惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

云风的 BLOG
云风的 BLOG
有赞技术团队
有赞技术团队
Simon Willison's Weblog
Simon Willison's Weblog
人人都是产品经理
人人都是产品经理
L
LINUX DO - 最新话题
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
A
Arctic Wolf
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
小众软件
小众软件
Jina AI
Jina AI
The Cloudflare Blog
P
Palo Alto Networks Blog
AWS News Blog
AWS News Blog
阮一峰的网络日志
阮一峰的网络日志
C
Cybersecurity and Infrastructure Security Agency CISA
Know Your Adversary
Know Your Adversary
T
Threat Research - Cisco Blogs
L
Lohrmann on Cybersecurity
NISL@THU
NISL@THU
G
GRAHAM CLULEY
Project Zero
Project Zero
博客园_首页
博客园 - 三生石上(FineUI控件)
罗磊的独立博客
Spread Privacy
Spread Privacy
WordPress大学
WordPress大学
Hugging Face - Blog
Hugging Face - Blog
Latest news
Latest news
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
C
Cisco Blogs
C
Cyber Attacks, Cyber Crime and Cyber Security
T
Tor Project blog
S
Securelist
V
Vulnerabilities – Threatpost
T
The Exploit Database - CXSecurity.com
C
CERT Recently Published Vulnerability Notes
IT之家
IT之家
Google DeepMind News
Google DeepMind News
爱范儿
爱范儿
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
The Last Watchdog
The Last Watchdog
T
Tenable Blog
宝玉的分享
宝玉的分享
S
Secure Thoughts
P
Privacy & Cybersecurity Law Blog
量子位
大猫的无限游戏
大猫的无限游戏
J
Java Code Geeks
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
Security Archives - TechRepublic
Security Archives - TechRepublic

博客园 - AI产品观察

公式截图怎么转LaTeX代码?这个免费工具一键搞定 免费白嫖Google顶尖算力?深度揭秘这个满血版Gemini 3 Pro体验入口 深度解析 VoGen:2026 年最强免费 AI 语音合成与情感克隆技术方案 分享一个网站,Crealens.ai - 可以免费体验 AI图像/视频 生成-编辑-创作 WriteRightly 这个AI 可以像教授一样批改论文 免费、快速、可靠:揭秘IsGPT如何精准检测AI内容 Crealens.ai 免费体验GPT-4o 生图+吉卜力风格化 目标检测-基于Pytorch实现Yolov3(1)- 搭建模型 01布尔模型&倒排索引 openpose模型在AI challenge人体骨骼关键点检测的表现 隐马尔可夫模型(HMM) 卷积神经网络经验-CS231n笔记 双显卡笔记本安装CUDA+theano、tensorflow环境 Exynos 4412 Uboot源码解析 隐马尔可夫模型 基于WDF的PCI/PCIe接口卡Windows驱动程序(5)-如何为硬件移植驱动程序 进程详解(1)——可能是最深入浅出的进程学习笔记 贪吃蛇游戏C语言源代码学习 经典功率谱估计及Matlab仿真 CAN总线(一)
概率生成模型
AI产品观察 · 2017-08-31 · via 博客园 - AI产品观察

对于一个分类问题,首先要有数据,然后需要找到一个模型f,定义loss function,最后找到表现最好的f的参数。

从概率上讲,分类问题其实就是根据训练数据估计新的数据属于哪一类的概率。

在讲概率生成模型前需要介绍高斯分布函数。

image

输入是特征向量x,输出是x的概率,高斯函数的形状由均值和协方差矩阵决定。

imageimage

首先假定训练数据的点服从高斯分布,那么我们需要找到训练数据背后的高斯分布,这样就能够给出新数据的概率。

如何找高斯分布模型呢?——使用极大似然估计的方法。

image

image

得到模型后就可以做分类了。

image

可以设定阈值,比如大于0.5就属于某一类。

image

事实上,对上述数据的分类准确率只有47%,即使考虑到其他维度的情况,准确率也只有64%.

因此需要改进模型,即两个高斯分布共享协方差矩阵,这样模型的参数就更少了。

image

image

改正后的模型准确率提高到74%,有意思的是分类边界变成线性的了。

image

可能最开始你就有疑问为什么要假定是高斯分布?其实这是视情况而定的,你也可以对二元特征使用伯努利分布。如果各项特征都独立,就变成了朴素贝叶斯分类器。

image

得到

image

下面从数学角度看看 z 是什么。

image

image

image

image

因为两个协方差矩阵是共享参数的:

image

最终得到z的表达式,其实是线性分类器。在概率模型中通过计算均值、协方差矩阵等来得到模型参数,

所以直接从训练数据中得到线性模型的参数不更好吗?

image

台湾大学 李宏毅 深度学习课程笔记:http://speech.ee.ntu.edu.tw/~tlkagk/courses/ML_2017/Lecture/Classification.mp4