您的位置：首页 > 其它

softmax交叉熵与最大似然估计

2017-09-16 21:11 429 查看

其实我们常用的 softmax 交叉熵损失函数，和最大似然估计是等价的。

首先来看 softmax 交叉熵目标函数是什么样子的： 对于N个样本

obj=−∑nNy(n)jlogf(x(n);w)j=−∑nNlogf(x(n);w)j

j: 第 n 个样本属于第 j 类， f 代表神经网络。

如果用最大似然估计呢？即：最大化已出现的样本的概率

objlogobj=∏nNp(y(n)|f(x(n);w))=∑nNlogp(y(n)|f(x(n);w))=∑nNlogf(x(n);w)j

最大化上式等价于最小化负的上式，所以和 softmax 交叉熵是等价的。

所以，softmax 交叉熵也是想最大化已出现样本的概率。

内容来自用户分享和网络整理，不保证内容的准确性，如有侵权内容，可联系管理员处理

标签：

相关文章推荐

最大似然估计学习总结
机器学习：最大似然估计与最大后验概率估计
文本语言模型的参数估计方法--最大似然估计、MAP、贝叶斯估计
最大似然估计与最小二乘的解释
最大似然估计学习
文本语言模型的参数估计-最大似然估计、MAP及贝叶斯估计
参数估计-最大似然估计、MAP及贝叶斯估计
[转] 最大似然估计
最大似然估计（MLE）和最大后验概率（MAP）
最大似然估计
最小二乘与最大似然估计之间的关系
最大似然估计与最大后验概率的区别与联系
最大似然估计log likelihood
(常用算法2)矩估计与最大似然估计
最大似然估计、MAP、贝叶斯估计
最大似然估计与meanshift
补充资料——自己实现极大似然估计(最大似然估计)MLE
机器学习之--最大似然估计
最大似然估计_基本知识回顾

新的分享

一次教科书级别的Redis高可用架构设计实践 - Redis
曾光：北京这次的毒株不像国内流行类型
从PRD文档到产品上线，有哪些问题需要解决？
vue3自定义指令的使用
Oracle SQL性能优化最常用的40条建议 - ORACLE
程序员翻车常见反应，你中枪了吗？ - 职场生涯
新鲜开源：基于Prometheus的企业监控平台设计与实现 - 运维
嵌入式软件开发之程序架构设计-任务调度
【Java面试】请简单说一下你对受检异常和非受检异常的理解
奇安信更新招股书：第一季亏损过5亿，齐向东持股38%
艾瑞咨询：2020年中国后智能厨房案例研究报告
艾瑞咨询：2020年中国人工智能+物流发展研究报告

章节导航