您的位置：首页 > 其它

自然语言和机器学习笔记

2013-06-19 10:30 204 查看

信息熵（Information Entropy）

    信息熵是衡量分布的混乱程度或分散程度的一种度量。分布越分散（或者分布越平均），信息熵就越大。分布越有序（或者说分布越集中），信息熵就越小。

    计算给定的样本集X的信息熵的公式：

Entropy(X) = ∑-pi log2pi
    信息熵越大表示样本集S分类越分散，信息熵越小则表明样本集X分类越集中。当S中n个分类出现的概率一样大时（都是1/n），信息熵取最大值log2(n)。当X只有一个分类时，信息熵取最小值0。

参考资料：

to

be

continued

内容来自用户分享和网络整理，不保证内容的准确性，如有侵权内容，可联系管理员处理

标签： NLP 机器学习自然语言

相关文章推荐

R语言机器学习笔记——垃圾邮件分类
R语言学习笔记-机器学习1-3章
自然语言期末复习笔记-Formal Grammars Of English
自然语言期末复习笔记—Morphological Analysis
自然语言期末复习笔记—神经网络语言模型NPLM
自然语言期末复习笔记—最大熵马尔科夫模型MEMM
机器学习和深度学习笔记（Matlab语言实现）
【年度技术观点合集】计算机视觉，自然语言，机器学习…看看顶级科学家们怎么说
本文转自“我爱自然语言处理”：www.52nlp.cn ----立委随笔：机器学习和自然语言处理
R语言与机器学习中的回归方法学习笔记
机器学习笔记之R语言基础篇4
自然语言16.1_Python自然语言处理学习笔记之信息提取步骤&分块（chunking）
笔记：自然语言的计算机处理
自然语言情感倾向分析笔记
机器学习笔记之R语言基础篇3（概率分布1）
自然语言期末复习笔记—最大熵模型
统计自然语言学习笔记（Manning）：第1章
机器学习笔记之R语言基础篇1
《JavaScript 语言精髓与编程实践》第二章笔记
渥瑞达 Linux Unix下C语言软件开发视频教程笔记4

新的分享

一次教科书级别的Redis高可用架构设计实践 - Redis
曾光：北京这次的毒株不像国内流行类型
从PRD文档到产品上线，有哪些问题需要解决？
vue3自定义指令的使用
Oracle SQL性能优化最常用的40条建议 - ORACLE
程序员翻车常见反应，你中枪了吗？ - 职场生涯
新鲜开源：基于Prometheus的企业监控平台设计与实现 - 运维
嵌入式软件开发之程序架构设计-任务调度
【Java面试】请简单说一下你对受检异常和非受检异常的理解
奇安信更新招股书：第一季亏损过5亿，齐向东持股38%
艾瑞咨询：2020年中国后智能厨房案例研究报告
艾瑞咨询：2020年中国人工智能+物流发展研究报告

章节导航