数学之美系列十六（下）－不要把所有的鸡蛋放在一个篮子里　最大熵模型

liuxinglanyue

浏览: 572669 次
性别:
来自: 杭州

最近访客更多访客>>

hui963966800

lhc98

guoshun0321

kidding87

博主相关

博客

微博

相册

留言

关于我

文章分类

社区版块

存档分类

2011-02 ( 10)
2011-01 ( 22)
2010-12 ( 165)
更多存档...

博客分类：

主题爬虫

算法 IBM IIS 网络应用金融

我们上次谈到用最大熵模型可以将各种信息综合在一起。我们留下一个问题没有回答，就是如何构造最大熵模型。我们已经所有的最大熵模型都是指数函数的形式，现在只需要确定指数函数的参数就可以了，这个过程称为模型的训练。

最原始的最大熵模型的训练方法是一种称为通用迭代算法 GIS(generalized iterative scaling) 的迭代算法。GIS 的原理并不复杂，大致可以概括为以下几个步骤：
1. 假定第零次迭代的初始模型为等概率的均匀分布。
2. 用第 N 次迭代的模型来估算每种信息特征在训练数据中的分布，如果超过了实际的，就把相应的模型参数变小；否则，将它们便大。
3. 重复步骤 2 直到收敛。

GIS 最早是由 Darroch 和 Ratcliff 在七十年代提出的。但是，这两人没有能对这种算法的物理含义进行很好地解释。后来是由数学家希萨（Csiszar)解释清楚的，因此，人们在谈到这个算法时，总是同时引用 Darroch 和Ratcliff 以及希萨的两篇论文。GIS 算法每次迭代的时间都很长，需要迭代很多次才能收敛，而且不太稳定，即使在 64 位计算机上都会出现溢出。因此，在实际应用中很少有人真正使用 GIS。大家只是通过它来了解最大熵模型的算法。

八十年代，很有天才的孪生兄弟的达拉皮垂(Della Pietra)在 IBM 对 GIS 算法进行了两方面的改进，提出了改进迭代算法 IIS（improved iterative scaling）。这使得最大熵模型的训练时间缩短了一到两个数量级。这样最大熵模型才有可能变得实用。即使如此，在当时也只有 IBM 有条件是用最大熵模型。

由于最大熵模型在数学上十分完美，对科学家们有很大的诱惑力，因此不少研究者试图把自己的问题用一个类似最大熵的近似模型去套。谁知这一近似，最大熵模型就变得不完美了，结果可想而知，比打补丁的凑合的方法也好不了多少。于是，不少热心人又放弃了这种方法。第一个在实际信息处理应用中验证了最大熵模型的优势的，是宾夕法尼亚大学马库斯的另一个高徒原 IBM 现微软的研究员拉纳帕提(Adwait Ratnaparkhi)。拉纳帕提的聪明之处在于他没有对最大熵模型进行近似，而是找到了几个最适合用最大熵模型、而计算量相对不太大的自然语言处理问题，比如词性标注和句法分析。拉纳帕提成功地将上下文信息、词性（名词、动词和形容词等）、句子成分（主谓宾）通过最大熵模型结合起来，做出了当时世界上最好的词性标识系统和句法分析器。拉纳帕提的论文发表后让人们耳目一新。拉纳帕提的词性标注系统，至今仍然是使用单一方法最好的系统。科学家们从拉纳帕提的成就中，又看到了用最大熵模型解决复杂的文字信息处理的希望。

但是，最大熵模型的计算量仍然是个拦路虎。我在学校时花了很长时间考虑如何简化最大熵模型的计算量。终于有一天，我对我的导师说，我发现一种数学变换，可以将大部分最大熵模型的训练时间在 IIS 的基础上减少两个数量级。我在黑板上推导了一个多小时，他没有找出我的推导中的任何破绽，接着他又回去想了两天，然后告诉我我的算法是对的。从此，我们就建造了一些很大的最大熵模型。这些模型比修修补补的凑合的方法好不少。即使在我找到了快速训练算法以后，为了训练一个包含上下文信息，主题信息和语法信息的文法模型(language model)，我并行使用了 20 台当时最快的 SUN 工作站，仍然计算了三个月。由此可见最大熵模型的复杂的一面。最大熵模型快速算法的实现很复杂，到今天为止，世界上能有效实现这些算法的人也不到一百人。有兴趣实现一个最大熵模型的读者可以阅读我的论文。

最大熵模型，可以说是集简与繁于一体，形式简单，实现复杂。值得一提的是，在Google的很多产品中，比如机器翻译，都直接或间接地用到了最大熵模型。

讲到这里，读者也许会问，当年最早改进最大熵模型算法的达拉皮垂兄弟这些年难道没有做任何事吗？他们在九十年代初贾里尼克离开 IBM 后，也退出了学术界，而到在金融界大显身手。他们两人和很多 IBM 语音识别的同事一同到了一家当时还不大，但现在是世界上最成功对冲基金(hedge fund)公司----文艺复兴技术公司 (Renaissance Technologies)。我们知道，决定股票涨落的因素可能有几十甚至上百种，而最大熵方法恰恰能找到一个同时满足成千上万种不同条件的模型。达拉皮垂兄弟等科学家在那里，用于最大熵模型和其他一些先进的数学工具对股票预测，获得了巨大的成功。从该基金 1988 年创立至今，它的净回报率高达平均每年 34%。也就是说，如果 1988 年你在该基金投入一块钱，今天你能得到 200 块钱。这个业绩，远远超过股神巴菲特的旗舰公司伯克夏哈撒韦（Berkshire Hathaway)。同期，伯克夏哈撒韦的总回报是 16 倍。

值得一提的是，信息处理的很多数学手段，包括隐含马尔可夫模型、子波变换、贝叶斯网络等等，在华尔街多有直接的应用。由此可见，数学模型的作用。

分享到：

数学之美系列十七闪光的不一定是金子 ... | 数学之美系列十六（上）不要把所有的鸡 ...

2010-11-26 22:27
浏览 947
评论(0)
分类:编程语言
查看更多

发表评论

您还没有登录,请您登录后再发表评论

相关推荐

3. 快速排序里的学问：信息熵1: 这是因为最大熵模型不依赖于任何主观假设，只根据已知条件来预测，这与“不要把所有的鸡蛋放在一个篮子里”的原则相吻合，意味着面对不确定性时，要保留所有可能性，以获取最客观的结果。总结来说，信息熵是一个...

谷歌黑板报: #### 最大熵模型：不要把所有的鸡蛋放在一个篮子里最大熵模型是一种统计模型，强调在已知条件下最大化不确定性。在NLP中，它被用于分类和标注任务，通过平衡各种假设和限制，避免过拟合和偏差，提供更可靠的结果。...

基于模糊故障树的工业控制系统可靠性分析与Python实现: 内容概要：本文探讨了模糊故障树（FFTA）在工业控制系统可靠性分析中的应用，解决了传统故障树方法无法处理不确定数据的问题。文中介绍了模糊数的基本概念和实现方式，如三角模糊数和梯形模糊数，并展示了如何用Python实现模糊与门、或门运算以及系统故障率的计算。此外，还详细讲解了最小割集的查找方法、单元重要度的计算，并通过实例说明了这些方法的实际应用场景。最后，讨论了模糊运算在处理语言变量方面的优势，强调了在可靠性分析中处理模糊性和优化计算效率的重要性。适合人群：从事工业控制系统设计、维护的技术人员，以及对模糊数学和可靠性分析感兴趣的科研人员。使用场景及目标：适用于需要评估复杂系统可靠性的场合，特别是在面对不确定数据时，能够提供更准确的风险评估。目标是帮助工程师更好地理解和预测系统故障，从而制定有效的预防措施。其他说明：文中提供的代码片段和方法可用于初步方案验证和技术探索，但在实际工程项目中还需进一步优化和完善。

风力发电领域双馈风力发电机（DFIG）Simulink模型的构建与电流电压波形分析: 内容概要：本文详细探讨了双馈风力发电机（DFIG）在Simulink环境下的建模方法及其在不同风速条件下的电流与电压波形特征。首先介绍了DFIG的基本原理，即定子直接接入电网，转子通过双向变流器连接电网的特点。接着阐述了Simulink模型的具体搭建步骤，包括风力机模型、传动系统模型、DFIG本体模型和变流器模型的建立。文中强调了变流器控制算法的重要性，特别是在应对风速变化时，通过实时调整转子侧的电压和电流，确保电流和电压波形的良好特性。此外，文章还讨论了模型中的关键技术和挑战，如转子电流环控制策略、低电压穿越性能、直流母线电压脉动等问题，并提供了具体的解决方案和技术细节。最终，通过对故障工况的仿真测试，验证了所建模型的有效性和优越性。适用人群：从事风力发电研究的技术人员、高校相关专业师生、对电力电子控制系统感兴趣的工程技术人员。使用场景及目标：适用于希望深入了解DFIG工作原理、掌握Simulink建模技能的研究人员；旨在帮助读者理解DFIG在不同风速条件下的动态响应机制，为优化风力发电系统的控制策略提供理论依据和技术支持。其他说明：文章不仅提供了详细的理论解释，还附有大量Matlab/Simulink代码片段，便于读者进行实践操作。同时，针对一些常见问题给出了实用的调试技巧，有助于提高仿真的准确性和可靠性。

基于西门子S7-200 PLC和组态王的八层电梯控制系统设计与实现: 内容概要：本文详细介绍了基于西门子S7-200 PLC和组态王软件构建的八层电梯控制系统。首先阐述了系统的硬件配置，包括PLC的IO分配策略，如输入输出信号的具体分配及其重要性。接着深入探讨了梯形图编程逻辑，涵盖外呼信号处理、轿厢运动控制以及楼层判断等关键环节。随后讲解了组态王的画面设计，包括动画效果的实现方法，如楼层按钮绑定、轿厢移动动画和门开合效果等。最后分享了一些调试经验和注意事项，如模拟困人场景、防抖逻辑、接线艺术等。适合人群：从事自动化控制领域的工程师和技术人员，尤其是对PLC编程和组态软件有一定基础的人群。使用场景及目标：适用于需要设计和实施小型电梯控制系统的工程项目。主要目标是帮助读者掌握PLC编程技巧、组态画面设计方法以及系统联调经验，从而提高项目的成功率。其他说明：文中提供了详细的代码片段和调试技巧，有助于读者更好地理解和应用相关知识点。此外，还强调了安全性和可靠性方面的考量，如急停按钮的正确接入和硬件互锁设计等。

CarSim与Simulink联合仿真：基于MPC模型预测控制实现智能超车换道: 内容概要：本文介绍了如何将CarSim的动力学模型与Simulink的智能算法相结合，利用模型预测控制(MPC)实现车辆的智能超车换道。主要内容包括MPC控制器的设计、路径规划算法、联合仿真的配置要点以及实际应用效果。文中提供了详细的代码片段和技术细节，如权重矩阵设置、路径跟踪目标函数、安全超车条件判断等。此外，还强调了仿真过程中需要注意的关键参数配置，如仿真步长、插值设置等，以确保系统的稳定性和准确性。适合人群：从事自动驾驶研究的技术人员、汽车工程领域的研究人员、对联合仿真感兴趣的开发者。使用场景及目标：适用于需要进行自动驾驶车辆行为模拟的研究机构和企业，旨在提高超车换道的安全性和效率，为自动驾驶技术研发提供理论支持和技术验证。其他说明：随包提供的案例文件已调好所有参数，可以直接导入并运行，帮助用户快速上手。文中提到的具体参数和配置方法对于初学者非常友好，能够显著降低入门门槛。

基于单片机的鱼缸监测设计(51+1602+AD0809+18B20+UART+JKx2)#0107: 包括：源程序工程文件、Proteus仿真工程文件、论文材料、配套技术手册等 1、采用51单片机作为主控； 2、采用AD0809(仿真0808)检测"PH、氨、亚硝酸盐、硝酸盐"模拟传感； 3、采用DS18B20检测温度； 4、采用1602液晶显示检测值； 5、检测值同时串口上传，调试助手监看； 6、亦可通过串口指令对加热器、制氧机进行控制；

风电领域双馈永磁风电机组并网仿真及短路故障分析与MPPT控制: 内容概要：本文详细介绍了双馈永磁风电机组并网仿真模型及其短路故障分析方法。首先构建了一个9MW风电场模型，由6台1.5MW双馈风机构成，通过升压变压器连接到120kV电网。文中探讨了风速模块的设计，包括渐变风、阵风和随疾风的组合形式，并提供了相应的Python和MATLAB代码示例。接着讨论了双闭环控制策略，即功率外环和电流内环的具体实现细节，以及MPPT控制用于最大化风能捕获的方法。此外，还涉及了短路故障模块的建模，包括三相电压电流特性和离散模型与phasor模型的应用。最后，强调了永磁同步机并网模型的特点和注意事项。适合人群：从事风电领域研究的技术人员、高校相关专业师生、对风电并网仿真感兴趣的工程技术人员。使用场景及目标：适用于风电场并网仿真研究，帮助研究人员理解和优化风电机组在不同风速条件下的性能表现，特别是在短路故障情况下的应对措施。目标是提高风电系统的稳定性和可靠性。其他说明：文中提供的代码片段和具体参数设置有助于读者快速上手并进行实验验证。同时提醒了一些常见的错误和需要注意的地方，如离散化步长的选择、初始位置对齐等。

空手道训练测试系统BLE106版本: 适用于空手道训练和测试场景

【音乐创作领域AI提示词】AI音乐提示词（deepseek,豆包,kimi,chatGPT,扣子空间,manus,AI训练师）: 内容概要：本文介绍了金牌音乐作词大师的角色设定、背景经历、偏好特点、创作目标、技能优势以及工作流程。金牌音乐作词大师凭借深厚的音乐文化底蕴和丰富的创作经验，能够为不同风格的音乐创作歌词，擅长将传统文化元素与现代流行文化相结合，创作出既富有情感又触动人心的歌词。在创作过程中，会严格遵守社会主义核心价值观，尊重用户需求，提供专业修改建议，确保歌词内容健康向上。; 适合人群：有歌词创作需求的音乐爱好者、歌手或音乐制作人。; 使用场景及目标：①为特定主题或情感创作歌词，如爱情、励志等；②融合传统与现代文化元素创作独特风格的歌词；③对已有歌词进行润色和优化。; 阅读建议：阅读时可以重点关注作词大师的创作偏好、技能优势以及工作流程，有助于更好地理解如何创作出高质量的歌词。同时，在提出创作需求时，尽量详细描述自己的情感背景和期望，以便获得更贴合心意的作品。

linux之用户管理教程.md: linux之用户管理教程.md

基于单片机的搬运机器人设计(51+1602+L298+BZ+KEY6)#0096: 包括：源程序工程文件、Proteus仿真工程文件、配套技术手册等 1、采用51/52单片机作为主控芯片； 2、采用1602液晶显示设置及状态； 3、采用L298驱动两个电机，模拟机械臂动力、移动底盘动力； 3、首先按键配置-待搬运物块的高度和宽度（为0不能开始搬运）； 4、按下启动键开始搬运，搬运流程如下：机械臂先把物块抓取到机器车上，机械臂减速机器车带着物块前往目的地机器车减速机械臂把物块放下来机械臂减速机器车回到物块堆积处（此时机器车是空车）机器车减速蜂鸣器提醒按下复位键，结束本次搬运

基于下垂控制的三相逆变器电压电流双闭环仿真及MATLAB/Simulink/PLECS实现: 内容概要：本文详细介绍了基于下垂控制的三相逆变器电压电流双闭环控制的仿真方法及其在MATLAB/Simulink和PLECS中的具体实现。首先解释了下垂控制的基本原理，即有功调频和无功调压，并给出了相应的数学表达式。随后讨论了电压环和电流环的设计与参数整定，强调了两者带宽的差异以及PI控制器的参数选择。文中还提到了一些常见的调试技巧，如锁相环的响应速度、LC滤波器的谐振点处理、死区时间设置等。此外，作者分享了一些实用的经验，如避免过度滤波、合理设置采样周期和下垂系数等。最后，通过突加负载测试展示了系统的动态响应性能。适合人群：从事电力电子、微电网研究的技术人员，尤其是有一定MATLAB/Simulink和PLECS使用经验的研发人员。使用场景及目标：适用于希望深入了解三相逆变器下垂控制机制的研究人员和技术人员，旨在帮助他们掌握电压电流双闭环控制的具体实现方法，提高仿真的准确性和效率。其他说明：本文不仅提供了详细的理论讲解，还结合了大量的实战经验和调试技巧，有助于读者更好地理解和应用相关技术。

光伏并网逆变器全栈开发资料：硬件设计、控制算法及实战经验: 内容概要：本文详细介绍了光伏并网逆变器的全栈开发资料，涵盖了从硬件设计到控制算法的各个方面。首先，文章深入探讨了功率接口板的设计，包括IGBT缓冲电路、PCB布局以及EMI滤波器的具体参数和设计思路。接着，重点讲解了主控DSP板的核心控制算法，如MPPT算法的实现及其注意事项。此外，还详细描述了驱动扩展板的门极驱动电路设计，特别是光耦隔离和驱动电阻的选择。同时，文章提供了并联仿真的具体实现方法，展示了环流抑制策略的效果。最后，分享了许多宝贵的实战经验和调试技巧，如主变压器绕制、PWM输出滤波、电流探头使用等。适合人群：从事电力电子、光伏系统设计的研发工程师和技术爱好者。使用场景及目标：①帮助工程师理解和掌握光伏并网逆变器的硬件设计和控制算法；②提供详细的实战经验和调试技巧，提升产品的可靠性和性能；③适用于希望深入了解光伏并网逆变器全栈开发的技术人员。其他说明：文中不仅提供了具体的电路设计和代码实现，还分享了许多宝贵的实际操作经验和常见问题的解决方案，有助于提高开发效率和产品质量。

机器人轨迹规划中粒子群优化与3-5-3多项式结合的时间最优路径规划: 内容概要：本文详细介绍了粒子群优化（PSO）算法与3-5-3多项式相结合的方法，在机器人轨迹规划中的应用。首先解释了粒子群算法的基本原理及其在优化轨迹参数方面的作用，随后阐述了3-5-3多项式的数学模型，特别是如何利用不同阶次的多项式确保轨迹的平滑过渡并满足边界条件。文中还提供了具体的Python代码实现，展示了如何通过粒子群算法优化时间分配，使3-5-3多项式生成的轨迹达到时间最优。此外，作者分享了一些实践经验，如加入惩罚项以避免超速，以及使用随机扰动帮助粒子跳出局部最优。适合人群：对机器人运动规划感兴趣的科研人员、工程师和技术爱好者，尤其是有一定编程基础并对优化算法有初步了解的人士。使用场景及目标：适用于需要精确控制机器人运动的应用场合，如工业自动化生产线、无人机导航等。主要目标是在保证轨迹平滑的前提下，尽可能缩短运动时间，提高工作效率。其他说明：文中不仅给出了理论讲解，还有详细的代码示例和调试技巧，便于读者理解和实践。同时强调了实际应用中需要注意的问题，如系统的建模精度和安全性考量。

【KUKA 机器人资料】：kuka机器人压铸欧洲标准.pdf: KUKA机器人相关资料

光子晶体中BIC与OAM激发的模拟及三维Q值计算: 内容概要：本文详细探讨了光子晶体中的束缚态在连续谱中（BIC）及其与轨道角动量（OAM）激发的关系。首先介绍了光子晶体的基本概念和BIC的独特性质，随后展示了如何通过Python代码模拟二维光子晶体中的BIC，并解释了BIC在光学器件中的潜在应用。接着讨论了OAM激发与BIC之间的联系，特别是BIC如何增强OAM激发效率。文中还提供了使用有限差分时域（FDTD）方法计算OAM的具体步骤，并介绍了计算本征态和三维Q值的方法。此外，作者分享了一些实验中的有趣发现，如特定条件下BIC表现出OAM特征，以及不同参数设置对Q值的影响。适合人群：对光子晶体、BIC和OAM感兴趣的科研人员和技术爱好者，尤其是从事微纳光子学研究的专业人士。使用场景及目标：适用于希望通过代码模拟深入了解光子晶体中BIC和OAM激发机制的研究人员。目标是掌握BIC和OAM的基础理论，学会使用Python和其他工具进行模拟，并理解这些现象在实际应用中的潜力。其他说明：文章不仅提供了详细的代码示例，还分享了许多实验心得和技巧，帮助读者避免常见错误，提高模拟精度。同时，强调了物理离散化方式对数值计算结果的重要影响。

C#联合Halcon 17.12构建工业视觉项目的配置与应用: 内容概要：本文详细介绍了如何使用C#和Halcon 17.12构建一个功能全面的工业视觉项目。主要内容涵盖项目配置、Halcon脚本的选择与修改、相机调试、模板匹配、生产履历管理、历史图像保存以及与三菱FX5U PLC的以太网通讯。文中不仅提供了具体的代码示例，还讨论了实际项目中常见的挑战及其解决方案，如环境配置、相机控制、模板匹配参数调整、PLC通讯细节、生产数据管理和图像存储策略等。适合人群：从事工业视觉领域的开发者和技术人员，尤其是那些希望深入了解C#与Halcon结合使用的专业人士。使用场景及目标：适用于需要开发复杂视觉检测系统的工业应用场景，旨在提高检测精度、自动化程度和数据管理效率。具体目标包括但不限于：实现高效的视觉处理流程、确保相机与PLC的无缝协作、优化模板匹配算法、有效管理生产和检测数据。其他说明：文中强调了框架整合的重要性，并提供了一些实用的技术提示，如避免不同版本之间的兼容性问题、处理实时图像流的最佳实践、确保线程安全的操作等。此外，还提到了一些常见错误及其规避方法，帮助开发者少走弯路。

基于Matlab的9节点配电网中分布式电源接入对节点电压影响的研究: 内容概要：本文探讨了分布式电源（DG）接入对9节点配电网节点电压的影响。首先介绍了9节点配电网模型的搭建方法，包括定义节点和线路参数。然后，通过在特定节点接入分布式电源，利用Matlab进行潮流计算，模拟DG对接入点及其周围节点电压的影响。最后，通过绘制电压波形图，直观展示了不同DG容量和接入位置对配电网电压分布的具体影响。此外，还讨论了电压越限问题以及不同线路参数对电压波动的影响。适合人群：电力系统研究人员、电气工程学生、从事智能电网和分布式能源研究的专业人士。使用场景及目标：适用于研究分布式电源接入对配电网电压稳定性的影响，帮助优化分布式电源的规划和配置，确保电网安全稳定运行。其他说明：文中提供的Matlab代码和图表有助于理解和验证理论分析，同时也为后续深入研究提供了有价值的参考资料。

电力市场领域中基于CVaR风险评估的省间交易商最优购电模型研究与实现: 内容概要：本文探讨了在两级电力市场环境中，针对省间交易商的最优购电模型的研究。文中提出了一个双层非线性优化模型，用于处理省内电力市场和省间电力交易的出清问题。该模型采用CVaR（条件风险价值）方法来评估和管理由新能源和负荷不确定性带来的风险。通过KKT条件和对偶理论，将复杂的双层非线性问题转化为更易求解的线性单层问题。此外，还通过实际案例验证了模型的有效性，展示了不同风险偏好设置对购电策略的影响。适合人群：从事电力系统规划、运营以及风险管理的专业人士，尤其是对电力市场机制感兴趣的学者和技术专家。使用场景及目标：适用于希望深入了解电力市场运作机制及其风险控制手段的研究人员和技术开发者。主要目标是为省间交易商提供一种科学有效的购电策略，以降低风险并提高经济效益。其他说明：文章不仅介绍了理论模型的构建过程，还包括具体的数学公式推导和Python代码示例，便于读者理解和实践。同时强调了模型在实际应用中存在的挑战，如数据精度等问题，并指出了未来改进的方向。

最近访客 更多访客>>

博主相关

文章分类

社区版块

存档分类

最新评论