最大似然估計(MLE)與最小二乘估計(LSE)的差別最大似然估計與最小二乘估計的差別最小二乘估計最大似然估計例題

2023-08-01 16:55:08

最大似然估計與最小二乘估計的差別

标簽（空格分隔）：機率論與數理統計

最小二乘估計

對于最小二乘估計來說，最合理的參數估計量應該使得模型能最好地拟合樣本資料，也就是估計值與觀測值之差的平方和最小。

設Q表示平方誤差， Yi 表示估計值， Ŷ i 表示觀測值，即 Q=∑ni=1(Yi−Ŷ i)2

最大似然估計

對于最大似然估計來說，最合理的參數估計量應該使得從模型中抽取該n組樣本的觀測值的機率最大，也就是機率分布函數或者似然函數最大。

顯然，最大似然估計需要已知這個機率分布函數，一般假設其滿足正态分布函數的特性，在這種情況下，最大似然估計與最小二乘估計是等價的，也就是估計的結果是相同的。

最大似然估計原理：

1. 當給定樣本 x1,x2,...,xn 時，定義似然函數為 L(θ)=f(x1,x2,...,xn;θ) ;

2. L(θ) 看做是 θ 的函數，最大似然估計就是用使 L(θ) 達到最大值的 θ̂ 去估計 θ ，這時稱 θ̂ 為 θ 的最大似然估計;

MLE的步驟：

1. 由總體分布導出樣本的聯合機率函數（或聯合密度）；

2. 把樣本聯合機率函數的自變量看成是已知常數，而把 θ 看做是自變量，得到似然函數 L(θ) ;

3. 求似然函數的最大值（常常取對數，然後求駐點）；

4. 用樣本值帶入得到參數的最大似然估計。

例題

設一個有偏的硬币，抛了100次，出現1次人頭，99次字。問用最大似然估計（ML）和最小均方誤差（LSE）估計出現人頭的機率哪個大？

LSE

設使用LSE估計，出現人頭的機率為 θ , 則出現字的機率為 1−θ 。

已知觀測量為：（觀測到的）出現人頭的機率為 1100 , （觀測到的）出現字的機率為 99100 ,則由最小二乘估計：

Q(θ)=argminθ∑1001(θ−θ̂ )2 =argminθ(1100−θ)2+[99100−(1−θ)]2∗99

令 ∂Q(θ)∂θ=0 ,解得 θ=1100 ;

ML

設使用ML估計，是以x服從伯努利分布， x∼B(朝上,θ) ,

則機率密度函數為：

P(x|θ)={θ,1−θ,if x 人頭朝上if x 字朝上

則連續100次試驗的似然函數為：

P(x1,x2,..x100|θ)=C1100θ1∗(1−θ)99=100∗θ1∗(1−θ)99

最大化似然函數，則 θ 至少為駐點，對似然函數取對數并求偏導：

lnP(x1,x2,..x100|θ)=ln100+lnθ+99ln(1−θ)

對 θ 求偏導為0，得到：

∂lnP(x1,x2,..x100|θ)∂θ=1θ−991−θ=0 , 解得 θ=1100.

兩者雖然得到的估計值是一樣的，但是原理完全不同，要對他們的推導過程非常清楚。

最大似然估計(MLE)與最小二乘估計(LSE)的差別最大似然估計與最小二乘估計的差別最小二乘估計最大似然估計例題

最大似然估計與最小二乘估計的差別

最小二乘估計

最大似然估計

例題

LSE

ML

繼續閱讀

信号的峰度和偏度信号的高階矩

Google Earth Engine（GEE）——python s2cloudless 進行 Sentinel-2 雲掩膜

信噪比與EbN0

聊聊生日悖論和生日攻擊

數理統計與描述性分析

二項分布與負二項分布卡片二項分布負二項分布示例

【優化充電】遺傳算法求解電動汽車充電管理優化問題【Matlab 1178期】

Human-level concept learning through probabilistic program induction

交叉熵損失函數二進制交叉熵損失函數多元交叉熵函數詳解

交叉熵損失函數原理和推導

模糊綜合評價模型一.概述二.經典集合和模糊集合的基本概念三.隸屬函數的三種确定方法四.應用：模糊綜合評價

泛統計理論初探——模型評估的驗證政策資料挖掘-模型驗證政策簡介

NILMTK——因子隐馬爾可夫之隐馬爾可夫1. 馬爾可夫鍊2.馬爾可夫模型3. 隐馬爾可夫模型4.HMM三種方式的實作5. hmmlearn應用

GMS：基于網格運動統計的快速極度魯棒的特征比對摘要1 簡介2 本文的方法3 應用于快速記分的網格架構4 實驗 5 結論

4 機率機器人 Probabilistic Robotics 擴充卡爾曼濾波算法1 前提介紹2 通過泰勒展式進行線性化3 擴充卡爾曼濾波算法（EKF）4 擴充卡爾曼濾波執行個體5 擴充卡爾曼濾波（EKF）公式推導6 擴充卡爾曼濾波的優缺點7 參考文獻

申請評分模型拒絕推斷（RI）方法申請評分模型拒絕推斷（RI）方法