推論統計學

推論統計學,或稱統計推斷(英語:Statistical inference),是利用資料分析推斷機率分布特性的過程。[1]推論統計分析對母體的特性進行推斷,例如通過檢定假設和導出估計量。通常假定觀測到的數據集是從較大母體中抽樣所得。
推論統計可與描述統計相對照。描述統計僅關注觀測數據本身的特性,並不以數據來自更大母體為前提。在機器學習中,「推斷」一詞有時被用來指「通過評估已訓練的模型進行預測」;[2]在此語境下,對模型特性的推斷稱為「訓練」或「學習」(而非「推斷」),而利用模型進行預測則稱為「推斷」(而非「預測」);另見預測推斷。
統計推斷的結果常用來決定下一步的做法,可能是進行更深入的試驗或問卷,或決定是否實施某項方案。
| 本文屬於 |
| 研究系列 |
|---|
| 哲学主题 |
引言
[编辑]統計推斷依據從母體中以某種抽樣方式抽取的數據,對母體做出命題。對於希望進行推斷的某個母體假設,統計推斷包含(一)選取描述數據生成過程的統計模型,以及(二)從模型推導出命題。[3]
Konishi 與 Kitagawa 指出:「統計推斷中的大多數問題,都可視為與統計建模相關的問題。」[4]與此相關,大衛·考克斯爵士曾說:「如何將實質問題轉化為統計模型,往往是分析中最關鍵的環節。」[5]
統計推斷的結論是一個統計命題。[6]常見的統計命題形式包括:
- 點估計,即最佳近似某參數的特定值;
- 區間估計,例如信賴區間(或集合估計)。信賴區間是利用樣本數據構建的區間,使得若重複進行許多次獨立抽樣(在數學上取極限),則固定比例(例如95%信賴區間對應95%)的結果區間會包含參數的真實值;
- 可信區間,即包含例如95%後驗信念的值的集合;
- 拒絕假設;[註 1]
- 將數據點聚類或分類成若干組別。
模型與假設
[编辑]任何統計推斷都需要若干假設。統計模型是一組關於觀測數據及類似數據生成方式的假設集合。統計模型的描述通常強調感興趣的母體量,即我們希望進行推斷的對象。[7]描述統計通常作為更正式推斷之前的初步步驟。[8]
模型/假設的層次
[编辑]統計學家將建模假設區分為三個層次:
- 完全參數型:描述數據生成過程的機率分布,假設可由只含有限個未知參數的機率分布族完全描述。[7]例如,可以假設母體值的分布確為常態分布,均值與變異數未知,且數據集由「簡單」隨機抽樣生成。廣義線性模型族是廣泛使用的靈活參數模型。
- 非參數型:對數據生成過程所作的假設遠少於參數統計,可以達到最低限度。[9]例如,每個連續機率分布都有中位數,可用樣本中位數或Hodges–Lehmann–Sen 估計量來估計,後者在數據來自簡單隨機抽樣時具有良好性質。
- 半參數型:這一術語通常意指介於完全參數型與非參數型之間的假設。例如,可以假設母體分布具有有限均值,並進一步假設母體中均值響應水準與某共變量呈真正線性關係(參數假設),但不對均值周圍的變異數作任何參數假設(即不對任何異方差性的存在或可能形式作假設)。更一般地,半參數模型通常可分為「結構」與「隨機變異」兩個分量,一個以參數方式處理,另一個以非參數方式處理。著名的 Cox 模型即為一套半參數假設。[10]
有效模型/假設的重要性
[编辑]
無論採用何種層次的假設,正確校準的推斷通常要求這些假設是正確的,即數據生成機制確實已被正確指定。
「簡單」隨機抽樣的錯誤假設可能使統計推斷失效。[11]更複雜的半參數和完全參數假設同樣值得警惕。例如,錯誤地假設 Cox 模型在某些情況下可能導致錯誤結論。[12]對母體常態性的錯誤假設也會使某些基於迴歸的推斷失效。[13]大多數人口抽樣專家對使用任何參數模型都持懷疑態度:「大多數抽樣統計學家在涉及信賴區間時,僅對基於非常大樣本的估計量作出陳述,因為中央極限定理保證這些估計量的分布近似常態。」[14]尤其是,常態分布「若用於任何類型的經濟學母體,將是一個完全不切實際且極為危險的假設」。[14]此處,中央極限定理指出:「對於非常大的樣本」,若分布無重尾,樣本均值的分布近似常態。
近似分布
[编辑]由於難以精確指定樣本統計量的分布,人們已發展出許多近似這些分布的方法。
對於有限樣本,近似結果衡量極限分布與統計量樣本分布之間的接近程度:例如,根據貝里-埃森定理,在有 10,000 個獨立樣本的情況下,常態分布能近似(精確到兩位有效數字)許多母體分布下樣本均值的分布。[15]然而在許多實際應用中,根據模擬研究和統計學家的經驗,當有 10 個或更多獨立樣本時,常態近似已能很好地逼近樣本均值的分布。[15]繼柯爾莫哥洛夫在 1950 年代的工作之後,現代統計學使用逼近理論和泛函分析來量化近似誤差。這一方法研究機率分布的度量幾何,以庫爾巴克-萊布勒散度、布雷格曼散度和海靈格距離等指標量化近似誤差。[16][17][18]
對於無限大的樣本,極限結果(如中央極限定理)描述樣本統計量在極限存在時的極限分布。極限結果並非關於有限樣本的陳述,對有限樣本確實毫無意義。[19][20][21]然而,對極限分布的漸近理論常被援引於有限樣本的研究。例如,極限結果常被援引以為廣義矩估計法和廣義估計方程提供正當性,後兩者在計量經濟學和生物統計學中廣受使用。極限分布與真實分布之差異(即近似的「誤差」)的量級可通過模擬進行評估。[22]將極限結果以啟發式方式應用於有限樣本,在許多應用中是常見做法,尤其是對具有對數凹概似函數的低維統計模型(如單參數指數族)。
基於隨機化的模型
[编辑]對於由隨機化設計產生的給定數據集,統計量的隨機化分布(在虛無假設下)定義為:對隨機化設計可能生成的所有方案評估檢定統計量。在頻率論推斷中,隨機化使推斷能夠基於隨機化分布而非主觀模型,這在調查抽樣和實驗設計中尤為重要。[23][24]來自隨機化研究的統計推斷也比許多其他情境更為直接。[25][26][27]在貝氏推斷中,隨機化同樣重要:在調查抽樣中,使用無放回抽樣確保樣本與母體的可交換性;在隨機化實驗中,隨機化為共變量資訊提供隨機缺失假設。[28]
客觀隨機化允許適當的歸納程序。[29][30][31][32][33]許多統計學家偏好對由明確隨機化程序生成的數據進行基於隨機化的分析。[34](然而,在具有成熟理論知識和實驗控制的科學領域中,隨機化實驗確實可能在不提升推斷質量的情況下增加實驗成本。[35][36])類似地,主要統計權威機構推薦隨機化實驗的結果,認為其比觀察性研究更具可靠性。[37]然而,一個良好的觀察性研究可能優於一個糟糕的隨機化實驗。
隨機化實驗的統計分析可以基於實驗方案中規定的隨機化方案,而不需要主觀模型。[38][39]
然而,某些假設在任何時候都無法使用能準確描述隨機化實驗或隨機樣本的客觀統計模型來檢驗。在某些情況下,此類隨機化研究不經濟或不符合倫理。
隨機實驗的模型分析
[编辑]在分析隨機化實驗的數據時,標準做法是援引統計模型,例如線性模型或邏輯斯迴歸模型。[40]然而,隨機化方案指導統計模型的選擇,若不了解隨機化方案,便無法選擇適當的模型。[24]在分析隨機化實驗數據時忽略實驗方案,可能導致嚴重誤導性的結果;常見錯誤包括忘記實驗中使用的區組設計,以及將同一實驗單元上的重複測量誤認為對不同實驗單元施加處理的獨立重複。[41]
無模型隨機化推斷
[编辑]無模型技術為基於模型的方法提供補充,後者採用簡化現實的還原論策略。前者結合、演化、整合並動態訓練演算法,以適應過程的情境相似性,並學習觀測值的內在特徵。[42][43]
例如,無模型簡單線性迴歸基於以下兩種設計之一:
- 隨機設計:觀測值對
獨立同分布(iid);
- 確定性設計:變數
為確定性的,但對應的響應變量
是隨機且獨立的,具有共同的條件分布,即
,與指標
無關。
在任一情況下,對共同條件分布 特徵的無模型隨機化推斷依賴某些正則條件,例如函數光滑性。例如,對母體特徵「條件均值」
的無模型隨機化推斷,在
光滑的假設下,可通過局部平均或局部多項式擬合進行一致估計。此外,依靠漸近常態性或重抽樣,可以構建母體特徵——即條件均值
——的信賴區間。[44]
推斷範式
[编辑]不同的統計推斷流派已各自確立。這些流派——或稱「範式」——並非互斥的,在一種範式下運作良好的方法,在其他範式下往往也有吸引人的詮釋。
Bandyopadhyay 與 Forster 描述了四種範式:古典(即頻率論)範式、貝氏範式、概似論者範式,以及基於赤池資訊量準則的範式。[45]
頻率論推斷
[编辑]此範式通過考慮對母體分布的(假想)重複抽樣(以生成類似於當前數據集的數據集)來校準命題的可信度。通過考察重複抽樣下數據集的特徵,可以量化統計命題的頻率論性質——儘管在實踐中,這種量化可能具有挑戰性。
頻率論推斷的例子
[编辑]頻率論推斷、客觀性與決策理論
[编辑]頻率論推斷(或古典推斷)的一種詮釋是:它僅適用於頻率機率的情境,即對母體進行重複抽樣的情境。然而,Neyman 的方法[46]是在實驗前機率的框架下發展這些程序的。也就是說,在進行實驗之前,先確定一個得出結論的規則,使得正確的機率受到適當控制:此類機率無需具有頻率論或重複抽樣的詮釋。相比之下,貝氏推斷使用條件機率(即以觀測數據為條件的機率),而頻率論方法使用邊際(但以未知參數為條件的)機率。
顯著性檢定和信賴區間的頻率論程序可以在不考慮效用函數的情況下構建。然而,頻率論統計的某些部分(如統計決策理論)確實涵蓋效用函數。[來源請求]特別是,最優推斷的頻率論發展(如最小方差無偏估計量或一致最強力檢定)使用損失函數,損失函數起到(負)效用函數的作用。統計學家無需明確陳述損失函數即可證明統計程序具有最優性。[47]然而,損失函數在陳述最優性時往往很有用:例如,中位數無偏估計量在絕對值損失函數下是最優的(它使期望損失最小),而最小平方估計量在平方誤差損失函數下是最優的。
使用頻率論推斷的統計學家必須自行選擇感興趣的參數及所用的估計量/檢定統計量,而缺乏明顯的顯式效用和先驗分布,使頻率論程序被廣泛視為「客觀的」。[48]
貝氏推斷
[编辑]貝氏演算使用機率的「語言」描述信念的程度;信念為正值,積分為一,並遵循機率公理。貝氏推斷使用可得的後驗信念作為提出統計命題的基礎。[49]使用貝氏方法有幾種不同的正當性理由。
貝氏推斷的例子
[编辑]貝氏推斷、主觀性與決策理論
[编辑]許多非正式貝氏推斷基於後驗的「直觀合理」摘要。例如,後驗均值、中位數和眾數、最高後驗密度區間以及貝氏因子都可以這種方式引入。雖然用戶無需陳述效用函數即可進行此類推斷,但這些摘要都在某種程度上依賴所陳述的先驗信念,通常被視為主觀結論。(無需外部輸入的先驗構建方法已被提出,但尚未完全發展。)
正式的貝氏推斷以明確陳述的效用函數或損失函數為校準標準;「貝氏規則」是使後驗不確定性下期望效用最大化的規則。因此,正式貝氏推斷在決策理論意義上自動提供最優決策。給定假設、數據和效用,幾乎任何問題都可以進行貝氏推斷,儘管並非每個統計推斷都需要具有貝氏詮釋。非正式貝氏分析在邏輯上可能是不一致的;使用適當先驗(即可積分為一的先驗)的貝氏程序的一個特徵是,它們保證是一致的。貝氏推斷的一些倡導者主張,推斷必須在此決策論框架內進行,且貝氏推斷不應以後驗信念的評估和總結作為結論。
基於概似函數的推斷
[编辑]基於概似函數的推斷是一種用於根據觀測數據估計統計模型參數的範式。概似論通過使用概似函數來處理統計問題,概似函數記為 ,量化在特定參數值集
下觀測到給定數據
的機率。在基於概似函數的推斷中,目標是找到使概似函數最大化的參數值集,等效地,最大化觀測到給定數據的機率。
基於概似函數的推斷過程通常涉及以下步驟:
- 建立統計模型:根據所面對的問題定義統計模型,指定分布假設以及觀測數據與未知參數之間的關係。模型可以是簡單的(如已知變異數的常態分布),也可以是複雜的(如具有多層隨機效應的層次模型)。
- 構建概似函數:給定統計模型,通過將觀測數據的聯合機率密度函數或質量函數作為未知參數的函數來構建概似函數。此函數表示在不同參數值下觀測到數據的機率。
- 最大化概似函數:下一步是找到使概似函數最大化的參數值集,可使用數值最優化演算法等技術實現。估計的參數值(通常記為
)即為最大概似估計量(MLE)。
- 評估不確定性:獲得最大概似估計量後,必須量化與參數估計相關的不確定性,可通過計算標準誤、信賴區間,或基於漸近理論或拔靴法等模擬技術進行假設檢定來實現。
- 模型檢驗:在獲得參數估計量並評估其不確定性之後,需要評估統計模型的適切性,包括檢查模型中的假設,以及使用擬合優度檢定、殘差分析或圖形診斷來評估模型對數據的擬合程度。
- 推斷與詮釋:最後,根據估計的參數和模型評估進行統計推斷,包括對母體參數得出結論、進行預測,或根據估計的模型檢定假設。
基於 AIC 的推斷
[编辑]赤池資訊量準則(AIC)是對給定數據集的統計模型相對質量的估計量。給定一組數據的模型集合,AIC 估計每個模型相對於其他各模型的質量,從而提供模型選擇的手段。
AIC 建立在資訊理論的基礎上:它提供一個估計量,衡量在使用給定模型表示生成數據的過程時,相對損失的資訊量。(在此過程中,它處理模型擬合優度與模型簡潔性之間的權衡。)
其他推斷範式
[编辑]最短描述長度
[编辑]最短描述長度(MDL)原則的發展源於資訊理論[50]和科爾莫哥洛夫複雜度理論的思想。[51]MDL 原則選取能最大程度壓縮數據的統計模型;推斷過程無需假設反事實或不可證偽的「數據生成機制」或數據的機率模型,而這在頻率論或貝氏方法中可能會發生。
然而,若現實中確實存在某「數據生成機制」,則根據夏農的信源編碼定理,它平均且漸近地提供了數據的 MDL 描述。[52]在最小化描述長度(或描述複雜性)方面,MDL 估計類似於最大概似估計和最大後驗概率估計(使用最大熵貝氏先驗)。然而,MDL 避免假設已知底層機率模型;MDL 原則也可以在不假設(例如)數據源自獨立抽樣的情況下應用。[52][53]
MDL 原則已被應用於資訊理論中的通信編碼理論、線性迴歸[53]和資料探勘。[51]
MDL 推斷程序的評估常使用計算複雜性理論中的技術或標準。[54]
信念推斷
[编辑]信念推斷是一種基於信念機率(又稱「信念分布」)的統計推斷方法。在後續研究中,這一方法被批評為定義不清、適用範圍極為有限,甚至是謬誤的。[55][56]然而,這一論點與以下論證相同[57]:所謂的信賴分布並非有效的機率分布,但這並未使信賴區間的應用失效,因此也不必然使從信念論據得出的結論失效。有人曾嘗試將費雪早期信念論據的工作重新詮釋為使用上下機率的推斷理論的特例。[58]
結構推斷
[编辑]喬治·巴納德在 1938 年至 1939 年間基於費雪和皮特曼的思想,[59]發展了「結構推斷」或「樞軸推斷」,[60]這是一種在群族上使用不變機率的方法。巴納德在信念推斷程序「定義明確且有用」的受限模型類上重新整理了信念推斷的論據。唐納德·弗雷澤基於群論為結構推斷建立了一套一般理論,[61]並將其應用於線性模型。[62]弗雷澤所建立的理論與決策理論和貝氏統計有密切聯繫,若最優頻率論決策規則存在,則能提供該規則。[63]
推斷主題
[编辑]以下主題通常被涵蓋在統計推斷的範疇之中。
預測推斷
[编辑]預測推斷是一種統計推斷方法,強調根據過去觀測值對未來觀測值的預測。
最初,預測推斷基於可觀測的參數,是研究機率的主要目的,[來源請求]但在二十世紀由於布魯諾·德菲內蒂所開創的新參數方法而失去青睞。這一方法將現象建模為帶有誤差的物理系統(例如天體力學)。德菲內蒂關於可交換性的思想——未來觀測應與過去觀測表現相似——隨著其 1937 年法文論文於 1974 年被譯成英文而引起英語世界的關注,[64]此後,這一思想由西摩·蓋賽爾等統計學家加以倡導。[65]
注释
[编辑]- ^ 根據皮爾斯的觀點,接受意味著對此問題的探究暫時告一段落。在科學中,所有科學理論均可被修訂。
参考文献
[编辑]- ^ Upton, G., Cook, I. (2008) Oxford Dictionary of Statistics, OUP. ISBN 978-0-19-954145-4.
- ^ TensorFlow Lite inference.
The term inference refers to the process of executing a TensorFlow Lite model on-device in order to make predictions based on input data.
- ^ Johnson, Richard. Statistical Inference. Encyclopedia of Mathematics. Springer: The European Mathematical Society. 12 March 2016 [26 October 2022].
- ^ Konishi & Kitagawa (2008), p. 75.
- ^ Cox (2006), p. 197.
- ^ Statistical inference - Encyclopedia of Mathematics. www.encyclopediaofmath.org. [2019-01-23].
- ^ 7.0 7.1 Cox (2006) page 2
- ^ Evans, Michael; et al. Probability and Statistics: The Science of Uncertainty. Freeman and Company. 2004: 267. ISBN 9780716747420.
- ^ van der Vaart, A.W. (1998) Asymptotic Statistics Cambridge University Press. ISBN 0-521-78450-6 (page 341)
- ^ Sestelo, Marta. A short course on Survival Analysis applied to the Financial Industry. (原始内容存档于Jan 16, 2026).
- ^ Kruskal 1988
- ^ Freedman, D.A. (2008) "Survival analysis: An Epidemiological hazard?". The American Statistician (2008) 62: 110-119. (Reprinted as Chapter 11 (pages 169–192) of Freedman (2010)).
- ^ Berk, R. (2003) Regression Analysis: A Constructive Critique (Advanced Quantitative Techniques in the Social Sciences) (v. 11) Sage Publications. ISBN 0-7619-2904-5
- ^ 14.0 14.1 Brewer, Ken. Combined Survey Sampling Inference: Weighing of Basu's Elephants. Hodder Arnold. 2002: 6. ISBN 978-0340692295.
- ^ 15.0 15.1 Jörgen Hoffman-Jörgensen's Probability With a View Towards Statistics, Volume I. Page 399 [需要完整来源]
- ^ Le Cam (1986) [页码请求]
- ^ Erik Torgerson (1991) Comparison of Statistical Experiments, volume 36 of Encyclopedia of Mathematics. Cambridge University Press. [需要完整来源]
- ^ Liese, Friedrich & Miescke, Klaus-J. Statistical Decision Theory: Estimation, Testing, and Selection. Springer. 2008. ISBN 978-0-387-73193-3.
- ^ Kolmogorov (1963, p.369): "The frequency concept, based on the notion of limiting frequency as the number of trials increases to infinity, does not contribute anything to substantiate the applicability of the results of probability theory to real practical problems where we have always to deal with a finite number of trials".
- ^ "Indeed, limit theorems 'as
tends to infinity' are logically devoid of content about what happens at any particular
. All they can do is suggest certain approaches whose performance must then be checked on the case at hand." — Le Cam (1986) (page xiv)
- ^ Pfanzagl (1994): "The crucial drawback of asymptotic theory: What we expect from asymptotic theory are results which hold approximately . . . . What asymptotic theory has to offer are limit theorems."(page ix) "What counts for applications are approximations, not limits." (page 188)
- ^ Pfanzagl (1994) : "By taking a limit theorem as being approximately true for large sample sizes, we commit an error the size of which is unknown. [. . .] Realistic information about the remaining errors may be obtained by simulations." (page ix)
- ^ Neyman, J.(1934) "On the two different aspects of the representative method: The method of stratified sampling and the method of purposive selection", Journal of the Royal Statistical Society, 97 (4), 557–625
- ^ 24.0 24.1 Hinkelmann and Kempthorne(2008) [页码请求]
- ^ ASA Guidelines for the first course in statistics for non-statisticians. (available at the ASA website)
- ^ David A. Freedman et alia's Statistics.
- ^ Moore et al. (2015).
- ^ Gelman A. et al. (2013). Bayesian Data Analysis (Chapman & Hall).
- ^ Peirce (1877-1878)
- ^ Peirce (1883)
- ^ Freedman, Pisani & Purves 1978.
- ^ David A. Freedman Statistical Models.
- ^ Rao, C.R. (1997) Statistics and Truth: Putting Chance to Work, World Scientific. ISBN 981-02-3111-3
- ^ Peirce; Freedman; Moore et al. (2015).[來源請求]
- ^ Box, G.E.P. and Friends (2006) Improving Almost Anything: Ideas and Essays, Revised Edition, Wiley. ISBN 978-0-471-72755-2
- ^ Cox (2006), p. 196.
- ^ ASA Guidelines for the first course in statistics for non-statisticians. (available at the ASA website)
- David A. Freedman et alias Statistics.
- Moore et al. (2015).
- ^ Neyman, Jerzy. 1923 [1990]. "On the Application of Probability Theory to AgriculturalExperiments. Essay on Principles. Section 9." Statistical Science 5 (4): 465–472. Trans. Dorota M. Dabrowska and Terence P. Speed.
- ^ Hinkelmann & Kempthorne (2008) [页码请求]
- ^ Dinov, Ivo; Palanimalai, Selvam; Khare, Ashwini; Christou, Nicolas. Randomization-based statistical inference: A resampling and simulation infrastructure. Teaching Statistics. 2018, 40 (2): 64–73. PMC 6155997
. PMID 30270947. doi:10.1111/test.12156.
- ^ Hinkelmann and Kempthorne (2008) Chapter 6.
- ^
Dinov, Ivo; Palanimalai, Selvam; Khare, Ashwini; Christou, Nicolas. Randomization-based statistical inference: A resampling and simulation infrastructure. Teaching Statistics. 2018, 40 (2): 64–73. PMC 6155997
. PMID 30270947. doi:10.1111/test.12156.
- ^
Tang, Ming; Gao, Chao; Goutman, Stephen; Kalinin, Alexandr; Mukherjee, Bhramar; Guan, Yuanfang; Dinov, Ivo. Model-Based and Model-Free Techniques for Amyotrophic Lateral Sclerosis Diagnostic Prediction and Patient Clustering. Neuroinformatics. 2019, 17 (3): 407–421. PMC 6527505
. PMID 30460455. doi:10.1007/s12021-018-9406-9.
- ^ Politis, D.N. Model-free inference in statistics: how and why. IMS Bulletin. 2019, 48.
- ^ Bandyopadhyay & Forster (2011). See the book's Introduction (p.3) and "Section III: Four Paradigms of Statistics".
- ^ Neyman, J. Outline of a Theory of Statistical Estimation Based on the Classical Theory of Probability. Philosophical Transactions of the Royal Society of London A. 1937, 236 (767): 333–380. Bibcode:1937RSPTA.236..333N. JSTOR 91337. doi:10.1098/rsta.1937.0005
.
- ^ Preface to Pfanzagl.
- ^ Little, Roderick J. Calibrated Bayes: A Bayes/Frequentist Roadmap. The American Statistician. 2006, 60 (3): 213–223. ISSN 0003-1305. JSTOR 27643780. S2CID 53505632. doi:10.1198/000313006X117837.
- ^ Lee, Se Yoon. Gibbs sampler and coordinate ascent variational inference: A set-theoretical review. Communications in Statistics - Theory and Methods. 2021, 51 (6): 1549–1568. S2CID 220935477. arXiv:2008.01006
. doi:10.1080/03610926.2021.1921214.
- ^ Soofi (2000)
- ^ 51.0 51.1 Hansen & Yu (2001)
- ^ 52.0 52.1 Hansen and Yu (2001), page 747.
- ^ 53.0 53.1 Rissanen (1989), page 84
- ^ Joseph F. Traub, G. W. Wasilkowski, and H. Wozniakowski. (1988) [页码请求]
- ^ Neyman (1956)
- ^ Zabell (1992)
- ^ Cox (2006) page 66
- ^ Hampel 2003.
- ^ Davison, page 12. [需要完整来源]
- ^ Barnard, G.A. (1995) "Pivotal Models and the Fiducial Argument", International Statistical Review, 63 (3), 309–323.
- ^ Fraser, D. A. S. The structure of inference. New York: Wiley. 1968. ISBN 0-471-27548-4. OCLC 440926.
- ^ Fraser, D. A. S. Inference and linear models. London: McGraw-Hill. 1979. ISBN 0-07-021910-9. OCLC 3559629.
- ^ Taraldsen, Gunnar; Lindqvist, Bo Henry. Fiducial theory and optimal inference. The Annals of Statistics. 2013-02-01, 41 (1). ISSN 0090-5364. S2CID 88520957. arXiv:1301.1717
. doi:10.1214/13-AOS1083.
- ^ De Finetti, Bruno. La Prévision: ses lois logiques, ses sources subjectives. Annales de l'Institut Henri Poincaré. 1937, 7 (1): 1–68. ISSN 0365-320X. Translated in De Finetti, Bruno. Foresight: Its Logical Laws, Its Subjective Sources. Breakthroughs in Statistics. Springer Series in Statistics. 1992: 134–174. ISBN 978-0-387-94037-3. doi:10.1007/978-1-4612-0919-5_10.
- ^ Geisser, Seymour (1993) Predictive Inference: An Introduction, CRC Press. ISBN 0-412-03471-9
- Bandyopadhyay, P. S.; Forster, M. R. (编), Philosophy of Statistics, Elsevier, 2011.
- Bickel, Peter J.; Doksum, Kjell A. Mathematical statistics: Basic and selected topics 1 Second (updated printing 2007). Prentice Hall. 2001. ISBN 0-13-850363-X. MR 0443141.
- Cox, D. R. (2006). Principles of Statistical Inference, Cambridge University Press. ISBN 0-521-68567-2.
- Fisher, R. A. (1955), “Statistical methods and scientific induction”, Journal of the Royal Statistical Society, Series B, 17, 69—78. (criticism of statistical theories of Jerzy Neyman and 沃德·亚伯拉罕)
- Freedman, D. A. Statistical Models: Theory and practice revised. Cambridge University Press. 2009: xiv+442 pp. ISBN 978-0-521-74385-3. MR 2489600.
- Freedman, D. A. (2010). Statistical Models and Causal Inferences: A Dialogue with the Social Sciences (Edited by David Collier, Jasjeet S. Sekhon, and Philip B. Stark), Cambridge University Press.
- Hampel, Frank. The proper fiducial argument (PDF) (Research Report No. 114). Feb 2003 [2016-03-29]. (原始内容存档 (PDF)于2017-05-10).
- Hansen, Mark H.; Yu, Bin. Model Selection and the Principle of Minimum Description Length: Review paper. Journal of the American Statistical Association. June 2001, 96 (454): 746–774. JSTOR 2670311. MR 1939352. doi:10.1198/016214501753168398. (原始内容存档于2004-11-16).
- Hinkelmann, Klaus; Kempthorne, Oscar. Introduction to Experimental Design Second. Wiley. 2008. ISBN 978-0-471-72756-9.
- Kolmogorov, Andrei N. On tables of random numbers. Sankhyā Ser. A. 1963, 25: 369–375. MR 0178484. Reprinted as Kolmogorov, Andrei N. On tables of random numbers. Theoretical Computer Science. 1998, 207 (2): 387–395. MR 1643414. doi:10.1016/S0304-3975(98)00075-9.
- Konishi S., Kitagawa G. (2008), Information Criteria and Statistical Modeling, Springer.
- Kruskal, William. Miracles and statistics: the casual assumption of independence (ASA Presidential Address). Journal of the American Statistical Association. December 1988, 83 (404): 929–940. JSTOR 2290117. doi:10.2307/2290117.
- Le Cam, Lucian. (1986) Asymptotic Methods of Statistical Decision Theory, Springer. ISBN 0-387-96307-3
- Moore, D. S.; McCabe, G. P.; Craig, B. A. (2015), Introduction to the Practice of Statistics, Eighth Edition, Macmillan.
- Neyman, Jerzy. Note on an article by Sir Ronald Fisher. Journal of the Royal Statistical Society, Series B. 1956, 18 (2): 288–294. JSTOR 2983716. (reply to Fisher 1955)
- Peirce, C. S. (1877–1878), “Illustrations of the logic of science” (series), Popular Science Monthly, vols. 12-13. Relevant individual papers:
- (1878 March), “The Doctrine of Chances”, Popular Science Monthly, v. 12, March issue, pp. 604 (页面存档备份,存于互联网档案馆)–615. Internet Archive Eprint.
- (1878 June), “The Order of Nature”, Popular Science Monthly, v. 13, pp. 203 (页面存档备份,存于互联网档案馆)–217. Internet Archive Eprint.
- (1878 August), “Deduction, Induction, and Hypothesis”, Popular Science Monthly, v. 13, pp. 470 (页面存档备份,存于互联网档案馆)–482. Internet Archive Eprint.
- Peirce, C. S. (1883), “A Theory of probable inference”, Studies in Logic, pp. 126-181 (页面存档备份,存于互联网档案馆), Little, Brown, and Company. (Reprinted 1983, John Benjamins Publishing Company, ISBN 90-272-3271-7)
- Pfanzagl, Johann; with the assistance of R. Hamböker. Parametric Statistical Theory. Berlin: Walter de Gruyter. 1994. ISBN 3-11-013863-8. MR 1291393.
- Rissanen, Jorma. Stochastic Complexity in Statistical Inquiry. Series in Computer Science 15. Singapore: World Scientific. 1989. ISBN 9971-5-0859-1. MR 1082556.
- Soofi, Ehsan S. Principal information-theoretic approaches (Vignettes for the Year 2000: Theory and Methods, ed. by George Casella). Journal of the American Statistical Association. December 2000, 95 (452): 1349–1353. JSTOR 2669786. MR 1825292. doi:10.1080/01621459.2000.10474346.
- Traub, Joseph F.; Wasilkowski, G. W.; Wozniakowski, H. Information-Based Complexity. Academic Press. 1988. ISBN 0-12-697545-0.
- Zabell, S. L. R. A. Fisher and Fiducial Argument. Statistical Science. Aug 1992, 7 (3): 369–387. JSTOR 2246073. doi:10.1214/ss/1177011233.
延伸阅读
[编辑]- Casella, G., Berger, R.L. (2001). Statistical Inference. Duxbury Press. ISBN 0-534-24312-6
- Freedman, D.A. Statistical models and shoe leather. Sociological Methodology. 1991, 21: 291–313. JSTOR 270939. doi:10.2307/270939.
- Held L., Bové D.S. (2014). Applied Statistical Inference—Likelihood and Bayes (Springer).
- Lenhard, Johannes. Models and Statistical Inference: the controversy between Fisher and Neyman–Pearson (PDF). British Journal for the Philosophy of Science. 2006, 57: 69–91 [2018-12-29]. doi:10.1093/bjps/axi152. (原始内容存档 (PDF)于2021-03-03).
- Lindley, D. Fiducial distribution and Bayes' theorem. Journal of the Royal Statistical Society, Series B. 1958, 20: 102–7.
- Rahlf, Thomas (2014). “Statistical Inference”, in Claude Diebolt, and Michael Haupert (eds.), “Handbook of Cliometrics (Springer Reference Series)”, Berlin/Heidelberg: Springer. http://www.springerreference.com/docs/html/chapterdbid/372458.html (页面存档备份,存于互联网档案馆)
- Reid, N.; Cox, D. R. On Some Principles of Statistical Inference. International Statistical Review. 2014, 83 (2): n/a. doi:10.1111/insr.12067.
- Young, G.A., Smith, R.L. (2005). Essentials of Statistical Inference, CUP. ISBN 0-521-83971-8
相关条目
[编辑]外部連結
[编辑]- MIT OpenCourseWare (页面存档备份,存于互联网档案馆): Statistical Inference
- NPTEL Statistical Inference (页面存档备份,存于互联网档案馆), youtube link (页面存档备份,存于互联网档案馆)
- Statistical induction and prediction