複合ポアソン分布

確率論において、複合ポアソン分布とは、複数の独立かつ同一分布に従う確率変数の和の確率分布であり、加算される項の数自体がポアソン分布に従う変数である。結果は連続分布または離散分布のいずれかとなる。

意味

仮に

N\sim \operatorname {Poisson} (\lambda ),

すなわち、Nは、その分布が期待値λのポアソン分布に従う確率変数であり、

X_{1},X_{2},X_{3},\dots

は互いに独立で、かつNにも依存しない同一分布に従う確率変数である。したがって、 iid確率変数の和の確率分布は $N$

Y=\sum _{n=1}^{N}X_{n}

複合ポアソン分布です。

N = 0の場合、これは 0 項の合計なので、Yの値は 0 になります。したがって、 N = 0を与えられたYの条件付き分布は退化した分布です。

複合ポアソン分布は、 ( Y、N )の結合分布をN上で周辺化することによって得られ、この結合分布は条件付き分布Y | NとNの周辺分布を組み合わせることによって得られます。

プロパティ

複合分布の期待値と分散は、総期待値の法則と総分散の法則から簡単に導くことができる。つまり、

\operatorname {E} (Y)=\operatorname {E} \left[\operatorname {E} (Y\mid N)\right]=\operatorname {E} \left[N\operatorname {E} (X)\right]=\operatorname {E} (N)\operatorname {E} (X),

{\begin{aligned}\operatorname {Var} (Y)&=\operatorname {E} \left[\operatorname {Var} (Y\mid N)\right]+\operatorname {Var} \left[\operatorname {E} (Y\mid N)\right]=\operatorname {E} \left[N\operatorname {Var} (X)\right]+\operatorname {Var} \left[N\operatorname {E} (X)\right],\\[6pt]&=\operatorname {E} (N)\operatorname {Var} (X)+\left(\operatorname {E} (X)\right)^{2}\operatorname {Var} (N).\end{aligned}}

そして、 Nがポアソン分布に従う場合、 E( N ) = Var( N )となるので、これらの式は次のように簡約できる。

\operatorname {E} (Y)=\operatorname {E} (N)\operatorname {E} (X)=\lambda \operatorname {E} (X),

\operatorname {Var} (Y)=\operatorname {E} (N)(\operatorname {Var} (X)+(\operatorname {E} (X))^{2})=\operatorname {E} (N){\operatorname {E} (X^{2})}=\lambda {\operatorname {E} (X^{2})}.

Yの確率分布は特性関数によって決定できる。

\varphi _{Y}(t)=\operatorname {E} (e^{itY})=\operatorname {E} \left(\left(\operatorname {E} (e^{itX}\mid N)\right)^{N}\right)=\operatorname {E} \left((\varphi _{X}(t))^{N}\right),\,

したがって、ポアソン分布の確率生成関数を用いると、

\varphi _{Y}(t)={\textrm {e}}^{\lambda (\varphi _{X}(t)-1)}.\,

代替アプローチは、キュムラント生成関数を使用することです。

K_{Y}(t)=\ln \operatorname {E} [e^{tY}]=\ln \operatorname {E} [\operatorname {E} [e^{tY}\mid N]]=\ln \operatorname {E} [e^{NK_{X}(t)}]=K_{N}(K_{X}(t)).\,

全キュムラントの法則によれば、ポアソン分布の平均λ = 1のとき、YのキュムラントはX ₁のモーメントと同じであることが示される。^[^要出典^]

無限に割り切れる確率分布はすべて、複合ポアソン分布の極限である。^[1]そして、複合ポアソン分布は定義により無限に割り切れる。

離散複合ポアソン分布

が正の整数値iid確率変数で、を満たすとき、この複合ポアソン分布は 離散複合ポアソン分布^[2]^[3]^[4]（またはスタッターリングポアソン分布^{[5] ）と呼ばれる。}確率生成関数の特性を満たす離散確率変数は、 $X_{1},X_{2},X_{3},\dots$ $P(X_{1}=k)=\alpha _{k},\ (k=1,2,\ldots )$ $Y$

P_{Y}(z)=\sum \limits _{i=0}^{\infty }P(Y=i)z^{i}=\exp \left(\sum \limits _{k=1}^{\infty }\alpha _{k}\lambda (z^{k}-1)\right),\quad (|z|\leq 1)

は離散複合ポアソン分布（DCP）に従う分布であり、パラメータは（ただし、）であり、次のように表される。 $(\alpha _{1}\lambda ,\alpha _{2}\lambda ,\ldots )\in \mathbb {R} ^{\infty }$ ${\textstyle \sum _{i=1}^{\infty }\alpha _{i}=1}$ ${\textstyle \alpha _{i}\geq 0,\lambda >0}$

X\sim {\text{DCP}}(\lambda {\alpha _{1}},\lambda {\alpha _{2}},\ldots )

さらに、の場合、は次数の離散複合ポアソン分布を持つと言えます。のとき、DCP はそれぞれポアソン分布とエルミート分布になります。のとき、DCP はそれぞれ三重スタッタリングポアソン分布と四重スタッタリングポアソン分布になります。^[6]その他の特殊なケースには、シフト幾何分布、負の二項分布、幾何ポアソン分布、ネイマン A 型分布、ルリア–デルブリュック実験におけるルリア–デルブリュック分布などがあります。DCP のより特殊なケースについては、レビュー論文^[7]とその中の参考文献を参照してください。 $X\sim {\operatorname {DCP} }(\lambda {\alpha _{1}},\ldots ,\lambda {\alpha _{r}})$ $X$ $r$ $r=1,2$ $r=3,4$

フェラーによる複合ポアソン分布の特徴付けによれば、非負整数rvは、その分布が離散複合ポアソン分布である場合に限り、無限に割り切れる。^[8]負の二項分布は離散無限に割り切れる。すなわち、Xが負の二項分布に従う場合、任意の正の整数nに対して、その和がXと同じ分布に従う離散iid確率変数X ₁ , ..., X _nが存在する。シフト幾何分布は、負の二項分布の自明なケースであるため、離散複合ポアソン分布である。 $X$

この分布は、（例えばバルクキュー^[5]^[9]における）バッチ到着をモデル化することができます。離散複合ポアソン分布は、保険数理学において総請求額の分布をモデル化するために広く用いられています。^[3]

いくつかが負の場合には、離散擬似複合ポアソン分布となる。^[3]確率生成関数の特性を満たす任意の離散確率変数を次のように定義する。 $\alpha _{k}$ $Y$

G_{Y}(z)=\sum \limits _{i=0}^{\infty }P(Y=i)z^{i}=\exp \left(\sum \limits _{k=1}^{\infty }\alpha _{k}\lambda (z^{k}-1)\right),\quad (|z|\leq 1)

は、パラメータおよびの離散擬似複合ポアソン分布を持ち、となります。 $(\lambda _{1},\lambda _{2},\ldots )=:(\alpha _{1}\lambda ,\alpha _{2}\lambda ,\ldots )\in \mathbb {R} ^{\infty }$ ${\textstyle \sum _{i=1}^{\infty }{\alpha _{i}}=1}$ ${\textstyle \sum _{i=1}^{\infty }{\left|{\alpha _{i}}\right|}<\infty }$ ${\alpha _{i}}\in \mathbb {R} ,\lambda >0$

複合ポアソンガンマ分布

Xがガンマ分布に従う場合（指数分布はその特別な場合である）、 Y | Nの条件付き分布もガンマ分布となる。Yの周辺分布は、分散指数1 < p < 2のTweedie分布である（特性関数の比較による証明）。^[10]より明確に言えば、

N\sim \operatorname {Poisson} (\lambda ),

そして

X_{i}\sim \operatorname {\Gamma } (\alpha ,\beta )

iidの場合、

Y=\sum _{i=1}^{N}X_{i}

は、 $ED(\mu ,\sigma ^{2})$

{\begin{aligned}\operatorname {E} [Y]&=\lambda {\frac {\alpha }{\beta }}=:\mu ,\\[4pt]\operatorname {Var} [Y]&=\lambda {\frac {\alpha (1+\alpha )}{\beta ^{2}}}=:\sigma ^{2}\mu ^{p}.\end{aligned}}

Tweedie パラメータとポアソンパラメータおよびガンマパラメータのマッピングは次のとおりです。 $\mu ,\sigma ^{2},p$ $\lambda ,\alpha ,\beta$

{\begin{aligned}\lambda &={\frac {\mu ^{2-p}}{(2-p)\sigma ^{2}}},\\[4pt]\alpha &={\frac {2-p}{p-1}},\\[4pt]\beta &={\frac {\mu ^{1-p}}{(p-1)\sigma ^{2}}}.\end{aligned}}

複合ポアソン過程

速度とジャンプサイズの分布Gを持つ複合ポアソン過程は、次式で表される連続時間確率過程である。 $\lambda >0$ $\{\,Y(t):t\geq 0\,\}$

Y(t)=\sum _{i=1}^{N(t)}D_{i},

ここで、 N ( t ) = 0である限り、和は慣例的にゼロになる。ここで、は速度のポアソン過程であり、は独立かつ同一分布に従う確率変数であり、分布関数Gを持ち、 ^[11]からも独立である。 $\{\,N(t):t\geq 0\,\}$ $\lambda$ $\{\,D_{i}:i\geq 1\,\}$ $\{\,N(t):t\geq 0\,\}.\,$

複合ポアソン過程の離散バージョンは、脆弱性モデルの生存分析に使用できます。 ^[12]

アプリケーション

Revfeimは、指数分布に従う複合ポアソン分布を用いて、1日の総降雨量の分布をモデル化した。各日にはポアソン分布に従うイベントが含まれ、各イベントは指数分布に従う降雨量をもたらす。^[13] Thompsonは同じモデルを月間総降雨量に適用した。^[14]

保険金請求^[15]^[16]やX線コンピュータ断層撮影^[17]^[18]^[19]への応用もある。

参照

参考文献

^ ルカーチ, E. (1970).特性関数. ロンドン: グリフィン. ISBN 0-85264-170-2。
^ Johnson, NL, Kemp, AW , Kotz, S. (2005) 単変量離散分布、第3版、Wiley、 ISBN 978-0-471-27246-5。
^ abc Huiming, Zhang; Yunxiao Liu; Bo Li (2014). 「離散複合ポアソンモデルに関するノートとリスク理論への応用」保険：数学と経済学. 59 : 325– 336. doi :10.1016/j.insmatheco.2014.09.012.
^ Huiming, Zhang; Bo Li (2016). 「離散複合ポアソン分布の特性評価」. Communications in Statistics - Theory and Methods . 45 (22): 6789– 6802. doi :10.1080/03610926.2014.901375. S2CID 125475756.
^ ab Kemp, CD (1967). "「吃音-ポアソン分布」。アイルランド統計社会調査ジャーナル。21 （ 5）：151-157。hdl ： 2262/6987 。
^ Patel, YC (1976). 三重および四重吃音ポアソン分布のパラメータの推定. Technometrics, 18(1), 67-73.
^ Wimmer, G., Altmann, G. (1996). 多重ポアソン分布、その特性と多様な形態. バイオメトリカルジャーナル, 38(8), 995-1011.
^ Feller, W. (1968). 『確率論とその応用入門』第1巻（第3版）. ニューヨーク: Wiley.
^ Adelson, RM (1966). 「複合ポアソン分布」. Journal of the Operational Research Society . 17 (1): 73– 75. doi :10.1057/jors.1966.8.
^ Jørgensen, Bent (1997).分散モデルの理論. Chapman & Hall. ISBN 978-0412997112。
^ SM Ross (2007).確率モデル入門（第9版）. ボストン: アカデミック・プレス. ISBN 978-0-12-598062-3。
^ Ata, N.; Özel, G. (2013). 「離散複合ポアソン過程に基づくフレイルティモデルの生存関数」. Journal of Statistical Computation and Simulation . 83 (11): 2105– 2116. doi :10.1080/00949655.2012.679943. S2CID 119851120.
^ Revfeim, KJA (1984). 「降雨イベントと日降雨量の関係性に関する初期モデル」. Journal of Hydrology . 75 ( 1–4 ): 357– 364. Bibcode :1984JHyd...75..357R. doi :10.1016/0022-1694(84)90059-3.
^ Thompson, CS (1984). 「降雨系列の均質性解析：現実的な降雨モデルの適用」. Journal of Climatology . 4 (6): 609– 619. Bibcode :1984IJCli...4..609T. doi :10.1002/joc.3370040605.
^ Jørgensen, Bent; Paes De Souza, Marta C. (1994年1月). 「Tweedieの複合ポアソンモデルの保険請求データへの適合」. Scandinavian Actuarial Journal . 1994 (1): 69– 93. doi :10.1080/03461238.1994.10413930.
^ Smyth, Gordon K.; Jørgensen, Bent (2014年8月29日). 「保険請求データへのTweedieの複合ポアソンモデルの適合：分散モデリング」. ASTIN Bulletin . 32 (1): 143– 157. doi : 10.2143/AST.32.1.1020 .
^ Whiting, Bruce R. (2002年5月3日). Antonuk, Larry E.; Yaffe, Martin J. (編). 「X線コンピュータ断層撮影における信号統計」. Medical Imaging 2002: Physics of Medical Imaging . 4682. International Society for Optics and Photonics: 53– 60. Bibcode :2002SPIE.4682...53W. doi :10.1117/12.465601. S2CID 116487704.
^ Elbakri, Idris A.; Fessler, Jeffrey A. (2003年5月16日). Sonka, Milan; Fitzpatrick, J. Michael (編). 「X線コンピュータ断層撮影における反復画像再構成のための効率的かつ正確な尤度」. Medical Imaging 2003: Image Processing . 5032. SPIE: 1839– 1850. Bibcode :2003SPIE.5032.1839E. CiteSeerX 10.1.1.419.3752 . doi :10.1117/12.480302. S2CID 12215253.
^ Whiting, Bruce R.; Massoumzadeh, Parinaz; Earl, Orville A.; O'Sullivan, Joseph A.; Snyder, Donald L.; Williamson, Jeffrey F. (2006年8月24日). 「X線コンピュータ断層撮影における前処理済みサイノグラムデータの特性」. Medical Physics . 33 (9): 3290– 3303. Bibcode :2006MedPh..33.3290W. doi :10.1118/1.2230762. PMID 17022224.

[1] ルカーチ, E. (1970).特性関数. ロンドン: グリフィン. ISBN 0-85264-170-2。

[libro-2] Johnson, NL, Kemp, AW , Kotz, S. (2005) 単変量離散分布、第3版、Wiley、 ISBN 978-0-471-27246-5。

[zhang-3] Huiming, Zhang; Yunxiao Liu; Bo Li (2014). 「離散複合ポアソンモデルに関するノートとリスク理論への応用」保険：数学と経済学. 59 : 325– 336. doi :10.1016/j.insmatheco.2014.09.012.

[zhang2-4] Huiming, Zhang; Bo Li (2016). 「離散複合ポアソン分布の特性評価」. Communications in Statistics - Theory and Methods . 45 (22): 6789– 6802. doi :10.1080/03610926.2014.901375. S2CID 125475756.

[kemp-5] Kemp, CD (1967). "「吃音-ポアソン分布」。アイルランド統計社会調査ジャーナル。21 （ 5）：151-157。hdl ： 2262/6987 。

[6] Patel, YC (1976). 三重および四重吃音ポアソン分布のパラメータの推定. Technometrics, 18(1), 67-73.

[7] Wimmer, G., Altmann, G. (1996). 多重ポアソン分布、その特性と多様な形態. バイオメトリカルジャーナル, 38(8), 995-1011.

[8] Feller, W. (1968). 『確率論とその応用入門』第1巻（第3版）. ニューヨーク: Wiley.

[9] Adelson, RM (1966). 「複合ポアソン分布」. Journal of the Operational Research Society . 17 (1): 73– 75. doi :10.1057/jors.1966.8.

[Jørgensen-1997-10] Jørgensen, Bent (1997).分散モデルの理論. Chapman & Hall. ISBN 978-0412997112。

[11] SM Ross (2007).確率モデル入門（第9版）. ボストン: アカデミック・プレス. ISBN 978-0-12-598062-3。

[12] Ata, N.; Özel, G. (2013). 「離散複合ポアソン過程に基づくフレイルティモデルの生存関数」. Journal of Statistical Computation and Simulation . 83 (11): 2105– 2116. doi :10.1080/00949655.2012.679943. S2CID 119851120.

[Revf-13] Revfeim, KJA (1984). 「降雨イベントと日降雨量の関係性に関する初期モデル」. Journal of Hydrology . 75 ( 1–4 ): 357– 364. Bibcode :1984JHyd...75..357R. doi :10.1016/0022-1694(84)90059-3.

[Thom-14] Thompson, CS (1984). 「降雨系列の均質性解析：現実的な降雨モデルの適用」. Journal of Climatology . 4 (6): 609– 619. Bibcode :1984IJCli...4..609T. doi :10.1002/joc.3370040605.

[15] Jørgensen, Bent; Paes De Souza, Marta C. (1994年1月). 「Tweedieの複合ポアソンモデルの保険請求データへの適合」. Scandinavian Actuarial Journal . 1994 (1): 69– 93. doi :10.1080/03461238.1994.10413930.

[16] Smyth, Gordon K.; Jørgensen, Bent (2014年8月29日). 「保険請求データへのTweedieの複合ポアソンモデルの適合：分散モデリング」. ASTIN Bulletin . 32 (1): 143– 157. doi : 10.2143/AST.32.1.1020 .

[17] Whiting, Bruce R. (2002年5月3日). Antonuk, Larry E.; Yaffe, Martin J. (編). 「X線コンピュータ断層撮影における信号統計」. Medical Imaging 2002: Physics of Medical Imaging . 4682. International Society for Optics and Photonics: 53– 60. Bibcode :2002SPIE.4682...53W. doi :10.1117/12.465601. S2CID 116487704.

[18] Elbakri, Idris A.; Fessler, Jeffrey A. (2003年5月16日). Sonka, Milan; Fitzpatrick, J. Michael (編). 「X線コンピュータ断層撮影における反復画像再構成のための効率的かつ正確な尤度」. Medical Imaging 2003: Image Processing . 5032. SPIE: 1839– 1850. Bibcode :2003SPIE.5032.1839E. CiteSeerX 10.1.1.419.3752 . doi :10.1117/12.480302. S2CID 12215253.

[19] Whiting, Bruce R.; Massoumzadeh, Parinaz; Earl, Orville A.; O'Sullivan, Joseph A.; Snyder, Donald L.; Williamson, Jeffrey F. (2006年8月24日). 「X線コンピュータ断層撮影における前処理済みサイノグラムデータの特性」. Medical Physics . 33 (9): 3290– 3303. Bibcode :2006MedPh..33.3290W. doi :10.1118/1.2230762. PMID 17022224.