Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data



1
Uji eksak Fisher memberikan nilai-p yang tidak seragam
Saya mencoba menerapkan uji eksak Fisher dalam masalah genetika yang disimulasikan, tetapi nilai-p tampaknya condong ke kanan. Menjadi seorang ahli biologi, saya kira saya hanya kehilangan sesuatu yang jelas bagi setiap ahli statistik, jadi saya akan sangat menghargai bantuan Anda. Setup saya adalah ini: (setup 1, marjinal tidak tetap) Dua …

3
Jeffreys Prior untuk distribusi normal dengan mean dan varian tidak diketahui
Saya membaca tentang distribusi sebelumnya dan saya menghitung Jeffrey sebelumnya untuk sampel variabel acak yang terdistribusi normal dengan rerata tidak diketahui dan tidak diketahui. Menurut perhitungan saya, berikut ini berlaku untuk Jeffreys sebelumnya: Di sini, adalah matriks informasi Fisher.p(μ,σ2)=det(I)−−−−−√=det(1/σ2001/(2σ4))−−−−−−−−−−−−−−−−−−√=12σ6−−−−√∝1σ3.p(μ,σ2)=det(I)=det(1/σ2001/(2σ4))=12σ6∝1σ3. p(\mu,\sigma^2)=\sqrt{det(I)}=\sqrt{det\begin{pmatrix}1/\sigma^2 & 0 \\ 0 & 1/(2\sigma^4)\end{pmatrix}}=\sqrt{\frac{1}{2\sigma^6}}\propto\frac{1}{\sigma^3}.III Namun, saya juga sudah …

1
Haruskah
Berikut ini adalah model yang dibuat dari mtcarsdataset: > ols(mpg~wt+am+qsec, mtcars) Linear Regression Model ols(formula = mpg ~ wt + am + qsec, data = mtcars) Model Likelihood Discrimination Ratio Test Indexes Obs 32 LR chi2 60.64 R2 0.850 sigma 2.4588 d.f. 3 R2 adj 0.834 d.f. 28 Pr(> chi2) …


1
Mengapa tidak setiap regresi kuat?
Contoh halaman ini menunjukkan bahwa regresi sederhana sangat dipengaruhi oleh pencilan dan ini dapat diatasi dengan teknik regresi yang kuat: http://www.alastairsanderson.com/R/tutorials/robust-regress-in-R/ . Saya percaya lmrob dan ltsReg adalah teknik regresi kuat lainnya. Mengapa seseorang tidak harus melakukan regresi yang kuat (seperti rlm atau rq) setiap kali daripada melakukan regresi sederhana …


2
Dimensi VC model regresi
Dalam seri kuliah Learning from Data , profesor menyebutkan bahwa dimensi VC mengukur kompleksitas model pada berapa banyak poin yang dapat dihancurkan oleh model tertentu. Jadi ini bekerja dengan sangat baik untuk model klasifikasi di mana kita bisa mengatakan keluar dari N poin jika classifier mampu menghancurkan k poin secara …


2
Cara membuat data kelangsungan hidup mainan (waktu ke acara) dengan sensor yang benar
Saya ingin membuat data survival mainan (waktu untuk acara) yang disensor dengan benar dan mengikuti distribusi dengan bahaya proporsional dan bahaya baseline konstan. Saya membuat data sebagai berikut, tetapi saya tidak dapat memperoleh estimasi rasio bahaya yang mendekati nilai sebenarnya setelah menyesuaikan model bahaya proporsional Cox dengan data yang disimulasikan. …


2
pdf produk dari dua variabel acak Uniform independen
Misalkan ~ dan ~ menjadi dua variabel acak independen dengan distribusi yang diberikan. Apa distribusi ?XXXU(0,2)U(0,2)U(0,2)YYYU(−10,10)U(−10,10)U(-10,10)V=XYV=XYV=XY Saya telah mencoba konvolusi, mengetahui itu h(v)=∫y=+∞y=−∞1yfY(y)fX(vy)dyh(v)=∫y=−∞y=+∞1yfY(y)fX(vy)dyh(v) = \int_{y=-\infty}^{y=+\infty}\frac{1}{y}f_Y(y) f_X\left (\frac{v}{y} \right ) dy Kita juga tahu bahwa fY(y)=120fY(y)=120f_Y(y) = \frac{1}{20} , h ( v ) = 120∫y= 10y= - 101y⋅ 12dyh(v)=120∫y=−10y=101y⋅12dyh(v)= \frac{1}{20} \int_{y=-10}^{y=10} …



Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.