Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

1
Apa gunanya model grafis?
Saya menghabiskan hari belajar tentang paket bnlearn di R hanya untuk menemukan bahwa model Bayesian tidak bekerja dengan grafik yang tidak terarah. Saya mencoba mempelajari tentang Markov Random Field Network, dan sejauh ini yang dapat saya lakukan adalah membuat struktur grafis menggunakan LASSO grafis. Dalam grafik terarah, tampaknya ada dua …

1
Pangkat dan z-alih alih-alih Wilcoxon?
Andrew Gelman dalam sebuah posting baru-baru ini di blognya menyarankan menggunakan peringkat, mengubah peringkat menjadi skor-z, dan kemudian menggunakan tes parametrik dan alat alih-alih melakukan tes non-parametrik. Saya tidak pernah mendengar itu sebelumnya. Pencarian di Google menunjukkan kepada saya fungsi R ini dalam paket GenABEL , yang tampaknya melakukan peringkat …

1
Regresi tanpa intersep: memperoleh dalam kuadrat terkecil (tidak ada matriks)
Dalam Pengantar Pembelajaran Statistik (James et al.), Di bagian 3.7 latihan 5, ini menyatakan bahwa rumus untuk dengan asumsi regresi linier tanpa intersep adalah mana dan adalah perkiraan yang biasa digunakan dalam OLS untuk regresi linier sederhana ( ).β^1β^1\hat{\beta}_1β^1=∑i = 1nxsayaysaya∑i = 1nx2saya,β^1=∑saya=1nxsayaysaya∑saya=1nxsaya2,\hat{\beta}_1 = \dfrac{\displaystyle\sum\limits_{i=1}^{n}x_iy_i}{\displaystyle \sum\limits_{i=1}^{n}x_i^2}\text{,}β^0=y¯-β^1x¯β^0=y¯-β^1x¯\hat{\beta}_0 = \bar{y}-\hat{\beta}_1\bar{x}β^1=Sx ySx xβ^1=SxySxx\hat{\beta}_1 …

2
Menerapkan aturan Rubin untuk menggabungkan kumpulan data berlipat ganda
Saya berharap untuk menyatukan hasil dari serangkaian analisis mendasar yang dilakukan pada data yang dilipatgandakan (misalnya regresi berganda, ANOVA). Beberapa imputasi dan analisis telah diselesaikan dalam SPSS tetapi SPSS tidak memberikan hasil gabungan untuk beberapa statistik termasuk nilai-F, matriks kovarian, R-Squared dll. Saya telah melakukan beberapa upaya untuk mengatasi masalah …


1
Beberapa model ARIMA cocok dengan data. Bagaimana cara menentukan pesanan? Pendekatan yang benar?
Saya punya dua seri waktu (parameter model untuk pria dan wanita) dan bertujuan untuk mengidentifikasi model ARIMA yang tepat untuk membuat perkiraan. Rangkaian waktu saya terlihat seperti: Plot dan ACF menunjukkan non-stasioner (paku ACF terputus sangat lambat). Jadi, saya menggunakan differencing dan memperoleh: Plot ini menunjukkan bahwa seri sekarang mungkin …

1
Memahami pesan peringatan "Ikatan hadir" di Kruskal-Wallis post hoc
Saya menjalankan perbandingan post-hoc setelah tes Kruskal-Wallis. Saya menggunakan paket PMCMR . > posthoc.kruskal.nemenyi.test( preference ~ instrument) Pairwise comparisons using Tukey and Kramer (Nemenyi) test with Tukey-Dist approximation for independent samples data: preference by instrument Cello Drums Guitar Drums 0.157 - - Guitar 0.400 0.953 - Harp 0.013 0.783 0.458 …
8 r  ties 

1
Apakah efek kelompok dalam model efek campuran dianggap telah diambil dari distribusi normal?
Katakanlah kami tertarik pada bagaimana nilai ujian siswa dipengaruhi oleh jumlah jam belajar siswa tersebut. Kami mengambil sampel siswa dari beberapa sekolah yang berbeda. Kami menjalankan model efek campuran berikut: nilai ujiansaya= a +β1×jam. belajarsaya+sekolahj+esayanilai ujiansaya=Sebuah+β1×jam. belajarsaya+sekolahj+esaya \text{exam.grades}_i = a + \beta_1 \times \text{hours.studied}_i + \text{school}_j + e_i Apakah saya …


1
Penaksir skewness dan kurtosis yang tidak sesuai
Skewness dan kurtosis didefinisikan sebagai: ζ3=E[ ( X- μ)3]E[ ( X- μ)2]3 / 2=μ3σ3ζ3=E[(X-μ)3]E[(X-μ)2]3/2=μ3σ3\zeta_3 = \frac{E[(X-\mu)^3]}{E[(X-\mu)^2]^{3/2}} = \frac{\mu_3}{\sigma^3} ζ4=E[ ( X- μ)4]E[ ( X- μ)2]2=μ4σ4ζ4=E[(X-μ)4]E[(X-μ)2]2=μ4σ4\zeta_4 = \frac{E[(X-\mu)^4]}{E[(X-\mu)^2]^2} = \frac{\mu_4}{\sigma^4} Rumus berikut digunakan untuk menghitung skewness dan kurtosis sampel: z3=1n∑ni = 1[ (xsaya-x¯)3](1n∑ni = 1[ (xsaya-x¯)2])3 / 2z3=1n∑saya=1n[(xsaya-x¯)3](1n∑saya=1n[(xsaya-x¯)2])3/2z_3 = \frac{\frac{1}{n}\sum_{i=1}^{n} [(x_i-\bar …

1
Bagaimana menangani beberapa pengukuran per peserta, dengan data kategorikal?
Saya telah melakukan percobaan di mana saya telah mengumpulkan pengukuran dari sejumlah peserta. Setiap titik data yang relevan memiliki dua variabel, keduanya kategorikal: pada kenyataannya, setiap variabel memiliki dua nilai yang mungkin (jawaban untuk dua pertanyaan ya / tidak). Saya ingin uji hipotesis statistik untuk memeriksa apakah tampaknya ada korelasi …

2
Bagaimana gradien merambat dalam jaringan saraf berulang yang tidak dikontrol?
Saya mencoba memahami bagaimana rnn dapat digunakan untuk memprediksi urutan dengan bekerja melalui contoh sederhana. Ini adalah jaringan sederhana saya, yang terdiri dari satu input, satu neuron tersembunyi, dan satu output: Neuron tersembunyi adalah fungsi sigmoid, dan output dianggap sebagai output linier sederhana. Jadi, saya pikir jaringan bekerja sebagai berikut: …


3
Bagaimana cara menghitung nilai p dari odds ratio dalam R?
Saya memiliki daftar nilai berikut: 25 75 38 162 Rasio peluang adalah 0,7037 dan log (OR) adalah -0,3514. Untuk tabel kontingensi dengan nilai a, b, c, dan d, varian log (OR) diberikan oleh (1/a + 1/b + 1/c + 1/d) Bagaimana saya bisa menghitung p.value log (OR) dari data ini …
8 r  variance 

2
Kemungkinan huruf-huruf muncul berurutan
Misalkan kita memiliki alfabet yang mengandung simbol , , di mana , dan \ Pr (\ $) = 1 - (\ Pr (a) + \ Pr (b) + \ cdots) = 1-mp .m+1m+1m+1{a,b,c,d,e,...,$}{a,b,c,d,e,...,$}\{a, b, c, d, e,..., \$\}p=Pr(a)=Pr(b)=⋯p=Pr(a)=Pr(b)=⋯p = \Pr(a) = \Pr(b) =\cdotsPr($)=1−(Pr(a)+Pr(b)+⋯)=1−mpPr($)=1−(Pr(a)+Pr(b)+⋯)=1−mp\Pr(\$) = 1 - (\Pr(a)+\Pr(b)+\cdots)=1-mp Untuk string acak …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.