Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data


1
Apa perbedaan antara "proporsi proporsi" dan "proporsi kontinu"?
Dalam komentar pada pertanyaan lain , klarifikasi ditanyakan jika topik yang dibahas adalah "proporsi proporsi" atau "proporsi berkelanjutan", dan tindak lanjut menunjukkan bahwa perbedaannya adalah informasi penting (untuk topik logistik / binomial vs regresi beta). Apa perbedaan antara keduanya, dan di manakah perbedaan itu? Apa hal penting yang perlu diingat …

1
Filter bootstrap / Algoritma filter partikel (Memahami)
Saya benar-benar kurang memahami cara kerja filter bootstrap. Saya kira-kira tahu konsepnya tetapi saya gagal memahami detail tertentu. Pertanyaan ini bagi saya untuk membersihkan kekacauan. Di sini saya akan menggunakan algoritma filter populer ini dari referensi oleh doucet (sejauh ini saya pikir ini adalah referensi termudah). Pertama-tama saya beri tahu …

3
Arsitektur saraf: desain otomatis informasi-informasi
Kemajuan baru-baru ini dalam jaringan saraf dirangkum oleh urutan arsitektur novel yang ditandai terutama dengan kompleksitas desain yang berkembang. Dari LeNet5 (1994) hingga AlexNet (2012), hingga Overfeat (2013) dan GoogleLeNet / Inception (2014) dan seterusnya ... Apakah ada upaya untuk membiarkan mesin memutuskan / mendesain arsitektur yang akan digunakan tergantung …

1
MCMC; Bisakah kita yakin bahwa kita memiliki sampel "murni" dan "cukup besar" dari posterior? Bagaimana cara kerjanya jika kita tidak?
Mengacu pada utas ini: Bagaimana Anda menjelaskan Markov Chain Monte Carlo (MCMC) kepada orang awam? . Saya dapat melihat bahwa itu adalah kombinasi dari Rantai Markov dan Monte Carlo: rantai Markov dibuat dengan posterior sebagai distribusi pembatas yang tidak berubah dan kemudian pengundian Monte Carlo (tergantung) dibuat dari distribusi pembatas …
12 mcmc 

1
Bisakah Anda memberikan penjelasan intuitif sederhana tentang metode IRLS untuk menemukan MLE dari GLM?
Latar Belakang: Saya mencoba mengikuti review Princeton tentang estimasi MLE untuk GLM . Saya memahami dasar-dasar estimasi MLE: likelihood, score, diamati dan diharapkan Fisher informationdan Fisher scoringteknik. Dan saya tahu bagaimana membenarkan regresi linier sederhana dengan estimasi MLE . Pertanyaan: Saya bahkan tidak mengerti baris pertama dari metode ini :( …

6
Apakah ada distribusi univariat yang tidak dapat kami sampel?
Kami memiliki beragam metode untuk pembangkitan acak dari distribusi univariat (transformasi terbalik, accept-reject, Metropolis-Hastings, dll.) Dan tampaknya kami dapat mengambil sampel dari setiap distribusi yang valid secara literal - apakah itu benar? Bisakah Anda memberikan contoh distribusi univariat yang tidak mungkin dihasilkan secara acak? Saya kira contoh di mana itu …

1
Interval kepercayaan pada prediksi untuk model campuran non-linear (nlme)
Saya ingin mendapatkan interval kepercayaan 95% pada prediksi nlmemodel campuran non-linear . Karena tidak ada standar yang disediakan untuk melakukan hal ini di dalam nlme, saya bertanya-tanya apakah benar menggunakan metode "interval prediksi populasi", sebagaimana diuraikan dalam bab buku Ben Bolker dalam konteks model yang sesuai dengan kemungkinan maksimum , …




3
Regresi moderat: Mengapa kita menghitung istilah * produk * di antara para prediktor?
Analisis regresi moderat sering digunakan dalam ilmu sosial untuk menilai interaksi antara dua atau lebih prediktor / kovariat. Biasanya, dengan dua variabel prediktor, model berikut ini diterapkan: Y=β0+β1∗X+β2∗M+β3∗XM+eY=β0+β1∗X+β2∗M+β3∗XM+eY = β_0 + β_1*X + β_2*M + β_3*XM + e Perhatikan bahwa uji moderasi dioperasionalkan oleh istilah produk XMXMXM (perkalian antara variabel …

2
Menggunakan lm untuk uji proporsi 2 sampel
Saya telah menggunakan model linier untuk melakukan tes proporsi 2 sampel untuk sementara waktu, tetapi telah menyadari bahwa mungkin tidak sepenuhnya benar. Tampaknya menggunakan model linier umum dengan tautan keluarga + identitas binomial memberikan hasil tes proporsi 2 sampel yang tidak dikumpulkan. Namun, menggunakan model linier (atau glm dengan keluarga …

1
Intuisi untuk derajat kebebasan LASSO
Zou et al. "Pada" derajat kebebasan "dari laso" (2007) menunjukkan bahwa jumlah koefisien bukan nol adalah perkiraan yang tidak bias dan konsisten untuk derajat kebebasan laso. Sepertinya agak berlawanan dengan intuisi saya. Misalkan kita memiliki model regresi (di mana variabelnya nol rata-rata) y=βx+ε.y=βx+ε.y=\beta x + \varepsilon. Misalkan perkiraan OLS yang …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.