Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

1
Apakah data yang tidak seimbang pengambilan sampel atas atau bawah benar-benar efektif? Mengapa?
Saya sering mendengar pengambilan sampel data atas atau bawah yang dibahas sebagai cara berurusan dengan klasifikasi data yang tidak seimbang. Saya mengerti bahwa ini bisa berguna jika Anda bekerja dengan classifier biner (bukan berdasarkan probabilistik atau berbasis skor) dan memperlakukannya sebagai kotak hitam, jadi skema pengambilan sampel adalah satu-satunya cara …

2
Mengapa campuran konjugat penting?
Saya punya pertanyaan tentang campuran prior konjugat. Saya belajar dan mengatakan campuran beberapa konjugasi beberapa kali ketika saya belajar bayesian. Saya bertanya-tanya mengapa teorema ini sangat penting, bagaimana kita akan menerapkannya ketika kita melakukan analisis Bayesian. Untuk lebih spesifik, satu teorema dari Diaconis dan Ylivisaker 1985 mengilustrasikan teorema sebagai berikut: …





2
Apakah ada cara untuk memaksa hubungan antara koefisien dalam regresi logistik?
Saya ingin menentukan model regresi logistik di mana saya memiliki hubungan berikut: E[Yi|Xi]=f(βxi1+β2xi2)E[Yi|Xi]=f(βxi1+β2xi2)E[Y_i|X_i] = f(\beta x_{i1} + \beta^2x_{i2}) dimana fff adalah fungsi invit logit. Apakah ada cara "cepat" untuk melakukan ini dengan fungsi R yang sudah ada atau apakah ada nama untuk model seperti ini? Saya menyadari bahwa saya dapat …

2
Apakah MLE dengan regularisasi adalah metode bayesian?
Biasanya dikatakan bahwa prior pada statistik bayesian dapat dianggap sebagai faktor regularisasi karena mereka menghukum solusi di mana sebelumnya menempatkan kepadatan probabilitas rendah. Kemudian, diberikan model sederhana ini yang parameter MLE-nya adalah: argmaxμ N(y;μ,σ)argmaxμ N(y;μ,σ) argmax_{\mu} \text{ } \mathcal{N}(y; \mu, \sigma) dan saya menambahkan sebelumnya: parameternya bukan parameter MLE tetapi …


1
Pemeriksaan prediktif posterior setelah inferensi ABC untuk beberapa parameter
Saya relatif baru dalam statistik Bayesian jadi harap bersikap lembut. Saya baru saja melakukan Perkiraan Bayesian Computation (ABC) untuk inferensi model multi-parameter. Sekarang saya mencari untuk melakukan pemeriksaan prediktif posterior pada parameter yang telah disimpulkan. Apa yang ingin saya ketahui adalah bahwa, ketika pengambilan sampel dari posterior untuk menghasilkan statistik …

2
Pada utilitas korelasi intercept-slope dalam model bertingkat
Dalam buku mereka "Analisis Multilevel: Pengantar Pemodelan Multilevel Dasar dan Lanjutan" (1999), Snijders & Bosker (bab 8, bagian 8.2, halaman 119) mengatakan bahwa korelasi intersep-slope, dihitung sebagai kovarians intersep-slope yang dibagi oleh akar kuadrat dari produk intercept variance dan slope variance, tidak dibatasi antara -1 dan +1 dan bahkan bisa …

1
Mengukur varians yang dijelaskan untuk Poisson GLM (fungsi log-link)
Saya mencari ukuran yang sesuai dari "varians yang dijelaskan" dari Poisson GLM (menggunakan fungsi log-link). Saya telah menemukan sejumlah sumber daya yang berbeda (baik di situs ini dan di tempat lain) yang membahas sejumlah pseudo- berbedaR2R2R^2 tindakan, tetapi hampir setiap situs menyebutkan langkah-langkah dalam kaitannya dengan fungsi link-logit, dan mereka …

2
Seseorang berulang kali memilih dua item paling mirip dari tiga. Bagaimana memodelkan / memperkirakan jarak persepsi antar item?
Seseorang diberikan tiga item, katakan gambar wajah, dan diminta untuk memilih mana dua dari tiga wajah yang paling mirip. Ini diulangi berkali-kali dengan kombinasi wajah yang berbeda, di mana setiap wajah dapat terjadi dalam banyak kombinasi. Dengan data seperti ini, saya ingin memodelkan / memperkirakan perbedaan / kesamaan antara wajah …

2
Regresi logistik dengan variabel prediktor jarang
Saat ini saya memodelkan beberapa data menggunakan regresi logistik biner. Variabel dependen memiliki jumlah kasus positif dan negatif yang baik - tidak jarang. Saya juga memiliki satu set pelatihan besar (> 100.000) dan jumlah efek utama yang saya minati sekitar 15 jadi saya tidak khawatir tentang masalah p> n. Yang …

2
Transformasi Chi-kuadrat ke Distribusi normal
Hubungan antara distribusi normal normal dan distribusi kuadrat diketahui. Saya bertanya-tanya, apakah ada transformasi yang dapat mengarah dari kembali ke distribusi normal standar?χ2( 1 )χ2(1)\chi^2 (1) Dapat dengan mudah dilihat bahwa transformasi akar kuadrat tidak berfungsi karena jangkauannya hanya angka positif. Saya percaya distribusi yang dihasilkan disebut normal terlipat . …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.