Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

3
Analisis faktor kuesioner yang terdiri dari item-item Likert
Saya biasa menganalisis item dari sudut pandang psikometrik. Tetapi sekarang saya mencoba menganalisis jenis pertanyaan lain tentang motivasi dan topik lainnya. Semua pertanyaan ini ada di skala Likert. Pikiran awal saya adalah menggunakan analisis faktor, karena pertanyaan dihipotesiskan untuk mencerminkan beberapa dimensi yang mendasarinya. Tetapi apakah analisis faktor tepat? Apakah …

5
Regresi Poisson dengan data besar: apakah salah mengubah satuan pengukuran?
Karena faktorial dalam distribusi poisson, menjadi tidak praktis untuk memperkirakan model poisson (misalnya, menggunakan kemungkinan maksimum) ketika pengamatan besar. Jadi, misalnya, jika saya mencoba memperkirakan suatu model untuk menjelaskan jumlah kasus bunuh diri pada tahun tertentu (hanya data tahunan yang tersedia), dan mengatakan, ada ribuan kasus bunuh diri setiap tahun, …


2
Jika model deret waktu regresif otomatis adalah non-linear, apakah masih memerlukan stasioneritas?
Berpikir tentang menggunakan jaringan saraf berulang untuk peramalan deret waktu. Mereka pada dasarnya menerapkan semacam regresi otomatis non-linier umum, dibandingkan dengan model ARMA dan ARIMA yang menggunakan regresi otomatis linier. Jika kita melakukan regresi otomatis non-linier, apakah masih perlu agar deret waktu tetap dan apakah kita perlu melakukan pembedaan seperti …



3
Menggunakan regularisasi ketika melakukan inferensi statistik
Saya tahu tentang manfaat regularisasi ketika membangun model prediksi (bias vs varians, mencegah overfitting). Tapi, saya bertanya-tanya apakah itu ide yang baik untuk juga melakukan regularisasi (laso, ridge, elastis net) ketika tujuan utama dari model regresi adalah inferensi pada koefisien (melihat prediktor mana yang signifikan secara statistik). Saya ingin mendengar …





3
Ide dan intuisi di balik estimasi kemungkinan semu maksimum (QMLE)
Pertanyaan: Apa gagasan dan intuisi di balik estimasi kemungkinan maksimum kuasi (QMLE; juga dikenal sebagai estimasi kemungkinan maksimum semu, PMLE)? Apa yang membuat estimator berfungsi ketika distribusi kesalahan yang sebenarnya tidak cocok dengan distribusi kesalahan yang diasumsikan? Situs Wikipedia untuk QMLE baik-baik saja (singkat, intuitif, to the point), tetapi saya …


5
Distribusi rasio antara dua variabel acak seragam independen
Misalkan dan adalah standar yang terdistribusi secara seragam dalam , dan mereka independen, berapakah PDF dari ?XXXYYY[0,1][0,1][0, 1]Z=Y/XZ=Y/XZ = Y / X Jawaban dari beberapa buku teks teori probabilitas adalah fZ(z)=⎧⎩⎨1/2,1/(2z2),0,if 0≤z≤1if z>1otherwise.fZ(z)={1/2,if 0≤z≤11/(2z2),if z>10,otherwise. f_Z(z) = \begin{cases} 1/2, & \text{if } 0 \le z \le 1 \\ 1/(2z^2), & …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.