Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data



3
Pemilihan Model: Regresi Logistik
Misalkan kita memiliki kovariat x 1 , ... , x n dan variabel hasil biner ynnnx1,…,xnx1,…,xnx_1, \dots, x_nyyy . Beberapa kovariat ini termasuk kategori dengan banyak tingkatan. Lainnya kontinu. Bagaimana Anda memilih model "terbaik"? Dengan kata lain, bagaimana Anda memilih kovariat mana yang akan dimasukkan dalam model? Apakah Anda memodelkan …

2
Menilai model regresi logistik
Pertanyaan ini muncul dari kebingungan aktual saya tentang bagaimana memutuskan apakah model logistik cukup baik. Saya memiliki model yang menggunakan keadaan berpasangan-proyek individu dua tahun setelah mereka dibentuk sebagai variabel dependen. Hasilnya berhasil (1) atau tidak (0). Saya memiliki variabel independen yang diukur pada saat pembentukan pasangan. Tujuan saya adalah …


1
Uji signifikansi pada perbedaan koefisien korelasi Spearman
(Terima kasih banyak atas tanggapan cepatnya! Saya melakukan pekerjaan yang buruk dalam mengajukan pertanyaan, jadi izinkan saya mencoba lagi.) Saya tidak tahu bagaimana cara mengetahui apakah perbedaan antara dua korelasi Spearman signifikan secara statistik. Saya ingin tahu bagaimana cara mengetahuinya. Alasan saya ingin mengetahuinya adalah bahwa dalam makalah berikut: Interpretasi …

2
Bagaimana para ekonom mengukur operasi pasar gelap?
Saya sedang melakukan banyak penelitian tentang kejahatan terorganisir di Asia Timur untuk sebuah proyek sebagai bantuan kepada teman penulis saya, dan saya perhatikan bahwa ada ekonom dan jurnalis terkemuka yang, bersama-sama, memperkirakan nilai operasi pasar gelap di seluruh dunia . Apa metodologi untuk ini? Bagaimana angka-angka ini bersatu? Apakah angka-angka …

3
Apakah menambah ukuran sampel secara dinamis oke, jika dinyatakan secara apriori?
Saya akan melakukan studi tentang manfaat dari satu stimulus dibandingkan yang lain dengan desain dalam-subjek. Saya memiliki skema permutasi yang dirancang untuk mengurangi efek urutan beberapa bagian penelitian (urutan jenis tugas, urutan stimulus, urutan tugas yang ditetapkan). Skema permutasi menentukan bahwa ukuran sampel dapat dibagi 8. Untuk menentukan ukuran sampel …

2
Tanpa pemodelan multi-level, bagaimana menangani replikasi dalam studi dalam meta-analisis, di mana studi adalah unit replikasi?
Deskripsi penelitian: Saya telah mengamati kesalahan umum di antara meta-analisis, berkaitan dengan penanganan replikasi dalam studi. Tidak jelas bagi saya jika kesalahan membatalkan studi ketika asumsi dinyatakan. Namun, seperti yang saya pahami, asumsi ini melanggar premis dasar statistik. Sebagai contoh, sebuah penelitian menguji efek kimia pada respon Y .XXXYYY Analisis …

1
Menghitung kemungkinan dari RMSE
Saya memiliki model untuk memprediksi lintasan (x sebagai fungsi waktu) dengan beberapa parameter. Saat ini, saya menghitung root mean square error (RMSE) antara lintasan yang diprediksi dan lintasan yang direkam secara eksperimental. Saat ini, saya meminimalkan perbedaan ini (RMSE) menggunakan simplex (fminsearch in matlab). Meskipun metode ini berfungsi untuk memberikan …


2
Berapa varians dari maksimum sampel?
BBBVar(maxiXi)≤B,Var(maxiXi)≤B, \mbox{Var}(\max_i X_i) \leq B \enspace, X={X1,…,XM}X={X1,…,XM}X = \{ X_1, \ldots, X_M \}MMMμ1,…,μMμ1,…,μM\mu_1, \ldots, \mu_Mσ21,…,σ2Mσ12,…,σM2\sigma_1^2, \ldots, \sigma_M^2 Saya dapat menyimpulkan bahwa tetapi batasan ini tampaknya sangat longgar. Tes numerik tampaknya menunjukkan bahwa mungkin merupakan suatu kemungkinan, tetapi saya belum dapat membuktikannya. Bantuan apa pun dihargai.Var(maxiXi)≤∑iσ2i,Var(maxiXi)≤∑iσi2, \mbox{Var}(\max_i X_i) \leq \sum_i \sigma_i^2 …




Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.