Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

1
Regresi Linier dengan Variabel Dependen yang merupakan Rasio
Saya melakukan regresi linier di mana variabel dependen adalah rasio yang dapat berkisar dari 0,01 hingga 100. Apakah boleh untuk mengambil log dari variabel dependen dan regresi itu? Saya mencocokkan hasil penelitian dan itulah yang mereka lakukan. Apa perbedaan dari mengambil log dengan menggunakan rasio apa adanya?
10 regression 


1
Apakah ada definisi umum tentang ukuran efek?
The effect-sizetag tidak memiliki wiki. The wikipedia Halaman tentang ukuran efek tidak memberikan definisi umum yang tepat. Dan saya belum pernah melihat definisi umum tentang ukuran efek . Namun ketika membaca beberapa diskusi seperti ini saya berada di bawah kesan bahwa orang-orang memiliki pemikiran umum tentang ukuran efek, dalam konteks …


1
Luce aksioma pilihan, pertanyaan tentang probabilitas bersyarat [ditutup]
Ditutup . Pertanyaan ini membutuhkan detail atau kejelasan . Saat ini tidak menerima jawaban. Ingin meningkatkan pertanyaan ini? Tambahkan detail dan jelaskan masalahnya dengan mengedit posting ini . Ditutup 2 tahun yang lalu . Saya membaca Luce (1959) . Kemudian saya menemukan pernyataan ini: Ketika seseorang memilih di antara alternatif, …

3
Memperbaiki vs Efek Acak
Saya baru-baru ini mulai belajar tentang Generalized Linear Mixed Models dan menggunakan R untuk mengeksplorasi perbedaan yang dibuat untuk memperlakukan keanggotaan grup sebagai efek tetap atau acak. Secara khusus, saya melihat contoh dataset yang dibahas di sini: http://www.ats.ucla.edu/stat/mult_pkg/glmm.htm http://www.ats.ucla.edu/stat/r/dae/melogit.htm Seperti yang diuraikan dalam tutorial ini, efek ID Dokter cukup besar …

1
Glm atau glmnet yang lebih akurat?
R glm dan glmnet menggunakan algoritma yang berbeda. Saya melihat perbedaan yang tidak sepele antara estimasi koefisien ketika saya menggunakan keduanya. Saya tertarik ketika satu lebih akurat daripada yang lain, dan waktu untuk menyelesaikan / akurasi trade off. Secara khusus saya mengacu pada kasus di mana satu set lambda = …

2
Apa hubungan antara inferensi kausal dan prediksi?
Apa hubungan dan perbedaan antara inferensi kausal dan prediksi (baik klasifikasi dan regresi)? Dalam konteks prediksi, kami memiliki variabel prediktor / input dan variabel respons / keluaran. Apakah itu berarti bahwa ada hubungan sebab akibat antara variabel input dan output? Jadi, apakah prediksi termasuk inferensi kausal? Jika saya mengerti dengan …


1
Bagaimana LASSO memilih di antara prediktor linier?
Saya mencari jawaban intuitif mengapa model GLM LASSO memilih prediktor spesifik dari kelompok yang sangat berkorelasi, dan mengapa itu melakukannya secara berbeda maka pemilihan fitur subset terbaik. Dari geometri LASSO yang ditunjukkan pada Gambar 2 di Tibshirani 1996, saya dituntun untuk percaya bahwa LASSO memilih prediktor dengan varian yang lebih …


1
Model bahaya waktu diskrit (cloglog) di R
The survivalpaket di Rmuncul untuk fokus pada model survival waktu kontinu. Saya tertarik untuk memperkirakan versi waktu diskrit dari model bahaya proporsional, model log-log pelengkap. Saya memiliki model bertahan hidup yang cukup mudah, dengan sensor kanan sederhana. Saya tahu bahwa satu cara untuk memperkirakan model ini adalah dengan membuat set …
10 r  survival 

1
Histogram dengan Bins seragam vs non-seragam
Pertanyaan ini menjelaskan perbedaan mendasar antara histogram yang seragam dan yang tidak seragam. Dan pertanyaan ini membahas aturan praktis untuk memilih jumlah tempat sampah dari histogram seragam yang mengoptimalkan (dalam arti tertentu) sejauh mana histogram mewakili distribusi dari mana sampel data diambil. Sepertinya saya tidak dapat menemukan diskusi "optimalitas" yang …



Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.