Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

3
Bagaimana cara mengartikan parameter GARCH?
Saya menggunakan model GARCH standar: rtσ2t=σtϵt=γ0+γ1r2t−1+δ1σ2t−1rt=σtϵtσt2=γ0+γ1rt−12+δ1σt−12\begin{align} r_t&=\sigma_t\epsilon_t\\ \sigma^2_t&=\gamma_0 + \gamma_1 r_{t-1}^2 + \delta_1 \sigma^2_{t-1} \end{align} Saya memiliki perkiraan koefisien yang berbeda dan saya perlu menafsirkannya. Karena itu saya bertanya-tanya tentang interpretasi yang bagus, jadi apa yang mewakili γ0γ0\gamma_0 , γ1γ1\gamma_1 dan δ1δ1\delta_1 ? Saya melihat bahwa γ0γ0\gamma_0 adalah sesuatu seperti …


2
Hubungan antara uji McNemar dan regresi logistik bersyarat
Saya tertarik pada pemodelan data respons biner dalam observasi berpasangan. Kami bertujuan untuk membuat kesimpulan tentang efektivitas intervensi pra-pasca dalam suatu kelompok, berpotensi menyesuaikan diri untuk beberapa kovariat dan menentukan apakah ada modifikasi efek oleh kelompok yang menerima pelatihan yang sangat berbeda sebagai bagian dari intervensi. Diberikan data dari formulir …

5
Metode untuk menghasilkan data non-normal berkorelasi
Saya tertarik untuk mencari metode untuk menghasilkan data non-normal yang berkorelasi. Jadi idealnya semacam distribusi yang mengambil dalam matriks kovarians (atau korelasi) sebagai parameter dan menghasilkan data yang mendekati itu. Tapi inilah intinya: metode yang saya coba temukan harus memiliki fleksibilitas untuk juga mengontrol kemiringan multivariat dan / atau kurtosis. …


2
Apakah regresi bertahap memberikan estimasi bias populasi r-square?
Dalam bidang psikologi dan bidang lainnya bentuk regresi bertahap sering digunakan yang melibatkan hal-hal berikut: Lihatlah prediktor yang tersisa (tidak ada dalam model pada awalnya) dan identifikasi prediktor yang menghasilkan perubahan r-square terbesar; Jika nilai p dari perubahan r-square kurang dari alpha (biasanya 0,05), maka sertakan prediktor itu dan kembali …

6
Cara membagi set data untuk melakukan validasi silang 10 kali lipat
Terkunci . Pertanyaan ini dan jawabannya dikunci karena pertanyaannya di luar topik tetapi memiliki signifikansi historis. Saat ini tidak menerima jawaban atau interaksi baru. Sekarang saya memiliki Rkerangka data (pelatihan), adakah yang bisa memberi tahu saya cara membagi set data ini secara acak untuk melakukan validasi silang 10 kali lipat?

2
Mengapa probabilitas nol untuk nilai tertentu dari distribusi normal?
Saya perhatikan bahwa dalam distribusi Normal, probabilitas sama dengan nol, sedangkan untuk distribusi Poisson, itu tidak akan sama dengan nol ketika c adalah bilangan bulat non-negatif.P(x=c)P(x=c)P(x=c)ccc Pertanyaan saya adalah: Apakah probabilitas konstanta dalam distribusi normal sama dengan nol karena mewakili area di bawah kurva apa pun? Atau itu hanya aturan …

5
Paket R KNutasi imputasi
Saya mencari paket imputasi KNN. Saya telah melihat paket imputasi ( http://cran.r-project.org/web/packages/imputation/imputation.pdf ) tetapi untuk beberapa alasan fungsi impute KNN (bahkan ketika mengikuti contoh dari deskripsi) hanya tampak untuk memasukkan nilai nol (sesuai di bawah ini). Saya telah melihat-lihat tetapi belum menemukan sesuatu, dan karenanya bertanya-tanya apakah ada yang punya …

3
Kesalahan standar median
Apakah rumus berikut ini benar jika saya ingin mengukur kesalahan standar median dalam kasus sampel kecil dengan distribusi tidak normal (saya menggunakan python)? sigma=np.std(data) n=len(data) sigma_median=1.253*sigma/np.sqrt(n)

1
Perancu - definisi
Menurut M. Katz dalam bukunya Multivariable analysis (Bagian 1.2, halaman 6), " Seorang perancu dikaitkan dengan faktor risiko dan secara kausal terkait dengan hasil. " Mengapa perancu harus terkait secara kausal dengan hasil? Apakah cukup bagi perancu untuk dikaitkan dengan hasilnya?


4
Tes Brant dalam R [ditutup]
Tutup. Pertanyaan ini di luar topik . Saat ini tidak menerima jawaban. Ingin meningkatkan pertanyaan ini? Perbarui pertanyaan sehingga sesuai topik untuk Cross Validated. Ditutup 6 bulan lalu . Dalam menguji asumsi regresi paralel dalam regresi logistik ordinal saya menemukan ada beberapa pendekatan. Saya telah menggunakan pendekatan grafis (seperti yang …

3
Mengapa kita menggunakan k-means daripada algoritma lainnya?
Saya meneliti tentang k-means dan ini adalah apa yang saya dapatkan: k-means adalah salah satu algoritma paling sederhana yang menggunakan metode pembelajaran tanpa pengawasan untuk memecahkan masalah pengelompokan yang diketahui. Ini bekerja sangat baik dengan kumpulan data besar. Namun, ada juga kekurangan K-Means yaitu: Sensitivitas yang kuat terhadap pencilan dan …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.