Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

5
Makalah penting tentang dekomposisi matriks
Baru-baru ini saya membaca buku Skillicorn tentang dekomposisi matriks, dan sedikit kecewa, karena ditargetkan untuk audiens sarjana. Saya ingin mengkompilasi (untuk saya dan orang lain) bibliografi singkat dari makalah penting (survei, tetapi juga makalah terobosan) pada dekomposisi matriks. Apa yang ada dalam pikiran saya terutama adalah sesuatu pada SVD / …

1
Sudahkah saya menghitung rasio kemungkinan ini dengan benar?
Saya penulis paket ez untuk R, dan saya sedang mengerjakan pembaruan untuk menyertakan perhitungan otomatis rasio kemungkinan (LR) dalam output ANOVA. Idenya adalah untuk memberikan LR untuk setiap efek yang analog dengan pengujian efek yang dicapai ANOVA. Misalnya, LR untuk efek utama mewakili perbandingan model nol dengan model yang mencakup …


2
Bagaimana kekuatan dari regresi logistik dan uji-t dibandingkan?
Apakah kekuatan regresi logistik dan uji-t setara? Jika demikian, mereka harus "setara kepadatan data" yang saya maksudkan bahwa jumlah pengamatan yang mendasari yang sama menghasilkan kekuatan yang sama dengan alfa tetap 0,05. Pertimbangkan dua kasus: [Uji-parametrik]: 30 gambar dari pengamatan binomial dibuat dan nilai-nilai yang dihasilkan dirata-rata. Ini dilakukan 30 …

3
Bagaimana saya bisa memperkirakan kesalahan standar koefisien saat menggunakan regresi ridge?
Saya menggunakan regresi ridge pada data yang sangat multikolinier. Menggunakan OLS saya mendapatkan kesalahan standar besar pada koefisien karena multikolinieritas. Saya tahu regresi ridge adalah cara untuk menangani masalah ini, tetapi dalam semua implementasi regresi ridge yang saya lihat, tidak ada kesalahan standar yang dilaporkan untuk koefisien. Saya ingin beberapa …




2
Kapan MCMC menjadi biasa?
Adakah yang tahu sekitar tahun berapa MCMC menjadi hal yang biasa (yaitu, metode populer untuk inferensi Bayesian)? Tautan ke jumlah artikel MCMC (jurnal) yang diterbitkan seiring waktu akan sangat membantu.
18 bayesian  mcmc  history 

5
Mengapa kami tidak menggunakan distribusi-t untuk membangun interval kepercayaan untuk proporsi?
Untuk menghitung interval kepercayaan (CI) untuk rata-rata dengan deviasi standar populasi yang tidak diketahui (SD) kami memperkirakan deviasi standar populasi dengan menggunakan t-distribusi. Khususnya, mana . Tetapi karena, kami tidak memiliki estimasi titik standar deviasi populasi, kami memperkirakan melalui perkiraan manaCI=X¯±Z95%σX¯CI=X¯±Z95%σX¯CI=\bar{X} \pm Z_{95\% }\sigma_{\bar X}σX¯=σn√σX¯=σn\sigma_{\bar X} = \frac{\sigma}{\sqrt n}CI=X¯±t95%(se)CI=X¯±t95%(se)CI=\bar{X} \pm …

4
Gambarkan bilangan bulat secara independen & seragam secara acak dari 1 ke
Saya ingin menggambar bilangan bulat dari 1 ke beberapa tertentu dengan menggulirkan sejumlah dadu enam sisi yang adil (d6). Jawaban yang baik akan menjelaskan mengapa metodenya menghasilkan bilangan bulat seragam dan independen .NNN Sebagai contoh ilustrasi, akan sangat membantu untuk menjelaskan bagaimana solusi bekerja untuk kasus .N=150N=150N=150 Lebih jauh, saya …




2
Mengapa keluarga eksponensial tidak memasukkan semua distribusi?
Saya membaca buku: Uskup, Pengenalan Pola dan Pembelajaran Mesin (2006) yang mendefinisikan keluarga eksponensial sebagai distribusi bentuk (Persamaan 2.194): p(x|η)=h(x)g(η)exp{ηTu(x)}p(x|η)=h(x)g(η)exp⁡{ηTu(x)}p(\mathbf x|\boldsymbol \eta) = h(\mathbf x) g(\boldsymbol \eta) \exp \{\boldsymbol \eta^\mathrm T \mathbf u(\mathbf x)\} Tapi saya melihat tidak ada batasan yang ditempatkan pada atau \ mathbf u (\ mathbf x) …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.