Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

2
Rasio penerimaan dalam algoritma Metropolis – Hastings
Dalam algoritma Metropolis – Hastings untuk pengambilan sampel distribusi target, misalkan: πiπi\pi_{i} menjadi kerapatan target di keadaan ,iii πjπj\pi_j menjadi densitas target pada status yang diusulkan ,jjj hijhijh_{ij} menjadi kepadatan proposal untuk transisi ke keadaan mengingat keadaan saat ini ,jjjiii aijaija_{ij} menjadi kemungkinan menerima keadaan yang diusulkan diberikan keadaan saat …

1
Beberapa pertanyaan tentang model statistik waktu keuangan dari "orang yang belajar mesin"
Untuk menjelaskan mengapa saya memiliki pertanyaan bodoh yang akan Anda temukan di bawah ini, saya harus mengatakan bahwa saya lebih sebagai orang yang belajar mesin. Sementara saya mengerjakan masalah dalam bioinformatika, semuanya baik-baik saja. Ketika saya mendengar kata-kata seperti "regresi" atau "kurtosis dan skewness", dalam kasus pertama saya hanya tersenyum, …

2
Probabilitas hubungan pada distribusi titik-titik yang seragam di atas ruang 2D
Asumsikan satu set node tersebar di permukaan 2D sehingga untuk setiap , jumlah node di dalam mengikuti distribusi Poisson dengan parameter , di manamenunjukkan area dari subset dan adalah intensitas dari poin (jumlah rata-rata poin per unit area).SS\mathcal{S}A⊂SA⊂S\mathcal{A} \subset \mathcal{S}AA\mathcal{A}|A|ρ|A|ρ|\mathcal{A}| \rho|A||A||\mathcal{A}|AA\mathcal{A}ρρ\rho Kami hanya tertarik pada titik-titik di dalam lingkaran yang …

4
Metode terbaik untuk mengubah urutan perbedaan rendah menjadi distribusi normal?
Saya telah menggunakan sekuens diskrepansi yang rendah untuk sementara waktu untuk Distribusi Seragam, karena saya telah menemukan sifat-sifatnya berguna (terutama dalam grafik komputer untuk penampilan acak mereka dan kemampuan mereka untuk menutupi [0,1] dengan padat secara bertahap). Misalnya, nilai acak di atas, nilai urutan Halton di bawah: Saya sedang mempertimbangkan …


5
ANCOVA dalam R menunjukkan penyadapan yang berbeda, tetapi 95% CI tumpang tindih ... bagaimana ini mungkin?
Kami memiliki kumpulan data dengan dua kovariat dan variabel pengelompokan kategoris dan ingin tahu apakah ada perbedaan yang signifikan antara kemiringan atau intersep di antara kovariat yang terkait dengan variabel pengelompokan yang berbeda. Kami telah menggunakan anova () dan lm () untuk membandingkan kecocokan dari tiga model yang berbeda: 1) …

2
Apakah urutan perbedaan rendah bekerja di ruang diskrit?
Urutan perbedaan rendah dalam ruang nyata ([ 0 , 1]n[0,1]n[0,1]^n) tampak seperti alat yang sangat baik untuk pengambilan sampel ruang sampel secara merata. Sejauh yang saya tahu, mereka menggeneralisasi dengan baik ke ruang nyata apa pun, jika Anda menggunakan peta yang sesuai (mis.[ 0 , 1 ] → [ a …
9 sampling 

1
Bisakah kemungkinan -2 Log dihitung dengan hanya satu model?
Saya menggunakan glmfitfungsi di MATLAB. Fungsi hanya mengembalikan penyimpangan dan bukan kemungkinan log. Saya mengerti bahwa penyimpangan pada dasarnya adalah dua kali perbedaan antara kemungkinan log dari model tetapi apa yang saya tidak dapatkan adalah saya hanya menggunakan glmfituntuk membuat satu model, tetapi entah bagaimana saya mendapatkan penyimpangan. Tidakkah perhitungan …

3
Bagaimana cara menggunakan komponen utama sebagai prediktor dalam GLM?
Bagaimana saya menggunakan output dari analisis komponen utama (PCA) dalam model linier umum (GLM), dengan asumsi PCA digunakan untuk pemilihan variabel untuk GLM? Klarifikasi: Saya ingin menggunakan PCA untuk menghindari penggunaan variabel yang berhubungan dalam GLM. Namun, PCA memberi saya output seperti .2*variable1+.5*variable3dll. Saya terbiasa menempatkan variabel 1 dan 3 …



1
Temukan persamaan dari output model linear umum
Katakanlah saya menghasilkan probabilitas hasil berdasarkan faktor tertentu dan plot kurva hasil itu. Apakah ada cara untuk mengekstrak persamaan untuk kurva itu dari R? > mod = glm(winner~our_bid, data=mydat, family=binomial(link="logit")) > summary(mod) Call: glm(formula = winner ~ our_bid, family = binomial(link = "logit"), data = mydat) Deviance Residuals: Min 1Q …


4
Penggandaan vektor dalam BUGS dan JAGS
Dalam R, c (3,1,0) * c (2,0,1) == c (6,0,0). Ini bukan produk titik dan bukan produk lintas. Pertama, apa nama untuk produk ini, dan kedua, apakah itu berfungsi di WinBUGS, OpenBUGS, dan / atau JAGS?
9 bugs  jags 


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.