Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

2
Apakah derajat kebebasan di lmerTest :: anova benar? Mereka sangat berbeda dari RM-ANOVA
Saya menganalisis hasil percobaan waktu reaksi dalam R. Saya menjalankan pengukuran ANOVA berulang (1 faktor dalam subjek dengan 2 level dan 1 antara faktor subjek dengan 2 level). Saya menjalankan model campuran linear yang sama dan saya ingin meringkas hasil lmer dalam bentuk tabel ANOVA menggunakan lmerTest::anova. Jangan salah paham: …

3
Bagaimana pembobotan data keanekaragaman Komunitas Survei Amerika akan mempengaruhi margin kesalahannya?
Latar belakang: Organisasi saya saat ini membandingkan statistik keanekaragaman tenaga kerjanya (mis.% Orang dengan disabilitas,% wanita,% veteran) dengan total ketersediaan tenaga kerja untuk kelompok-kelompok tersebut berdasarkan American Community Survey (proyek survei oleh US Census Bureau). Ini adalah tolok ukur yang tidak akurat, karena kami memiliki serangkaian pekerjaan yang sangat spesifik …


2
Ukuran yang tepat untuk menemukan matriks kovariansi terkecil
Dalam buku teks yang saya baca mereka menggunakan ketajaman positif (semi-positive definiteness) untuk membandingkan dua matriks kovarian. Gagasan bahwa jika A−BA−BA-B adalah pd maka lebih kecil dari . Tapi aku berjuang untuk mendapatkan intuisi dari hubungan ini?BBBAAA Ada utas serupa di sini: /math/239166/what-is-the-intuition-for-using-definiteness-to-compare-matrices Apa intuisi untuk menggunakan ketetapan untuk membandingkan …

4
Ide model campuran dan metode Bayesian
Dalam model campuran, kami mengasumsikan efek acak (parameter) adalah variabel acak yang mengikuti distribusi normal. Itu terlihat sangat mirip dengan metode Bayesian, di mana semua parameter dianggap acak. Jadi, apakah model efek acak jenis kasus khusus metode Bayesian?

2
Inferensi regresi yang kuat dan penaksir Sandwich
Bisakah Anda memberi saya contoh penggunaan estimator sandwich untuk melakukan inferensi regresi yang kuat? Saya dapat melihat contohnya ?sandwich, tetapi saya tidak begitu mengerti bagaimana kita dapat beralih dari lm(a ~ b, data)( r -code) ke estimasi dan nilai p yang dihasilkan dari model regresi menggunakan matriks varians-kovarians yang dikembalikan …
10 r  regression  lm  sandwich 

2
Merencanakan statistik ringkasan dengan mean, sd, min, dan maks?
Saya dari latar belakang ekonomi dan biasanya dalam disiplin statistik ringkasan variabel dilaporkan dalam tabel. Namun, saya ingin merencanakannya. Saya bisa memodifikasi plot kotak untuk memungkinkannya menampilkan mean, standar deviasi, minimum dan maksimum tetapi saya tidak ingin melakukannya karena plot kotak secara tradisional digunakan untuk menampilkan median dan Q1 dan …



1
Integrasikan dengan eCDF dengan cepat di R
Saya memiliki persamaan integral dari bentuk mana adalah cdf empiris dan adalah fungsi . Saya memiliki pemetaan kontraksi dan jadi saya mencoba untuk menyelesaikan persamaan integral dengan menggunakan urutan teorema Fixed Point Banach.F n gT1( x ) = ∫x0g( T1( y) ) d F^n( y)T1(x)=∫0xg(T1(y)) dF^n(y) T_1(x) = \int_0^x g(T_1(y)) …

4
Saya ingin menunjukkan
Mari X:Ω→NX:Ω→NX:\Omega \to \mathbb N menjadi variabel acak pada probabilitas ruang (Ω,B,P)(Ω,B,P)(\Omega,\mathcal B,P) .show bahwa E(X)=∑n=1∞P(X≥n).E(X)=∑n=1∞P(X≥n).E(X)=\sum_{n=1}^\infty P(X\ge n). definisi saya dari E(X)E(X)E(X) sama dengan E(X)=∫ΩXdP.E(X)=∫ΩXdP.E(X)=\int_\Omega X \, dP. Terima kasih.

2
Bagaimana membandingkan rata-rata dua sampel yang datanya sesuai dengan distribusi eksponensial
Saya memiliki dua sampel data, sampel awal, dan sampel perawatan. Hipotesisnya adalah bahwa sampel perlakuan memiliki rata-rata yang lebih tinggi daripada sampel awal. Kedua sampel berbentuk eksponensial. Karena datanya agak besar, saya hanya memiliki rata-rata dan jumlah elemen untuk setiap sampel pada saat saya akan menjalankan tes. Bagaimana saya bisa …

1
Apakah ada "standar" untuk notasi model statistik?
Sebagai contoh, dalam manual BUGS atau buku yang akan datang oleh Lee dan Wagenmakers ( pdf ) dan di banyak tempat lain jenis notasi digunakan yang bagi saya tampaknya sangat fleksibel karena dapat digunakan untuk menggambarkan secara ringkas sebagian besar model statistik. Contoh dari notasi ini adalah sebagai berikut: ysaya∼ …

2
Memahami Fitur Hashing
Wikipedia memberikan contoh berikut ketika menjelaskan hashing fitur ; tetapi pemetaan tampaknya tidak konsisten dengan kamus yang ditentukan Misalnya, toharus dikonversi 3sesuai dengan kamus, tetapi dikodekan sebagai 1gantinya. Apakah ada kesalahan dalam deskripsi? Bagaimana cara kerja hashing fitur? Teks: John likes to watch movies. Mary likes too. John also likes …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.