Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

1
Mengapa nilai taksiran dari Prediktor Linier Linier Terbaik (BLUP) berbeda dari Estimator Linier Tidak Cocok Terbaik (BIRU)?
Saya mengerti bahwa perbedaan di antara mereka terkait dengan apakah variabel pengelompokan dalam model diperkirakan sebagai efek tetap atau acak, tetapi tidak jelas bagi saya mengapa mereka tidak sama (jika mereka tidak sama). Saya secara khusus tertarik pada bagaimana ini bekerja ketika menggunakan estimasi area kecil, jika itu relevan, tetapi …

2
Cara menginterpretasikan plot ACF dan pacf ini
Berikut ini adalah plot acf dan pacf dari seri data bulanan. Plot kedua adalah acf dengan ci.type = 'ma': Bertahannya nilai tinggi dalam petak acf mungkin mewakili tren positif jangka panjang. Pertanyaannya adalah apakah ini mewakili variasi musiman? Saya mencoba melihat berbagai situs tentang topik ini, tetapi saya tidak yakin …

1
Bagaimana cara menggunakan metode delta untuk kesalahan standar efek marginal?
Saya tertarik untuk lebih memahami metode delta untuk mendekati kesalahan standar dari efek marginal rata-rata dari model regresi yang mencakup istilah interaksi. Saya telah melihat pertanyaan terkait di bawah metode delta tetapi tidak ada yang memberikan apa yang saya cari. Pertimbangkan contoh data berikut ini sebagai contoh yang memotivasi: set.seed(1) …


2
Apakah ada kelebihan SVD dibandingkan PCA?
Saya tahu cara menghitung PCA dan SVD secara matematis, dan saya tahu bahwa keduanya dapat diterapkan pada regresi Linear Least Squares. Keuntungan utama dari SVD secara matematis adalah dapat diterapkan pada matriks non-kuadrat. Kedua fokus pada dekomposisi dari matriks. Selain keunggulan SVD yang disebutkan, apakah ada keuntungan atau wawasan tambahan …
20 pca  least-squares  svd 

6
Apakah median jenis rata-rata, untuk beberapa generalisasi "rata-rata"?
Konsep "berarti" menjelajah jauh lebih luas daripada rata-rata aritmatika tradisional; Apakah itu membentang sejauh termasuk median? Dengan analogi, raw data⟶idraw data⟶meanraw mean⟶id−1arithmetic meanraw data⟶recipreciprocals⟶meanmean reciprocal⟶recip−1harmonic meanraw data⟶loglogs⟶meanmean log⟶log−1geometric meanraw data⟶squaresquares⟶meanmean square⟶square−1root mean squareraw data⟶rankranks⟶meanmean rank⟶rank−1medianraw data⟶idraw data⟶meanraw mean⟶id−1arithmetic meanraw data⟶recipreciprocals⟶meanmean reciprocal⟶recip−1harmonic meanraw data⟶loglogs⟶meanmean log⟶log−1geometric meanraw data⟶squaresquares⟶meanmean square⟶square−1root mean squareraw data⟶rankranks⟶meanmean …
20 mean  average  median 

2
Varian dari vektor acak setelah transformasi linear
Jika adalah vektor acak dan adalah matriks tetap, dapatkah seseorang menjelaskan mengapaZZ\mathbf {Z}SEBUAHSEBUAHAc o v [A Z ]=A c o v [ Z ] A⊤.cHaiv[SEBUAHZ]=SEBUAHcHaiv[Z]SEBUAH⊤.\mathrm{cov}[A \mathbf {Z}]= A \mathrm{cov}[\mathbf {Z}]A^\top.
20 covariance 

1
Cara mendapatkan nilai Mean squared error dalam regresi linier di R
Biarkan model regresi linier yang diperoleh oleh fungsi R lm ingin tahu apakah mungkin diperoleh dengan perintah Mean Squared Error. Saya memiliki output BERIKUT dari contoh > lm <- lm(MuscleMAss~Age,data) > sm<-summary(lm) > sm Call: lm(formula = MuscleMAss ~ Age, data = data) Residuals: Min 1Q Median 3Q Max -16.1368 …
20 r  regression  error 

3
Uji koefisien model (kemiringan regresi) terhadap beberapa nilai
Dalam R, ketika saya memiliki (umum) model linier ( lm, glm, gls, glmm, ...), bagaimana saya bisa menguji koefisien (slope regresi) terhadap nilai selain 0? Dalam ringkasan model, hasil uji t dari koefisien secara otomatis dilaporkan, tetapi hanya untuk perbandingan dengan 0. Saya ingin membandingkannya dengan nilai lain. Saya tahu …
20 r  regression  t-test 

2
Pengambilan sampel Gibbs versus MH-MCMC umum
Saya baru saja melakukan beberapa bacaan pada Gibbs sampling dan algoritma Metropolis Hastings dan punya beberapa pertanyaan. Seperti yang saya pahami, dalam kasus pengambilan sampel Gibbs, jika kita memiliki masalah multivariat yang besar, kita sampel dari distribusi bersyarat yaitu sampel satu variabel sambil menjaga semua yang lain tetap sedangkan di …



2
Analisis Kelangsungan Hidup Bayesian: tolong, tuliskan saya sebelumnya untuk Kaplan Meier!
Pertimbangkan pengamatan yang disensor benar, dengan peristiwa pada waktu . Jumlah individu yang rentan pada waktu adalah , dan jumlah peristiwa pada saat adalah .t1,t2,…t1,t2,…t_1, t_2, \dotsiiininin_iiiididid_i Kaplan-Meier atau penaksir produk muncul secara alami sebagai MLE ketika fungsi bertahan hidup adalah fungsi langkah . Kemungkinannya adalah dan MLE adalah .S(t)=∏i:ti<tαiS(t)=∏i:ti<tαiS(t) …

2
KKT versus formulasi regresi laso tanpa kendala
Regresi dihukum L1 (alias laso) disajikan dalam dua formulasi. Biarkan dua fungsi objektif menjadi Q1=12||Y−Xβ||22Q2=12||Y−Xβ||22+λ||β||1.Q1=12||Y−Xβ||22Q2=12||Y−Xβ||22+λ||β||1. Q_1 = \frac{1}{2}||Y - X\beta||_2^2 \\ Q_2 =\frac{1}{2}||Y - X\beta||_2^2 + \lambda ||\beta||_1. Kemudian dua formulasi yang berbeda adalah argminβQ1argminβQ1 \text{argmin}_\beta \; Q_1 tunduk ||β||1≤t,||β||1≤t, ||\beta||_1 \leq t, dan, ekuivalen dengan argminβQ2.argminβQ2. \text{argmin}_\beta \; Q_2. …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.