Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data


2
Bagaimana saya bisa memperkirakan interval kepercayaan 95% menggunakan profil untuk parameter yang diestimasi dengan memaksimalkan fungsi log-likelihood menggunakan optim di R?
Bagaimana saya bisa memperkirakan interval kepercayaan 95% menggunakan profil untuk parameter yang diestimasi dengan memaksimalkan fungsi log-likelihood menggunakan optim di R? Saya tahu saya dapat secara asimtotik memperkirakan matriks kovarians dengan membalik goni , tetapi saya khawatir bahwa data saya tidak memenuhi asumsi yang diperlukan agar metode ini valid. Saya …

2
Kebingungan tentang kriging
Saya sedang membaca artikel wikipedia ini terkait dengan kriging. Saya tidak mengerti bagian ketika mengatakan itu Kriging menghitung terbaik linear berisi , dari Z ( x 0 ) sehingga kriging varians dari diminimalkan dengan kondisi unbiasedness. Saya tidak mendapatkan derivasi dan juga bagaimana variansnya diminimalkan. Ada saran?Z^(x0)Z^(x0)\hat Z (x_0)Z(x0)Z(x0)Z(x_0) Khususnya, …


1
Mensimulasikan distribusi
Saya sedang mengerjakan tugas Perencanaan Kapasitas dan saya telah membaca beberapa buku. Ini khusus tentang distribusi. Saya menggunakan R. Apa pendekatan yang direkomendasikan untuk mengidentifikasi apa distribusi data saya? Apakah ada metode statistik untuk mengidentifikasinya? Saya punya diagram ini. Apa saja pendekatan simulasi yang tersedia menggunakan R? Di sini saya …





2
Bootstrap parametrik, semiparametrik, dan nonparametrik untuk model campuran
Cangkok berikut diambil dari artikel ini . Saya pemula untuk bootstrap dan mencoba mengimplementasikan bootstrap parametrik, semiparametrik, dan nonparametrik untuk model campuran linier dengan R bootpaket. Kode R Ini Rkode saya : library(SASmixed) library(lme4) library(boot) fm1Cult <- lmer(drywt ~ Inoc + Cult + (1|Block) + (1|Cult), data=Cultivation) fixef(fm1Cult) boot.fn <- …
9 r  mixed-model  bootstrap  central-limit-theorem  stable-distribution  time-series  hypothesis-testing  markov-process  r  correlation  categorical-data  association-measure  meta-analysis  r  anova  confidence-interval  lm  r  bayesian  multilevel-analysis  logit  regression  logistic  least-squares  eda  regression  notation  distributions  random-variable  expected-value  distributions  markov-process  hidden-markov-model  r  variance  group-differences  microarray  r  descriptive-statistics  machine-learning  references  r  regression  r  categorical-data  random-forest  data-transformation  data-visualization  interactive-visualization  binomial  beta-distribution  time-series  forecasting  logistic  arima  beta-regression  r  time-series  seasonality  large-data  unevenly-spaced-time-series  correlation  statistical-significance  normalization  population  group-differences  demography 

1
Regresi berganda dengan variabel prediktor yang hilang
Misalkan kita diberi satu set data formulir dan . Kami diberi tugas untuk memprediksi berdasarkan nilai . Kami memperkirakan dua regresi di mana: ( y , x 1 , x 2 , ⋯ , x n - 1 ) y x y(y,x1,x2,⋯,xn)(y,x1,x2,⋯,xn)(y,x_{1},x_{2},\cdots, x_{n})(y,x1,x2,⋯,xn−1)(y,x1,x2,⋯,xn−1)(y,x_{1},x_{2},\cdots, x_{n-1})yyyxxxyy=f1(x1,⋯,xn−1,xn)=f2(x1,⋯,xn−1)(1)(2)(1)y=f1(x1,⋯,xn−1,xn)(2)y=f2(x1,⋯,xn−1) \begin{align} y &=f_{1}(x_{1},\cdots, x_{n-1}, x_{n}) \tag{1} …

3
Bias ketergantungan-distribusi-respons dalam regresi hutan acak
Saya menggunakan paket randomForest di R (R versi 2.13.1, randomForest versi 4.6-2) untuk regresi dan melihat bias yang signifikan dalam hasil saya: kesalahan prediksi tergantung pada nilai variabel respon. Nilai tinggi di bawah prediksi dan nilai rendah di atas prediksi. Pada awalnya saya menduga ini adalah konsekuensi dari data saya, …


3
Kinerja terbaik yang diharapkan pada kumpulan data
Katakanlah saya punya masalah pembelajaran mesin sederhana seperti klasifikasi. Dengan beberapa tolok ukur dalam penglihatan atau pengenalan audio, saya, sebagai manusia, adalah penggolong yang sangat baik. Karena itu saya memiliki intuisi tentang seberapa bagus classifier bisa didapat. Tetapi dengan banyak data, satu hal adalah saya tidak tahu seberapa bagus classifier …

2
Menyesuaikan model campuran Poisson GLM dengan kemiringan dan penyadapan acak
Saat ini saya sedang mengerjakan serangkaian model deret waktu Poisson yang mencoba memperkirakan efek perubahan dalam bagaimana penghitungan diperoleh (beralih dari satu uji diagnostik ke uji lain) sambil mengendalikan tren lain dari waktu ke waktu (katakanlah peningkatan umum pada kejadian penyakit). Saya punya data untuk sejumlah situs yang berbeda. Meskipun …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.