Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

1
Nested / SplitModel - RepeatMeasures / MixedModel ANOVA: level bersarang & skrip di R
Kumpulan data saya memiliki variabel berikut: Pengobatan (4 jenis - diperbaiki) Lokasi (8 lokasi - diperbaiki) Posisi di Lokasi (3 posisi per lokasi-tetap) Sampel diambil di setiap posisi (3 sampel per posisi-acak) Waktu (dua kali pengambilan sampel - ditetapkan) Tingkat mineralisasi (sebagai hasil analisis sampel yang diambil) Dua lokasi digunakan …

2
Bagaimana saya bisa mengubah data deret waktu sehingga saya bisa menggunakan teknik yang lebih sederhana untuk prediksi kesalahan?
Saya tahu ini terutama adalah situs statistik, jadi jika saya di luar topik, harap redirect saya. Saya memiliki sistem dengan pompa yang kadang pecah dan perlu diganti. Saya ingin dapat memprediksi kegagalan, dan dengan demikian memberikan peringatan dini kepada orang-orang yang mengganti pompa. Saya memiliki data historis untuk proses pompa, …

2
Memodelkan model campuran dalam JAGS / BUGS [ditutup]
Tutup. Pertanyaan ini di luar topik . Saat ini tidak menerima jawaban. Ingin meningkatkan pertanyaan ini? Perbarui pertanyaan sehingga sesuai topik untuk Cross Validated. Ditutup 8 bulan lalu . Saat ini saya sedang dalam proses menerapkan model untuk prediksi hasil sepak bola di JAGS. Sebenarnya, saya telah menerapkan beberapa, tetapi …

2
Aplikasi Analisis Kelangsungan Hidup yang Tepat
Saya memiliki percobaan yang akan menghasilkan pengamatan waktu sampai suatu peristiwa terjadi. Beberapa sifat dasar adalah itu Kami menghitung jumlah peristiwa yang terjadi di beberapa titik .t1, . . . ,tnt1,...,tnt_1,...,t_n Waktu acara disensor interval, antara ,( t - 1 , t ](t-1,t](t-1,t] Individu tidak akan meninggalkan persidangan antara , …
8 survival 

3
Estimasi parameter distribusi eksponensial dengan sampling bias
Saya ingin menghitung parameter dari distribusi eksponensial dari populasi sampel yang diambil dari distribusi ini dalam kondisi bias. Sejauh yang saya tahu, untuk sampel nilai n, estimator yang biasa adalah . Namun sampel saya bias sebagai berikut:λλ\lambdae- λ xe−λxe^{-\lambda x}λ^=n∑xsayaλ^=n∑xi\hat{\lambda} = \frac{n}{\sum x_i} Dari populasi lengkap elemen m yang diambil …


1
Meramalkan seri waktu non-stasioner
Saya ingin meramalkan deret waktu non-stasioner, yang melibatkan beberapa asumsi a-priori penting setelah mempelajari contoh-contoh deret tersebut. Saya telah membangun fungsi distribusi probabilitas satu titik rata-rata waktu yang diperkirakan oleh distribusi normal. Dari sudut pandang ini, saya ingin perkiraan tidak melebihi ini ketika . Dengan kata lain, varian harus dibatasi.hal^( …



1
Generalisasi distribusi dan klasifikasi normal multivariat
Saya tertarik pada keluarga distribusi multivariat yang dapat dilihat sebagai generalisasi dari distribusi normal multivariat, sejauh ditentukan oleh nilai ekspektasi μ⃗ μ→\vec \mu dan matriks kovarians ΣΣ\Sigma, ditambah fungsi yang menurun secara monoton g(d)g(d)g(d) sedemikian rupa sehingga kepadatannya p(x⃗ )∝g(Δ(x⃗ ,μ⃗ ))p(x→)∝g(Δ(x→,μ→)) p(\vec x) \propto g \left ( \Delta(\vec x, …

2
Menafsirkan output jaringan saraf dalam R?
Saya berhasil membuat jaringan saraf data saya. Tapi saya tidak begitu yakin tentang interpretasi output R. Saya menggunakan perintah berikut untuk membuat jaringan saraf: > net=nnet(formula = category~iplen+date_time, size=0,skip=T,lineout=T) # weights: 3 initial value 136242.000000 final value 136242.000000 converged Kemudian saya menggunakan perintah berikut untuk melihat hasilnya: > summary(net) a …


3
Post hoc test dalam ANOVA desain campuran 2x3 menggunakan SPSS?
Saya memiliki dua kelompok yang terdiri dari 10 peserta yang dinilai tiga kali selama percobaan. Untuk menguji perbedaan antara kelompok dan di tiga penilaian, saya menjalankan ANOVA desain campuran 2x3 dengan group(kontrol, eksperimental), time(pertama, kedua, tiga), dan group x time. Keduanya timedan grouphasilnya signifikan, selain itu ada interaksi yang signifikan …
8 anova  mixed-model  spss  post-hoc  bonferroni  time-series  unevenly-spaced-time-series  classification  normal-distribution  discriminant-analysis  probability  normal-distribution  estimation  sampling  classification  svm  terminology  pivot-table  random-generation  self-study  estimation  sampling  estimation  categorical-data  maximum-likelihood  excel  least-squares  instrumental-variables  2sls  total-least-squares  correlation  self-study  variance  unbiased-estimator  bayesian  mixed-model  ancova  statistical-significance  references  p-value  fishers-exact  probability  monte-carlo  particle-filter  logistic  predictive-models  modeling  interaction  survey  hypothesis-testing  multiple-regression  regression  variance  data-transformation  residuals  minitab  r  time-series  forecasting  arima  garch  correlation  estimation  least-squares  bias  pca  predictive-models  genetics  sem  partial-least-squares  nonparametric  ordinal-data  wilcoxon-mann-whitney  bonferroni  wilcoxon-signed-rank  traminer  regression  econometrics  standard-error  robust  misspecification  r  probability  logistic  generalized-linear-model  r-squared  effect-size  gee  ordered-logit  bayesian  classification  svm  kernel-trick  nonlinear  bayesian  pca  dimensionality-reduction  eigenvalues  probability  distributions  mathematical-statistics  estimation  nonparametric  kernel-smoothing  expected-value  filter  mse  time-series  correlation  data-visualization  clustering  estimation  predictive-models  recommender-system  sparse  hypothesis-testing  data-transformation  parametric  probability  summations  correlation  pearson-r  spearman-rho  bayesian  replicability  dimensionality-reduction  discriminant-analysis  outliers  weka 

1
Klasifikasi SVM non-linear dengan kernel RBF
Saya menerapkan classifier SVM non-linear dengan RBF kernel. Saya diberitahu bahwa satu-satunya perbedaan dari SVM normal adalah bahwa saya harus mengganti produk dot dengan fungsi kernel: Saya tahu bagaimana SVM linear normal bekerja, yaitu, setelah menyelesaikan masalah optimasi kuadratik (tugas ganda), saya menghitung hyperplane pembagian optimal seperti dan offset dari …

4
Apakah Bayesian Classifier merupakan pendekatan yang baik untuk teks dengan meta-data numerik?
Saya mencoba membuat pendekatan untuk mendeteksi iklan penipuan di situs web saya. Saya pikir masalahnya ada banyak kesamaan dengan mendeteksi email spam (yang mana Bayesian classifier adalah solusi umum) karena banyak sinyal yang mengindikasikan penipuan akan ditemukan dalam teks iklan. Namun, ada beberapa informasi lain yang bisa menjadi indikator scam …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.