Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

1
Apa manfaat menggunakan tes permutasi?
Saat menguji beberapa hipotesis nol versus alternatif dengan statistik uji , di manaU(X)U(X)U(X)X={xi,...,xn}X={xi,...,xn}X = \{ x_i, ..., x_n\} , terapkan tes permutasi dengan setpermutasi padadan kami memiliki statistik GGGXXXT(X):=#{π∈G:U(πX)≥U(X)}|G|.T(X):=#{π∈G:U(πX)≥U(X)}|G|. T(X) := \frac{\# \{\pi \in G: U(\pi X) \geq U(X)\}}{|G|}. Apa manfaat menggunakan tes permutasi daripada tidak menggunakannya? Yaitu seperti apa …

2
Apakah nilai tunggal ini cocok dengan distribusi itu?
ini terasa seperti pertanyaan yang sangat naif tetapi saya mengalami kesulitan melihat jawabannya. Saya memiliki satu set 30 nilai. Secara mandiri saya memperoleh nilai ke-31. Hipotesis nol adalah bahwa nilai 31 adalah bagian dari distribusi yang sama. Alternatifnya berbeda. Saya ingin semacam nilai p atau ukuran kemungkinan. Beberapa pemikiran yang …

1
Metode penalti untuk data kategorikal: menggabungkan level dalam suatu faktor
Model yang dihukum dapat digunakan untuk memperkirakan model yang jumlah parameternya sama atau bahkan lebih besar dari ukuran sampel. Situasi ini dapat muncul dalam model log-linear dari tabel jarang besar dari data kategorikal atau jumlah. Dalam pengaturan ini, sering juga diinginkan atau membantu untuk merobohkan tabel dengan menggabungkan level faktor …



3
Mengukur beberapa pasien lebih dari satu kali
Saya sedang melakukan studi klinis di mana saya menentukan ukuran antropometrik pasien. Saya tahu bagaimana menangani situasi di mana saya memiliki satu ukuran per pasien: Saya membuat model, di mana saya memiliki sampel acak dari beberapa kepadatan , dan saya melakukan hal-hal yang biasa: tulis kemungkinan sampel, memperkirakan parameter, menentukan …
10 inference 


4
Model Sejarah Acara Diskrit-Waktu (Bertahan Hidup) di R
Saya mencoba menyesuaikan model waktu-diskrit dalam R, tapi saya tidak yakin bagaimana melakukannya. Saya telah membaca bahwa Anda dapat mengatur variabel dependen dalam baris yang berbeda, satu untuk setiap pengamatan waktu, dan menggunakan glmfungsi dengan logit atau tautan cloglog. Dalam hal ini, saya memiliki tiga kolom: ID, Event(1 atau 0, …
10 r  survival  pca  sas  matlab  neural-networks  r  logistic  spatial  spatial-interaction-model  r  time-series  econometrics  var  statistical-significance  t-test  cross-validation  sample-size  r  regression  optimization  least-squares  constrained-regression  nonparametric  ordinal-data  wilcoxon-signed-rank  references  neural-networks  jags  bugs  hierarchical-bayesian  gaussian-mixture  r  regression  svm  predictive-models  libsvm  scikit-learn  probability  self-study  stata  sample-size  spss  wilcoxon-mann-whitney  survey  ordinal-data  likert  group-differences  r  regression  anova  mathematical-statistics  normal-distribution  random-generation  truncation  repeated-measures  variance  variability  distributions  random-generation  uniform  regression  r  generalized-linear-model  goodness-of-fit  data-visualization  r  time-series  arima  autoregressive  confidence-interval  r  time-series  arima  autocorrelation  seasonality  hypothesis-testing  bayesian  frequentist  uninformative-prior  correlation  matlab  cross-correlation 

1
Pertanyaan tentang fungsi sampel autokovarian
Saya membaca buku analisis deret waktu dan rumus untuk sampel autocovariance didefinisikan dalam buku ini sebagai: γˆ(h)=n−1∑t=1n−h(xt+h−x¯)(xt−x¯)γ^(h)=n−1∑t=1n−h(xt+h−x¯)(xt−x¯)\widehat{\gamma}(h) = n^{-1}\displaystyle\sum_{t=1}^{n-h}(x_{t+h}-\bar{x})(x_t-\bar{x}) denganuntuk . adalah mean.γˆ(−h)=γˆ(h)γ^(−h)=γ^(h)\widehat{\gamma}(-h) = \widehat{\gamma}(h)\;h=0,1,...,n−1h=0,1,...,n−1\;h = 0,1, ..., n-1x¯x¯\bar{x} Bisakah seseorang menjelaskan secara intuitif mengapa kita membagi jumlah dengan dan bukan dengan ? Buku ini menjelaskan bahwa ini adalah karena …



1
Menentukan istilah Error () dalam tindakan berulang ANOVA di R
Saya mengalami masalah dengan mendefinisikan istilah kesalahan untuk pengukuran dua arah berulang ANOVA di R. Data saya terdiri dari perkiraan kepadatan kayu untuk tiga posisi radial (dalam, tengah, dan luar) di sepanjang inti yang diekstraksi dari pohon. Ada total 20 spesies pohon, 6 individu dari setiap spesies, dan dua core …


3
Algoritma pembelajaran mesin untuk peringkat
Aku punya satu set unsur yang saya bisa menggambarkan sesuai dengan karakteristik. Jadi:nXXXnnn xi:{ci1,ci2,…,cin}∣xi∈Xxi:{ci1,ci2,…,cin}∣xi∈Xx_i: \{c_{i1}, c_{i2}, \ldots, c_{in}\} \mid x_i \in X di mana adalah evaluasi (numerik) untuk elemen sesuai dengan karakteristik . Jadi elemen saya dapat dilihat sebagai titik dalam ruang dimensi. i j ncijcijc_{ij}iiijjjnnn Menurut bacaan saya, ada …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.