Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

2
Paket R mana yang digunakan untuk melakukan analisis pertumbuhan kelas laten (LCGA) / model campuran pertumbuhan (GMM)?
Saya mencoba melakukan analisis pertumbuhan kelas laten (LCGA) dan / atau model campuran pertumbuhan (GMM) di R. Data yang saya gunakan adalah peningkatan jumlah garpu repositori git (variabel diskrit, bukan kategorikal), yang Anda bisa lihat di dataset ini . Saya mencoba lavaan, yang membantu saya menyesuaikan model kurva pertumbuhan laten, …

1
Perbandingan entropi dan distribusi byte dalam data terkompresi / terenkripsi
Saya punya beberapa pertanyaan yang cukup lama. Tes entropi sering digunakan untuk mengidentifikasi data yang dienkripsi. Entropi mencapai maksimum ketika byte dari data yang dianalisis didistribusikan secara seragam. Tes entropi mengidentifikasi data yang dienkripsi, karena data ini memiliki data terkompresi seperti distribusi yang seragam, yang diklasifikasikan sebagai terenkripsi ketika menggunakan …

3
Bagaimana cara membandingkan data peringkat?
Saya punya beberapa pertanyaan tentang bagaimana menganalisis data peringkat. Data terlihat seperti ini: 4 kelompok orang dengan HIV dan 16 kelompok orang lain yang tinggal di desa yang sama diminta untuk membuat peringkat 12 tantangan bagi orang dengan HIV menurut tingkat kepentingannya. (fe kesehatan fisik - penerimaan sosial - kesehatan …

3
Analogi sensitivitas dan spesifisitas untuk hasil yang berkelanjutan
Bagaimana saya bisa menghitung sensitivitas dan spesifisitas (atau tindakan analog) dari tes diagnostik berkelanjutan dalam memprediksi hasil yang berkelanjutan (misalnya, tekanan darah) tanpa mendikotomisasi hasilnya? Ada ide? Tampaknya para peneliti telah melakukan ini menggunakan pemodelan efek campuran (lihat tautan di bawah), tetapi saya tidak terbiasa dengan penggunaan teknik ini: http://www.ncbi.nlm.nih.gov/pmc/articles/PMC3026390/ …

2
Bagaimana cara menafsirkan plot kotak?
Saya memiliki beberapa data di mana ada 5 variabel penjelas kategori ( concern, breath, weath, sleep, act) dan 1 variabel respon kontinu ( tto). Selain itu, setiap variabel penjelas kategori dibagi menjadi 5 level yang menunjukkan seberapa kuat seseorang merasakannya. level 1 dan level 5 masing-masing menunjukkan kondisi sempurna dan …


2
Dua periode musiman di ARIMA menggunakan R
Saat ini saya menggunakan R untuk memprediksi deret waktu dengan instruksi ini: X <- ts(datas, frequency=24) X.arima <- Arima(X, order=c(2,1,0), seasonal=c(1,1,1)) pred <- predict(X.arima, n.ahead=24) plot.ts(pred$pred) Seperti yang Anda lihat, saya memiliki data setiap jam, dan saya memilih periode musiman 24 (satu hari). Saya ingin meningkatkan perkiraan saya menggunakan periode …

5
Merapikan data 2D
Data terdiri dari spektra optik (intensitas cahaya terhadap frekuensi) yang direkam pada waktu yang bervariasi. Poin diperoleh pada grid reguler dalam x (waktu), y (frekuensi). Untuk menganalisis evolusi waktu pada frekuensi tertentu (kenaikan cepat, diikuti oleh peluruhan eksponensial), saya ingin menghapus beberapa derau yang ada dalam data. Kebisingan ini, untuk …

1
Apa kelebihan metode Multiple Kernel Learning (MKL)?
Metode Multiple Kernel Learning bertujuan untuk membangun model kernel di mana kernel merupakan kombinasi linear dari kernel basis tetap. Mempelajari kernel kemudian terdiri dari mempelajari koefisien pembobotan untuk setiap kernel dasar, daripada mengoptimalkan parameter kernel dari satu kernel. Kelemahan dari beberapa pembelajaran kernel tampaknya adalah mereka kurang dapat ditafsirkan dan …

1
Pembuatan catatan musik acak
Saya sedang mengerjakan proyek kecil, yang masih dalam tahap pengembangan awal sekarang. Apa yang saya coba cari tahu adalah bagaimana cara menghasilkan musik acak, terutama catatan. Dengan googling saya hanya berhasil menemukan generator note tebusan dan banyak musik acak, di mana kata acak tidak ada hubungannya dengan definisi variabel acak …



1
Menggunakan beberapa imputasi untuk bahaya proporsional Cox, lalu validasi dengan paket rms?
Saya telah meneliti paket tikus , dan saya belum menemukan cara untuk menggunakan beberapa imputasi untuk membuat model Cox, kemudian memvalidasi model itu dengan fungsi paket rmsvalidate() . Berikut adalah beberapa contoh kode dari apa yang saya miliki sejauh ini, menggunakan kumpulan data veteran: library(rms) library(survival) library(mice) remove(veteran) data(veteran) veteran$trt=factor(veteran$trt,levels=c(1,2)) …

2
Estimator untuk tingkat kejadian
Saat sedang menjalani kursus statistik untuk mahasiswa kedokteran, saya mengalami masalah terkait dengan angka kejadian. Konteks masalah adalah bab tentang distribusi Poisson. Dalam masalah ini, 2.300 perokok diikuti selama rentang 1 tahun di mana 24 di antaranya mengembangkan kanker paru-paru. Mereka kemudian ingin menghitung tingkat kejadian proses dan melanjutkan sebagai …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.