Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data



2
Bagaimana melakukan model linear umum dengan beberapa variabel dependen dalam R?
Saya memiliki enam variabel dependen (jumlah data) dan beberapa variabel independen, saya melihat bahwa dalam MMR skripnya seperti ini: my.model <- lm(cbind(DV1,DV2,DV3,DV4,DV5,DV6) ~ IV1 + IV2 + ... + IVn) Tapi, karena data saya dihitung, saya ingin menggunakan model linier umum dan saya mencoba ini: my.model <- glm(cbind(DV1,DV2,DV3,DV4,DV5,DV6) ~ IV1 …


3
Membandingkan dua hasil akurasi classifier untuk signifikansi statistik dengan uji-t
Saya ingin membandingkan keakuratan dua pengklasifikasi untuk signifikansi statistik. Kedua pengklasifikasi dijalankan pada set data yang sama. Ini membuat saya percaya bahwa saya harus menggunakan uji-t satu sampel dari apa yang telah saya baca . Sebagai contoh: Classifier 1: 51% accuracy Classifier 2: 64% accuracy Dataset size: 78,000 Apakah ini …


4
Istilah kesalahan model rata-rata bergerak
Ini adalah pertanyaan mendasar pada model Box-Jenkins MA. Seperti yang saya pahami, model MA pada dasarnya adalah regresi linier dari nilai time-series YYY terhadap istilah kesalahan sebelumnya . Yaitu, pengamatan pertama mundur terhadap nilai sebelumnya dan kemudian satu atau lebih nilai digunakan sebagai istilah kesalahan untuk MA model. Y Y …


4
Mengkonfirmasi distribusi residu dalam regresi linier
Misalkan kita menjalankan regresi linier sederhana y=β0+β1x+uy=β0+β1x+uy=\beta_0+\beta_1x+u , menyelamatkan residu ui^ui^\hat{u_i} dan menggambar histogram distribusi residu. Jika kita mendapatkan sesuatu yang terlihat seperti distribusi yang akrab, dapatkah kita berasumsi bahwa istilah kesalahan kita memiliki distribusi ini? Katakanlah, jika kami menemukan bahwa residu menyerupai distribusi normal, apakah masuk akal untuk menganggap …

1
Interval kepercayaan berbasis bootstrap
Saat mempelajari interval kepercayaan berbasis bootstrap, saya pernah membaca pernyataan berikut: Jika distribusi bootstrap miring ke kanan, interval kepercayaan berbasis bootstrap memasukkan koreksi untuk memindahkan titik akhir lebih jauh ke kanan; ini mungkin tampak berlawanan dengan intuisi, tetapi itu adalah tindakan yang benar. Saya mencoba memahami logika yang mendasari pernyataan …

2
Mengapa classifier regresi ridge berfungsi cukup baik untuk klasifikasi teks?
Selama percobaan untuk klasifikasi teks, saya menemukan classifier ridge menghasilkan hasil yang secara konstan berada di atas tes di antara classifier yang lebih umum disebutkan dan diterapkan untuk tugas-tugas penambangan teks, seperti SVM, NB, kNN, dll. Meskipun, saya belum menguraikan tentang cara mengoptimalkan setiap classifier pada tugas klasifikasi teks khusus …


3
Nilai maksimum koefisien variasi untuk kumpulan data terbatas
Dalam diskusi mengikuti pertanyaan terbaru tentang apakah standar deviasi dapat melebihi rata-rata, satu pertanyaan diajukan secara singkat tetapi tidak pernah dijawab sepenuhnya. Jadi saya bertanya di sini. Pertimbangkan satu set nnn angka negatif xixix_i mana 0≤xi≤c0≤xi≤c0 \leq x_i \leq c untuk 1≤i≤n1≤i≤n1 \leq i \leq n . Tidak diperlukan berbeda, …


3
Koefisien tergantung waktu dalam R - bagaimana cara melakukannya?
Pembaruan : Maaf untuk pembaruan lain tetapi saya telah menemukan beberapa solusi yang mungkin dengan polinomial fraksional dan paket risiko yang bersaing yang saya perlukan bantuan. Masalah Saya tidak dapat menemukan cara mudah untuk melakukan analisis koefisien dependen waktu dalam R. Saya ingin dapat mengambil koefisien variabel saya dan melakukannya …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.