Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data




5
Jaringan saraf modern yang membangun topologi mereka sendiri
Keterbatasan dari algoritma neural net standar (seperti backprop) adalah Anda harus membuat keputusan desain tentang berapa banyak layer tersembunyi dan neuron per layer yang Anda inginkan. Biasanya, tingkat pembelajaran dan generalisasi sangat sensitif terhadap pilihan-pilihan ini. Ini telah menjadi alasan, mengapa algoritma neural net seperti korelasi kaskade telah menghasilkan minat. …


6
Contoh masalah model Markov tersembunyi?
Saya membaca sedikit model Markov yang tersembunyi dan dapat mengkodekan versi yang cukup mendasar sendiri. Tetapi ada dua cara utama yang tampaknya saya pelajari. Salah satunya adalah membaca dan mengimplementasikannya ke dalam kode (yang dilakukan) dan yang kedua adalah memahami bagaimana itu berlaku dalam situasi yang berbeda (jadi saya bisa …

3
Perbedaan Regresi vs ANOVA (aov vs lm dalam R)
Saya selalu mendapat kesan bahwa regresi hanyalah bentuk yang lebih umum dari ANOVA dan hasilnya akan sama. Namun baru-baru ini, saya telah menjalankan regresi dan ANOVA pada data yang sama dan hasilnya berbeda secara signifikan. Artinya, dalam model regresi kedua efek utama dan interaksi adalah signifikan, sedangkan di ANOVA satu …
21 r  regression  anova 

3
Bagaimana saya bisa menghitung margin kesalahan dalam hasil NPS (Net Promoter Score)?
Saya akan membiarkan Wikipedia menjelaskan bagaimana NPS dihitung: Skor Net Promoter diperoleh dengan mengajukan satu pertanyaan kepada pelanggan pada skala peringkat 0 hingga 10, di mana 10 adalah "sangat mungkin" dan 0 adalah "sama sekali tidak mungkin": "Seberapa mungkin Anda merekomendasikan perusahaan kami kepada suatu teman atau kolega? " Berdasarkan …

3
Mengapa kita harus peduli tentang pencampuran cepat dalam rantai MCMC?
Ketika bekerja dengan rantai Markov, Monte Carlo untuk menarik kesimpulan, kita membutuhkan rantai yang bercampur dengan cepat, yaitu bergerak melalui dukungan distribusi posterior dengan cepat. Tetapi saya tidak mengerti mengapa kita membutuhkan properti ini, karena dari apa yang saya pahami, gambar yang diterima menarik harus dan akan terkonsentrasi di bagian …
21 mcmc 

1
Perhitungan invers matriks yang efisien dalam R
Saya perlu menghitung invers matriks dan telah menggunakan solvefungsi. Meskipun bekerja dengan baik pada matriks kecil, solvecenderung sangat lambat pada matriks besar. Saya bertanya-tanya apakah ada fungsi lain atau kombinasi fungsi (melalui SVD, QR, LU, atau fungsi dekomposisi lainnya) yang dapat memberi saya hasil lebih cepat.


4
Apa artinya "ketidakberpihakan"?
Apa artinya mengatakan bahwa "varians adalah penduga yang bias". Apa artinya mengubah estimasi bias menjadi estimasi tidak bias melalui formula sederhana. Apa tepatnya yang dilakukan konversi ini? Juga, Apa manfaat praktis dari konversi ini? Apakah Anda mengonversi skor ini saat menggunakan statistik tertentu?

4
Apa kutukan dimensi?
Secara khusus, saya sedang mencari referensi (makalah, buku) yang akan menunjukkan dan menjelaskan kutukan dimensi. Pertanyaan ini muncul setelah saya mulai membaca buku putih ini oleh Lafferty dan Wasserman. Dalam paragraf ketiga mereka menyebutkan persamaan "terkenal" yang menyiratkan bahwa tingkat konvergensi terbaik adalah ; kalau ada yang bisa menjelaskan itu …
21 theory 

1
Regresi logistik untuk deret waktu
Saya ingin menggunakan model regresi logistik biner dalam konteks streaming data (seri waktu multidimensi) untuk memprediksi nilai variabel dependen dari data (yaitu baris) yang baru saja tiba, mengingat pengamatan sebelumnya. Sejauh yang saya tahu, regresi logistik secara tradisional digunakan untuk analisis postmortem, di mana setiap variabel dependen telah ditetapkan (baik …

5
Contoh koefisien korelasi kuat dengan nilai p tinggi
Saya bertanya-tanya, mungkinkah memiliki koefisien korelasi yang sangat kuat (katakanlah 0,9 atau lebih tinggi), dengan nilai p tinggi (katakanlah, 25 atau lebih tinggi)? Berikut ini contoh koefisien korelasi yang rendah, dengan nilai p tinggi: set.seed(10) y <- rnorm(100) x <- rnorm(100)+.1*y cor.test(x,y) cor = 0,03908927, p = 0,6994 Koefisien korelasi …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.