Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

2
Apakah "oke" untuk memplot garis regresi untuk data peringkat (korelasi Spearman)?
Saya memiliki data yang saya hitung korelasi Spearman dan ingin memvisualisasikannya untuk publikasi. Variabel dependen diberi peringkat, variabel independen tidak. Apa yang ingin saya visualisasikan lebih merupakan tren umum daripada kemiringan aktual, jadi saya memberi peringkat independen dan menerapkan korelasi / regresi Spearman. Tetapi ketika saya merencanakan data saya dan …


4
Buku teks tentang pembelajaran penguatan
Saya mencari buku teks / catatan kuliah dalam pembelajaran penguatan. Saya menyukai "Pengantar Pembelajaran Statistik" , tetapi sayangnya mereka tidak membahas topik ini. Saya tahu bahwa sebuah buku karya Sutton dan Barto adalah referensi standar, dan mungkin NDP juga bagus tetapi mereka bertanggal 1997-98, dan saya berharap untuk menemukan eksposisi …

2
Algoritma pembelajaran mesin untuk data panel
Dalam pertanyaan ini - Apakah ada metode untuk membangun pohon keputusan yang memperhitungkan prediktor terstruktur / hierarkis / multilevel? - mereka menyebutkan metode data panel untuk pohon. Apakah ada metode data panel khusus untuk mendukung Mesin Vector dan Jaringan Saraf Tiruan? Jika demikian, dapatkah Anda mengutip beberapa makalah untuk algoritme …

2
memahami nilai-p dalam regresi linier berganda
Mengenai nilai p dari analisis regresi linier berganda, pengantar dari situs web Minitab ditunjukkan di bawah ini. Nilai p untuk setiap istilah menguji hipotesis nol bahwa koefisiennya sama dengan nol (tidak berpengaruh). Nilai p yang rendah (<0,05) menunjukkan bahwa Anda dapat menolak hipotesis nol. Dengan kata lain, prediktor yang memiliki …

2
Distribusi probabilitas untuk gelombang sinus yang bising
Saya mencari untuk secara analitik menghitung distribusi probabilitas titik pengambilan sampel dari fungsi berosilasi ketika ada beberapa kesalahan pengukuran. Saya sudah menghitung distribusi probabilitas untuk bagian "tanpa suara" (saya akan menempatkan ini di akhir), tetapi saya tidak tahu bagaimana memasukkan "suara". Perkiraan angka Agar lebih jelas, bayangkan ada beberapa fungsi …


5
Norma punggungan & LASSO
Posting ini mengikuti yang ini: Mengapa estimasi ridge menjadi lebih baik daripada OLS dengan menambahkan konstanta pada diagonal? Ini pertanyaan saya: Sejauh yang saya tahu, regularisasi ridge menggunakan -norm (jarak euclidean). Tetapi mengapa kita menggunakan kuadrat dari norma ini? (aplikasi langsung akan menghasilkan dengan akar kuadrat dari jumlah beta kuadrat).ℓ …





1
Perbedaan antara seri dengan drift dan seri dengan tren
Serangkaian dengan drift dapat dimodelkan sebagai mana adalah drift (konstan), dan . yt=c+ϕyt−1+εtyt=c+ϕyt−1+εty_t = c + \phi y_{t-1} + \varepsilon_tcccϕ=1ϕ=1\phi=1 Serangkaian dengan tren dapat dimodelkan sebagai mana adalah drift (konstan), adalah tren waktu deterministik dan .yt=c+δt+ϕyt−1+εtyt=c+δt+ϕyt−1+εty_t = c + \delta t + \phi y_{t-1} + \varepsilon_tcccδtδt\delta tϕ=1ϕ=1\phi=1 Kedua seri tersebut …



Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.