Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data




1
Entri Silang atau Kemungkinan Log di lapisan Output
Saya membaca halaman ini: http://neuralnetworksanddeeplearning.com/chap3.html dan dikatakan bahwa lapisan keluaran sigmoid dengan cross-entropy cukup mirip dengan lapisan keluaran softmax dengan kemungkinan log. apa yang terjadi jika saya menggunakan sigmoid dengan log-likelihood atau softmax dengan cross entropy pada layer output? itu baik? karena saya melihat hanya ada sedikit perbedaan dalam persamaan …


3
Apa perbedaan antara distribusi prediktif posterior dan posterior?
Saya mengerti apa itu Posterior, tapi saya tidak yakin apa artinya yang terakhir? Bagaimana 2 yang berbeda? Kevin P Murphy ditunjukkan dalam buku pelajarannya, Machine Learning: a Probabilistic Perspective , bahwa itu adalah "keadaan kepercayaan internal". Apa maksudnya itu? Saya mendapat kesan bahwa Prior merupakan kepercayaan atau bias internal Anda, …




3
Utilitas rekayasa-fitur: Mengapa membuat fitur baru berdasarkan fitur yang ada?
Saya sering melihat orang membuat fitur baru berdasarkan fitur yang ada pada masalah pembelajaran mesin. Misalnya, di sini: https://triangleinequality.wordpress.com/2013/09/08/basic-feature-engineering-with-the-titanic-data/ orang telah menganggap ukuran keluarga seseorang sebagai fitur baru, berdasarkan pada jumlah saudara, saudari, dan orang tua, yang merupakan fitur yang ada. Tapi apa gunanya ini? Saya tidak mengerti mengapa pembuatan …


6
Mengapa nilai yang diharapkan dinamai demikian?
Saya mengerti bagaimana kita mendapatkan 3,5 sebagai nilai yang diharapkan untuk menggulung dadu 6 sisi yang adil. Namun secara intuitif, saya dapat mengharapkan setiap wajah dengan peluang yang sama 1/6. Jadi bukankah seharusnya nilai yang diharapkan dari menggulung dadu menjadi salah satu dari angka antara 1-6 dengan probabilitas yang sama? …



3
Apa akar penyebab masalah ketidakseimbangan kelas?
Saya telah banyak berpikir tentang "masalah ketidakseimbangan kelas" dalam pembelajaran mesin / statistik akhir-akhir ini, dan saya semakin dalam merasakan bahwa saya tidak mengerti apa yang sedang terjadi. Pertama, biarkan saya mendefinisikan (atau mencoba) mendefinisikan istilah saya: Masalah ketidakseimbangan kelas dalam pembelajaran mesin / statistik adalah pengamatan bahwa beberapa algoritma …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.