Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

2
Memprediksi kepercayaan jaringan saraf
Misalkan saya ingin melatih jaringan saraf yang dalam untuk melakukan klasifikasi atau regresi, tetapi saya ingin tahu seberapa yakin prediksi tersebut. Bagaimana saya bisa mencapai ini? Gagasan saya adalah menghitung entropi silang untuk setiap datum pelatihan, berdasarkan kinerja prediksinya dalam meter saraf di atas. Kemudian, saya akan melatih jaringan saraf …

2
Bantuan dalam Maksimalisasi Ekspektasi dari kertas: bagaimana memasukkan distribusi sebelumnya?
Pertanyaannya didasarkan pada makalah berjudul: Rekonstruksi gambar dalam tomografi optik difus menggunakan model transport-difusi radiatif digabungkan Tautan unduhan Penulis menerapkan EM algoritma dengan sparsity regularisasi vektor yang tidak diketahui untuk memperkirakan pixel dari suatu gambar. Model ini diberikan oleh μl1l1l_1μμ\mu y=Aμ+e(1)(1)y=Aμ+ey=A\mu + e \tag{1} Estimasi diberikan dalam Persamaan (8) sebagai …

2
Konvolusi 1D di Jaringan Saraf Tiruan
Saya mengerti bagaimana konvolusi bekerja tetapi saya tidak mengerti bagaimana konvolusi 1D diterapkan pada data 2D. Dalam contoh ini Anda dapat melihat konvolusi 2D dalam data 2D. Tetapi bagaimana jadinya jika konvolusi 1D? Hanya 1D kernel yang meluncur dengan cara yang sama? Dan jika langkahnya adalah 2? Terima kasih!


1
Contoh kehidupan nyata dari Penghasil Angka Acak yang tidak efisien
Kita semua tahu bahwa Penghasil Angka Acak di komputer tidak menghasilkan angka acak yang sebenarnya, melainkan menghasilkan angka pseudo-acak. Juga, beberapa RNG lebih baik dari yang lain, dan beberapa diimplementasikan lebih baik daripada yang lain. Apa saja contoh ketika RNG yang buruk telah digunakan, atau RNG yang buruk diimplementasikan, dan …

1
Pengklasifikasi aljabar, informasi lebih lanjut?
Saya telah membaca pengklasifikasi aljabar: pendekatan umum untuk validasi silang cepat, pelatihan online, dan pelatihan paralel dan kagum dengan kinerja algoritma yang diturunkan. Namun, tampaknya di luar Naif Bayes (dan GBM) tidak ada banyak algoritma yang disesuaikan dengan kerangka kerja. Apakah ada makalah lain yang bekerja pada pengklasifikasi yang berbeda? …


2
Turunkan gradien dari jaringan saraf tunggal lapisan wrt inputnya, apa operator dalam aturan rantai?
Masalahnya adalah: Turunkan gradien sehubungan dengan lapisan input untuk jaringan saraf lapisan tersembunyi tunggal menggunakan sigmoid untuk input -> hidden, softmax untuk hidden -> output, dengan kehilangan entropi silang. Saya dapat melewati sebagian besar derivasi menggunakan aturan rantai tetapi saya tidak yakin tentang bagaimana sebenarnya "rantai" mereka bersama-sama. Tentukan beberapa …

1
Ruang data, ruang variabel, ruang observasi, ruang model (misalnya dalam regresi linier)
Misalkan kita memiliki data matriks , yang merupakan n -by- p , dan label vektor Y , yang merupakan n -by-satu. Di sini, setiap baris matriks adalah pengamatan, dan setiap kolom sesuai dengan dimensi / variabel. (asumsikan n > p )XX\mathbf{X}nnnpppYYYnnnn>pn>pn>p Lalu apa data space, variable space, observation space, model …


2
Mengapa kriteria informasi (tidak disesuaikan
Dalam model deret waktu, seperti ARMA-GARCH, untuk memilih jeda atau urutan model kriteria informasi yang berbeda, seperti AIC, BIC, SIC, dll. Pertanyaan saya sangat sederhana, mengapa kami tidak menggunakan disesuaikan R2R2R^2untuk memilih model yang sesuai? Kita bisa pilih model yang menyebabkan nilai yang lebih tinggi dari adjusted R2R2R^2 . Karena …

1
Interval tumpang tindih acak
Bagaimana saya bisa menemukan ekspresi analitik dalam masalah berikut?D ( n , l , L )D(n,l,L.)D(n,l,L) Saya secara acak menjatuhkan "bar" dengan panjang l ke dalam interval [ 0 , L ] . "Bar" bisa tumpang tindih. Saya ingin mencari panjang total rata-rata D dari interval [ 0 , L …

1
Input Normalisasi untuk neuron ReLU
Menurut "Efficient Backprop" oleh LeCun et al (1998) adalah praktik yang baik untuk menormalkan semua input sehingga mereka berpusat di sekitar 0 dan berada dalam kisaran turunan maksimum kedua. Jadi misalnya kita akan menggunakan [-0,5,0,5] untuk fungsi "Tanh". Ini untuk membantu perkembangan back-propagation ketika Hessian menjadi lebih stabil. Namun, saya …

1
Bagaimana cara memformalkan distribusi probabilitas sebelumnya? Apakah ada aturan praktis yang harus digunakan?
Sementara saya suka berpikir saya memiliki pemahaman yang baik tentang konsep informasi sebelumnya dalam analisis statistik Bayesian dan pengambilan keputusan, saya sering mengalami kesulitan membungkus kepala saya di sekitar penerapannya. Saya telah memikirkan beberapa situasi yang mencontohkan perjuangan saya, dan saya merasa bahwa mereka tidak ditangani dengan benar dalam buku …

4
Interpretasi nilai AIC
Nilai khas AIC yang saya lihat untuk model logistik adalah ribuan, setidaknya ratusan. misalnya pada http://www.r-bloggers.com/how-to-perform-a-logistic-regress-in-r/ AIC adalah 727,39 Meskipun selalu dikatakan bahwa AIC harus digunakan hanya untuk membandingkan model, saya ingin memahami apa arti nilai AIC tertentu. Sesuai rumus, A IC= - 2 log( L ) + 2 KSEBUAHsayaC=-2catatan⁡(L.)+2KAIC= …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.