Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data


2
Mengapa RNNs dengan unit LSTM juga menderita "meledak gradien"?
Saya memiliki pengetahuan dasar tentang bagaimana RNN (dan, khususnya, dengan unit LSTM) bekerja. Saya punya ide gambar arsitektur unit LSTM, yaitu sel dan beberapa gerbang, yang mengatur aliran nilai. Namun, tampaknya, saya belum sepenuhnya memahami bagaimana LSTM memecahkan masalah "gradien menghilang dan meledak", yang terjadi saat pelatihan, menggunakan back-propagation melalui …

1
Format input untuk respons dalam binomial glm di R
Di R, ada tiga metode untuk memformat data input untuk regresi logistik menggunakan glmfungsi: Data dapat dalam format "biner" untuk setiap pengamatan (misalnya, y = 0 atau 1 untuk setiap pengamatan); Data dapat dalam format "Wilkinson-Rogers" (misalnya, y = cbind(success, failure)) dengan setiap baris mewakili satu perlakuan; atau Data dapat …


3
Memahami MCMC: apa alternatifnya?
Mempelajari statistik Bayesian untuk pertama kalinya; sebagai sudut pandang untuk memahami MCMC saya bertanya-tanya: apakah ia melakukan sesuatu yang pada dasarnya tidak dapat dilakukan dengan cara lain, atau hanya melakukan sesuatu yang jauh lebih efisien daripada alternatifnya? Sebagai ilustrasi, misalkan kita mencoba menghitung probabilitas parameter kita mengingat data diberi model …
13 bayesian  mcmc 

2
Bagaimana metode .similaritas dalam SpaCy dihitung?
Tidak yakin apakah ini situs tumpukan yang tepat, tetapi begini saja. Bagaimana cara kerja metode .similiarity? Wah spanya bagus! Model tfidf-nya bisa lebih mudah, tetapi w2v dengan hanya satu baris kode ?! Dalam 10 baris tutorialnya di spaCy andrazhribernik, tunjukkan pada kami metode .similaritas yang dapat dijalankan pada token, sents, …

4
Jika setiap neuron dalam jaringan saraf pada dasarnya adalah fungsi regresi logistik, mengapa multi layer lebih baik?
Saya akan mengikuti kursus DeepAI Cousera (video Week3 1 "Ikhtisar Jaringan Saraf") dan Andrew Ng menjelaskan bagaimana setiap lapisan dalam jaringan saraf hanyalah regresi logistik yang lain, tetapi dia tidak menjelaskan bagaimana hal itu membuat segalanya menjadi lebih akurat. Jadi dalam jaringan 2 layer, bagaimana cara menghitung logistik berkali-kali membuatnya …

1
Mengapa classifier naif bayes optimal untuk kerugian 0-1?
Klasifikasi Naive Bayes adalah pengklasifikasi yang menetapkan item ke kelas berdasarkan pada memaksimalkan posterior untuk keanggotaan kelas, dan mengasumsikan bahwa fitur dari item tersebut independen.xxxCCCP(C|x)P(C|x)P(C|x) Kehilangan 0-1 adalah kerugian yang menyebabkan hilangnya klasifikasi "miss", dan hilangnya "0" untuk klasifikasi yang benar. Saya sering membaca (1) bahwa "Naive Bayes" Classifier, optimal …

1
Mengapa algoritma keturunan “Saddle-Free Newton” tidak digunakan dalam praktik?
Baru-baru ini saya telah membaca makalah oleh Yann Dauphin et al. Mengidentifikasi dan menyerang masalah saddle point dalam optimasi non-cembung dimensi tinggi , di mana mereka memperkenalkan algoritma keturunan yang menarik yang disebut Saddle-Free Newton , yang tampaknya dirancang khusus untuk optimalisasi jaringan saraf dan tidak boleh menderita macet di …

1
Apakah Just-Identified 2SLS Median-Unlimited?
Dalam Mostly Harmless Econometrics: Seorang Pendamping Empiris (Angrist dan Pischke, 2009: halaman 209) Saya membaca yang berikut ini: (...) Faktanya, 2SLS yang baru diidentifikasi (katakanlah, estimator Wald sederhana) kira-kira tidak bias . Ini sulit untuk ditunjukkan secara formal karena 2SLS yang diidentifikasi hanya tidak memiliki momen (yaitu, distribusi sampel memiliki …


1
Apakah estimasi MLE normal dan efisien asimtotik walaupun modelnya tidak benar?
Premis: ini mungkin pertanyaan bodoh. Saya hanya tahu pernyataan tentang sifat asimptotik MLE, tetapi saya tidak pernah mempelajari buktinya. Jika saya melakukannya, mungkin saya tidak akan menanyakan pertanyaan-pertanyaan ini, atau saya mungkin saya akan menyadari pertanyaan-pertanyaan ini tidak masuk akal ... jadi tolong mudahkan saya :) Saya sering melihat pernyataan …



1
Bagaimana cara membandingkan model berdasarkan AIC?
Kami memiliki dua model yang menggunakan metode yang sama untuk menghitung kemungkinan log dan AIC untuk satu lebih rendah dari yang lain. Namun, yang dengan AIC lebih rendah jauh lebih sulit untuk ditafsirkan. Kami mengalami masalah dalam memutuskan apakah layak untuk memperkenalkan kesulitan dan kami menilai ini menggunakan perbedaan persentase …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.