Ilmu Data

T&J untuk profesional sains Data, spesialis Pembelajaran Mesin, dan mereka yang tertarik untuk belajar lebih banyak tentang bidang ini

2
Mengapa tidak overfitting jaringan saraf yang merusak untuk klasifikasi MNIST?
Saya memiliki jaringan saraf sederhana (NN) untuk klasifikasi MNIST. Ini termasuk 2 lapisan tersembunyi, masing-masing dengan 500 neuron. Oleh karena itu dimensi NN adalah: 784-500-500-10. ReLU digunakan di semua neuron, softmax digunakan pada output, dan cross-entropy adalah fungsi loss. Apa yang membingungkan saya adalah mengapa overfitting tampaknya tidak menghancurkan NN? …


1
Naive Bayes untuk klasifikasi teks Multi-label
Cara menggunakan Naive Bayes untuk klasifikasi teks multi-label dalam R. Saya mencoba menggunakan naiveBayes () dari perpustakaan e1071 tetapi tampaknya saat pelatihan, ia tidak menerima variabel kelas multi-label. Saya membuat TermDocumentMatrix menggunakan corpus dokumen teks dan mencoba membuat model menggunakan matriks ini dan variabel kelas (daftar topik milik dokumen tertentu). …

1
XGBoost untuk klasifikasi biner: memilih ambang batas yang tepat
Saya sedang mengerjakan dataset berlabel biner yang sangat tidak seimbang, di mana jumlah label yang benar hanya 7% dari keseluruhan dataset. Tetapi beberapa kombinasi fitur dapat menghasilkan jumlah yang lebih tinggi dari yang di himpunan bagian. Misalnya kita memiliki dataset berikut dengan satu fitur (warna): 180 sampel merah - 0 …

2
Penghasilan Informasi dalam R
Saya menemukan paket yang digunakan untuk menghitung "Information Gain" untuk memilih atribut utama di C4.5 Decision Tree dan saya mencoba menggunakannya untuk menghitung "Information Gain". Tetapi hasil perhitungan masing-masing paket berbeda seperti kode di bawah ini. > IG.CORElearn <- attrEval(In_Occu ~ In_Temp+In_Humi+In_CO2+In_Illu+In_LP+Out_Temp+Out_Humi, dataUSE1, estimator = "InfGain") > IG.RWeka <- InfoGainAttributeEval(In_Occu …

4
Apakah konvolusi “meratakan gambar”?
Saya mencari penjelasan yang bagus tentang bagaimana konvolusi dalam pembelajaran mendalam bekerja ketika diterapkan pada gambar multi-channel. Sebagai contoh, katakanlah saya memiliki gambar 100 x 100 piksel dengan tiga saluran, RGB. Input tensor kemudian memiliki dimensi 100 x 100 x 3. Jika saya menerapkan konvolusi dengan N filter dan satu …

3
Pengetahuan apa yang saya butuhkan untuk menulis program AI sederhana untuk bermain game?
Saya lulusan B.Sc. Salah satu kursus saya adalah 'Pengantar Pembelajaran Mesin', dan saya selalu ingin melakukan proyek pribadi dalam subjek ini. Baru-baru ini saya mendengar tentang pelatihan AI yang berbeda untuk bermain game seperti Mario, Go, dll. Pengetahuan apa yang perlu saya peroleh untuk melatih program AI sederhana untuk bermain …

1
Pembelajaran Mesin: Menulis Puisi
Saya seorang siswa pembelajaran mesin, dan hari ini saya mencoba belajar bagaimana menggunakan perpustakaan TensorFlow. Saya telah melalui berbagai tutorial dan percobaan & kesalahan dengan tensorflow, dan saya pikir cara terbaik untuk mempelajarinya secara nyata adalah dengan menggunakannya dalam proyek kecil saya sendiri. Saya telah memutuskan bahwa saya harus berusaha …


1
Pertanyaan Ketika Memajukan dari Jaringan Saraf Tiruan Vanilla ke Jaringan Saraf Berulang
Baru-baru ini saya belajar bagaimana jaringan saraf vanilla akan bekerja, dengan jumlah input yang diberikan, node tersembunyi, dan jumlah output yang sama dengan input. Saya telah melihat berbagai posting yang sekarang berhubungan dengan jaringan saraf berulang, dan saya memahami konsep di baliknya, tetapi saya gagal untuk memahami bagian-bagian tertentu dari …

4
Kelas tidak seimbang: class_weight untuk algoritma ML di Spark MLLib
Di python sklearn, ada beberapa algoritma (misalnya regresi, hutan acak ... dll.) Yang memiliki parameter class_weight untuk menangani data yang tidak seimbang. Namun, saya tidak menemukan parameter seperti itu untuk algoritma MLLib. Apakah ada rencana penerapan class_weight untuk beberapa algoritma MLLib? Atau apakah ada pendekatan dalam MLLib untuk data yang …

1
Mengapa pelatihan RNN tidak menggunakan 100% GPU?
Saya bertanya-tanya mengapa pelatihan RNN biasanya tidak menggunakan 100% GPU. Misalnya, jika saya menjalankan benchmark RNN ini pada Maxwell Titan X di Ubuntu 14.04.4 LTS x64, utilisasi GPU di bawah 90%: Tolok ukur diluncurkan menggunakan perintah: python rnn.py -n 'fastlstm' -l 1024 -s 30 -b 128 Bagaimana saya bisa mendiagnosis …

2
Dapatkah overfitting terjadi dalam algoritma Pengoptimalan Lanjutan?
saat mengambil kursus online tentang pembelajaran mesin oleh Andrew Ng tentang coursera, saya menemukan topik yang disebut overfitting . Saya tahu ini dapat terjadi ketika gradient descent digunakan dalam regresi linier atau logistik tetapi dapatkah hal ini terjadi ketika algoritma Optimasi Lanjutan seperti "Conjugate gradient", "BFGS", dan "L-BFGS" digunakan?

3
Bagaimana mengevaluasi pengelompokan teks?
Metrik apa yang dapat digunakan untuk mengevaluasi model pengelompokan teks? Saya menggunakan tf-idf+ k-means, tf-idf+ hierarchical clustering, doc2vec+ k-means (metric is cosine similarity), doc2vec+ hierarchical clustering (metric is cosine similarity). Bagaimana menentukan model mana yang terbaik?

2
Menghitung indeks dalam panda
Saya merasa ini adalah pertanyaan yang belum sempurna tetapi saya sangat baru dalam hal ini dan belum bisa memecahkannya / temukan jawabannya. Pada akhirnya apa yang saya coba lakukan di sini adalah untuk menghitung nilai unik pada kolom tertentu dan kemudian menentukan nilai unik mana yang memiliki lebih dari satu …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.