Ilmu Data

T&J untuk profesional sains Data, spesialis Pembelajaran Mesin, dan mereka yang tertarik untuk belajar lebih banyak tentang bidang ini

2
Mengapa laju pembelajaran menyebabkan bobot jaringan saraf saya meroket?
Saya menggunakan tensorflow untuk menulis jaringan saraf sederhana untuk sedikit riset dan saya punya banyak masalah dengan bobot 'nan' saat pelatihan. Saya mencoba banyak solusi berbeda seperti mengubah pengoptimal, mengubah kehilangan, ukuran data, dll. Tetapi tanpa hasil. Akhirnya, saya perhatikan bahwa perubahan dalam tingkat pembelajaran membuat perbedaan yang luar biasa …

2
Fitur vektor kata di word2vec
Saya mencoba melakukan analisis sentimen. Untuk mengkonversi kata ke vektor kata saya menggunakan model word2vec. Misalkan saya memiliki semua kalimat dalam daftar bernama 'kalimat' dan saya meneruskan kalimat ini ke word2vec sebagai berikut: model = word2vec.Word2Vec(sentences, workers=4 , min_count=40, size=300, window=5, sample=1e-3) Karena saya noob untuk kata vektor saya punya …


1
kepentingan fitur melalui hutan acak dan regresi linier berbeda
Diterapkan Lasso untuk memeringkat fitur dan mendapatkan hasil berikut: rank feature prob. ================================== 1 a 0.1825477951589229 2 b 0.07858498115577893 3 c 0.07041793111843796 Perhatikan bahwa kumpulan data memiliki 3 label. Peringkat fitur untuk label yang berbeda sama. Kemudian menerapkan hutan acak ke kumpulan data yang sama: rank feature score =================================== 1 …

3
Algoritma pembelajaran mesin manakah yang diterima sebagai pertukaran yang baik antara kemampuan menjelaskan dan prediksi?
Teks pembelajaran mesin yang menggambarkan algoritma seperti mesin peningkat gradien atau jaringan saraf sering berkomentar bahwa model-model ini bagus dalam prediksi, tetapi ini harus dibayar dengan hilangnya penjelasan atau interpretabilitas. Sebaliknya, pohon keputusan tunggal dan model regresi klasik diberi label baik dalam penjelasan, tetapi memberikan akurasi prediksi (relatif) buruk dibandingkan …

3
Memilih metode regularisasi dalam jaringan saraf
Saat melatih jaringan saraf, setidaknya ada 4 cara untuk mengatur jaringan: Regulasi L1 Regulasi L2 Keluar Normalisasi Batch ditambah tentu saja hal-hal lain seperti pembagian berat badan dan mengurangi jumlah koneksi, yang mungkin bukan pengaturan dalam arti yang paling ketat. Tetapi bagaimana orang akan memilih metode regularisasi mana yang akan …

3
Mesin rekomendasi apa untuk situasi di mana pengguna hanya dapat melihat sebagian kecil dari semua item?
Saya ingin menambahkan fitur rekomendasi ke sistem manajemen dokumen . Ini adalah server tempat sebagian besar dokumen perusahaan disimpan. Karyawan menelusuri antarmuka web dan klik untuk mengunduh (atau membaca online) dokumen yang mereka inginkan. Setiap karyawan hanya memiliki akses ke subset dari semua dokumen: Tujuan saya : Rekomendasikan kepada karyawan …

2
Kumpulan data patokan untuk pemfilteran kolaboratif
Saya ingin menguji algoritma baru untuk pemfilteran kolaboratif . Kasus penggunaan yang umum adalah merekomendasikan film berdasarkan preferensi pengguna yang mirip dengan pengguna tertentu. Apa beberapa dataset patokan umum yang sering digunakan peneliti untuk menguji algoritme mereka? Saya tahu bahwa di dalam Computer Vision orang sering menggunakan MNIST atau CIFAR, …

3
Ekspor bobot (formula) dari Regulator Hutan Acak di Scikit-Learn
Saya melatih model prediksi dengan Scikit Learn in Python (Random Forest Regressor) dan saya ingin mengekstraksi bobot setiap fitur untuk membuat alat excel untuk prediksi manual. Satu-satunya hal yang saya temukan adalah model.feature_importances_tetapi tidak membantu. Apakah ada cara untuk mencapainya? def performRandomForest(X_train, y_train, X_test, y_test): '''Perform Random Forest Regression''' from …

1
Apa hubungan antara SVM dan kehilangan engsel?
Kolega saya dan saya mencoba untuk membungkus kepala kami di sekitar perbedaan antara regresi logistik dan SVM. Jelas mereka mengoptimalkan fungsi tujuan yang berbeda. Apakah SVM sesederhana mengatakan itu adalah klasifikasi diskriminatif yang hanya mengoptimalkan kehilangan engsel? Atau lebih kompleks dari itu? Bagaimana vektor pendukung berperan? Bagaimana dengan variabel slack? …


2
Apakah ada studi yang meneliti dropout vs regularisasi lainnya?
Apakah ada makalah yang diterbitkan yang menunjukkan perbedaan metode regularisasi untuk jaringan saraf, lebih disukai pada domain yang berbeda (atau setidaknya set data yang berbeda)? Saya bertanya karena saat ini saya merasa bahwa kebanyakan orang tampaknya hanya menggunakan dropout untuk regularisasi dalam visi komputer. Saya ingin memeriksa apakah akan ada …

3
Tutorial Analisis Sentimen
Saya mencoba memahami analisis sentimen dan cara menerapkannya menggunakan bahasa apa pun (R, Python, dll). Saya ingin tahu apakah ada tempat yang bagus di internet untuk tutorial yang dapat saya ikuti. Saya mencari di Google, tetapi saya tidak terlalu puas karena itu bukan tutorial tetapi lebih dari teori. Saya ingin …


2
Klasifikasi urutan vektor
Dataset saya terdiri dari sekuens vektor. Setiap vektor memiliki 50 dimensi bernilai nyata. Jumlah vektor dalam rentang urutan 3-5 hingga 10-15. Dengan kata lain, panjang urutan tidak tetap. Sejumlah urutan yang adil (bukan vektor!) Dijelaskan dengan label kelas. Tugas saya adalah mempelajari classifier yang diberi urutan vektor, label kelas untuk …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.