Ilmu Data

T&J untuk profesional sains Data, spesialis Pembelajaran Mesin, dan mereka yang tertarik untuk belajar lebih banyak tentang bidang ini

4
Mengapa menambahkan dropout layer meningkatkan kinerja pembelajaran mesin / dalam, mengingat bahwa dropout menekan beberapa neuron dari model?
Jika menghapus beberapa neuron menghasilkan model yang berkinerja lebih baik, mengapa tidak menggunakan jaringan saraf yang lebih sederhana dengan lebih sedikit lapisan dan lebih sedikit neuron di tempat pertama? Mengapa membangun model yang lebih besar dan lebih rumit pada awalnya dan menekan bagian-bagiannya nanti?

3
Apa itu embedding grafik?
Saya baru-baru ini menemukan grafik embedding seperti DeepWalk dan LINE. Namun, saya masih belum memiliki ide yang jelas seperti apa yang dimaksud dengan embeddings grafik dan kapan menggunakannya (aplikasi)? Ada saran dipersilahkan!
13 graphs 




1
Bagaimana seharusnya bias diinisialisasi dan diatur?
Saya telah membaca beberapa makalah tentang inisialisasi kernel dan banyak makalah yang menyebutkan bahwa mereka menggunakan L2 regularisasi kernel (seringkali dengan ).λ=0.0001λ=0.0001\lambda = 0.0001 Adakah yang melakukan sesuatu yang berbeda dari menginisialisasi bias dengan nol konstan dan tidak mengaturnya? Makalah inisialisasi kernel Mishkin dan Matas: Yang Anda butuhkan adalah init …


1
Apa itu Layer Konvolusional 1D dalam Pembelajaran Jauh?
Saya memiliki pemahaman umum yang baik tentang peran dan mekanisme lapisan konvolusional dalam Pembelajaran Jauh untuk pemrosesan gambar dalam kasus implementasi 2D atau 3D - mereka "hanya" mencoba menangkap pola 2D dalam gambar (dalam 3 saluran dalam kasus 3D). Tetapi baru-baru ini saya bertemu lapisan konvolusional 1D dalam konteks Natural …

1
Lupakan Lapisan dalam Jaringan Syaraf Berulang (RNN) -
Saya mencoba mencari tahu dimensi masing-masing variabel dalam RNN di lapisan lupa, namun, saya tidak yakin apakah saya berada di jalur yang benar. Gambar dan persamaan selanjutnya adalah dari posting blog Colah "Memahami Jaringan LSTM" : dimana: m ∗ 1xtxtx_t adalah input ukuran vektorm∗1m∗1m*1 n ∗ 1ht−1ht−1h_{t-1} adalah status tersembunyi …

3
Mengapa berbelit-belit jika Max Pooling hanya akan menurunkan gambar?
Gagasan menerapkan filter untuk melakukan sesuatu seperti mengidentifikasi tepi, adalah ide yang cukup keren. Misalnya, Anda dapat mengambil gambar 7. Dengan beberapa filter, Anda dapat berakhir dengan gambar yang diubah yang menekankan berbagai karakteristik gambar asli. 7 yang asli: dapat dialami oleh jaringan sebagai: Perhatikan bagaimana setiap gambar telah mengekstraksi …




2
Scaling Data Scaling yang Etis dan Hemat Biaya
Beberapa hal dalam hidup memberi saya kesenangan seperti menggores data terstruktur dan tidak terstruktur dari Internet dan memanfaatkannya dalam model saya. Sebagai contoh, Data Science Toolkit (atau RDSTKuntuk programmer R) memungkinkan saya untuk menarik banyak data berbasis lokasi yang baik menggunakan IP atau alamat dan paket tm.webmining.pluginuntuk R tmmembuat goresan …

3
Cara terbaik untuk mengklasifikasikan dataset dengan tipe atribut campuran
Saya ingin tahu apa cara terbaik untuk mengklasifikasikan kumpulan data yang terdiri dari berbagai jenis atribut, misalnya, tekstual dan numerik. Saya tahu saya bisa mengonversi teks menjadi boolean, tetapi perbendaharaan katanya beragam dan datanya terlalu jarang. Saya juga mencoba untuk mengklasifikasikan jenis atribut secara terpisah dan menggabungkan hasilnya melalui teknik …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.