Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data


2
Memprediksi persyaratan memori CPU dan GPU untuk pelatihan DNN
Katakanlah saya memiliki beberapa arsitektur model pembelajaran yang mendalam, serta ukuran mini-batch yang dipilih. Bagaimana saya mendapatkan dari persyaratan memori yang diharapkan untuk melatih model itu? Sebagai contoh, pertimbangkan model (tidak berulang) dengan input dimensi 1000, 4 lapisan tersembunyi yang sepenuhnya terhubung dari dimensi 100, dan lapisan keluaran tambahan dimensi …


1
Bagaimana penduga yang meminimalkan jumlah bias kuadrat dan varians yang sesuai dengan teori keputusan?
Oke - pesan asli saya gagal mendapat respons; jadi, izinkan saya mengajukan pertanyaan yang berbeda. Saya akan mulai dengan menjelaskan pemahaman saya tentang estimasi dari perspektif teori keputusan. Saya tidak memiliki pelatihan formal dan tidak akan mengejutkan saya jika pemikiran saya cacat dalam beberapa cara. Misalkan kita memiliki beberapa fungsi …

4
Mengapa gradient descent diperlukan?
Ketika kita dapat membedakan fungsi biaya dan menemukan parameter dengan menyelesaikan persamaan yang diperoleh melalui diferensiasi parsial sehubungan dengan setiap parameter dan mencari tahu di mana fungsi biaya minimum. Juga saya pikir mungkin untuk menemukan banyak tempat di mana turunannya nol, dengan demikian kita dapat memeriksa semua tempat tersebut dan …



1
Penjelasan intuitif logloss
Dalam beberapa kompetisi yang luar biasa, penilaian didasarkan pada "logloss". Ini berkaitan dengan kesalahan klasifikasi. Inilah jawaban teknis tetapi saya mencari jawaban yang intuitif. Saya sangat menyukai jawaban atas pertanyaan ini tentang jarak Mahalanobis, tetapi PCA tidak logloss. Saya dapat menggunakan nilai yang dikeluarkan oleh perangkat lunak klasifikasi saya, tetapi …




2
Bagaimana membuktikan kerja sama dari urutan perilaku
Situasi: Dua burung (jantan dan betina) melindungi telur mereka di sarang dari pengganggu. Setiap burung dapat menggunakan serangan atau ancaman untuk perlindungan, dan hadir atau tidak ada. Ada pola yang muncul dari data bahwa perilaku mungkin saling melengkapi - serangan laki-laki sementara perempuan menggunakan tampilan ancaman dan sebaliknya. Pertanyaan saya …

3
Bagaimana cara melakukan regresi ridge non-negatif?
Bagaimana cara melakukan regresi ridge non-negatif? Laso non-negatif tersedia di scikit-learn, tetapi untuk ridge, saya tidak dapat menegakkan non-negativitas beta, dan memang, saya mendapatkan koefisien negatif. Adakah yang tahu mengapa ini terjadi? Juga, dapatkah saya menerapkan punggungan dalam hal kuadrat terkecil reguler? Pindah ini ke pertanyaan lain: Dapatkah saya menerapkan …

2
Penjelasan gamblang untuk “stabilitas numerik inversi matriks” dalam regresi ridge dan perannya dalam mengurangi overfit
Saya mengerti bahwa kita dapat menggunakan regularisasi dalam masalah regresi kuadrat terkecil sebagai w∗= argminw[ ( Y - X w )T( y - X w ) + λ ∥ w ∥2]w∗=argminw⁡[(y−Xw)T(y−Xw)+λ‖w‖2]\boldsymbol{w}^* = \operatorname*{argmin}_w \left[ (\mathbf y-\mathbf{Xw})^T(\boldsymbol{y}-\mathbf{Xw}) + \lambda\|\boldsymbol{w}\|^2 \right] dan bahwa masalah ini memiliki solusi bentuk tertutup seperti: w^= ( …

1
Apakah ada aplikasi di mana SVM masih unggul?
Algoritma SVM cukup tua - dikembangkan tahun 1960-an, tetapi sangat populer pada 1990-an dan 2000-an. Ini adalah bagian klasik (dan sangat indah) dari kursus pembelajaran mesin. Saat ini tampaknya dalam pemrosesan media (gambar, suara, dll.) Jaringan saraf benar-benar mendominasi, sementara di daerah lain Gradient Boosting memiliki posisi yang sangat kuat. …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.