Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data


1
Softmax overflow [ditutup]
Tutup. Pertanyaan ini di luar topik . Saat ini tidak menerima jawaban. Ingin meningkatkan pertanyaan ini? Perbarui pertanyaan sehingga sesuai topik untuk Cross Validated. Ditutup 2 tahun yang lalu . Menunggu kursus selanjutnya Andrew Ng di Coursera, saya mencoba memprogram classifier Python dengan fungsi softmax pada layer terakhir untuk memiliki …
11 softmax  numerics 


4
Apakah multikolinearitas benar-benar masalah?
Saya sedang mengerjakan beberapa proyek pemodelan prediktif dewasa ini: mencoba mempelajari suatu model dan membuat prediksi waktu nyata berdasarkan pada model yang saya pelajari secara offline. Saya mulai menggunakan regresi ridge baru-baru ini, karena saya membaca bahwa regularisasi dapat membantu mengurangi efek multikolinieritas. Namun, saya membaca blog ini hari ini. …

2
Performa yang lebih baik menggunakan Random Forest one-Vs-All daripada Random Forest multiclass?
Saya sedang mengerjakan masalah multiclass dengan 9 kemungkinan label, yang mana saya memiliki dataset yang terdiri dari ~ 50.000 contoh dan ~ 200 fitur masing-masing. Setiap contoh hanya dapat dimiliki oleh satu kelas. Data cukup seimbang di antara label yang berbeda. Mengingat kekokohan dan skalabilitasnya, saya memutuskan untuk menggunakan Random …


2
Bagaimana tepatnya menghitung Fungsi Kehilangan Q-Learning Jauh?
Saya ragu tentang bagaimana tepatnya fungsi kerugian dari Deep Q-Learning Network dilatih. Saya menggunakan jaringan feedforward 2 layer dengan lapisan output linear dan lapisan tersembunyi relu. Anggaplah saya memiliki 4 tindakan yang memungkinkan. Dengan demikian, output dari jaringan saya untuk keadaan saat ini adalah . Untuk membuatnya lebih konkret, mari …

4
Fungsi kemungkinan maksimum untuk distribusi tipe campuran
Secara umum kami memaksimalkan suatu fungsi L(θ;x1,…,xn)=∏i=1nf(xi∣θ)L(θ;x1,…,xn)=∏i=1nf(xi∣θ) L(\theta; x_1, \ldots, x_n) = \prod_{i=1}^n f(x_i \mid \theta) di mana fff adalah fungsi kerapatan probabilitas jika distribusi yang mendasarinya adalah kontinu, dan fungsi massa probabilitas (dengan penjumlahan sebagai pengganti produk) jika distribusinya terpisah. Bagaimana kita menentukan fungsi kemungkinan jika distribusi yang mendasarinya …



2
Varians maksimum variabel acak Gaussian
Diberikan variabel acak X1,X2,⋯,XnX1,X2,⋯,XnX_1,X_2, \cdots, X_n sampel iid dari ∼N(0,σ2)∼N(0,σ2)\sim \mathcal{N}(0, \sigma^2), tentukan Z=maxi∈{1,2,⋯,n}XiZ=maxi∈{1,2,⋯,n}XiZ = \max_{i \in \{1,2,\cdots, n \}} X_i Kami memilikinya E[Z]≤σ2logn−−−−−√E[Z]≤σ2log⁡n\mathbb{E}[Z] \le \sigma \sqrt{2 \log n} . Saya bertanya-tanya apakah ada batas atas / bawah pada Var(Z)Var(Z)\text{Var}(Z) ?



1
Pro dan Kontra dari Smoothing spline
Saya punya pertanyaan umum. Baru-baru ini saya baru saja belajar Dasar Ekspansi dan Regularisasi. Ada beberapa teknik menarik termasuk: spline kubik, spline alami, b-spline dan spline smoothing . Pertanyaannya adalah, apa kelebihan dan kekurangan (jika ada) dari smoothing spline dibandingkan dengan spline kubik dan alami "tipikal" di mana pengguna harus …

3
High Recall - Precision Rendah untuk dataset yang tidak seimbang
Saya saat ini menghadapi beberapa masalah menganalisis dataset tweet dengan mesin vektor dukungan. Masalahnya adalah bahwa saya memiliki satu set pelatihan kelas biner yang tidak seimbang (5: 2); yang diharapkan sebanding dengan distribusi kelas nyata. Saat memprediksi saya mendapatkan presisi rendah (0,47) untuk kelas minoritas di set validasi; recall adalah …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.