Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

2
Mengapa Bayes Classifier adalah classifier yang ideal?
Ini dianggap sebagai kasus ideal di mana struktur probabilitas yang mendasari kategori dikenal dengan sempurna. Mengapa dengan Bayes classifier kita mencapai kinerja terbaik yang bisa dicapai? Apa bukti / penjelasan formal untuk ini? Karena kami selalu menggunakan pengklasifikasi Bayes sebagai tolok ukur untuk membandingkan kinerja semua pengklasifikasi lainnya.

3
Apa fungsi kerugian yang harus digunakan untuk mendapatkan classifier biner yang presisi atau tinggi?
Saya mencoba membuat detektor objek yang sangat jarang terjadi (dalam gambar), berencana untuk menggunakan classifier biner CNN yang diterapkan pada jendela geser / ukuran. Saya telah membangun pelatihan 1: 1 positif-negatif yang seimbang dan set tes (apakah itu hal yang benar untuk dilakukan dalam kasus seperti itu?), Dan classifier baik-baik …

1
Algoritma: Pencarian biner ketika nilai tidak pasti
Saya membutuhkan algoritma untuk melakukan pencarian biner ketika tes pada setiap langkah dapat memberikan hasil yang salah. Latar belakang: Saya perlu menempatkan siswa pada 12 tingkat kesulitan yang paling tepat. Pendekatan saat ini adalah brute force dan mengajukan 60 pertanyaan pilihan ganda 4-jawaban untuk meningkatkan kesulitan, berhenti setelah tiga salah, …
11 algorithms 

1
Bagaimana cara menguji apakah matriks kovarian silang tidak nol?
Latar belakang penelitian saya : Dalam sampling Gibbs di mana kami sampel (variabel minat) dan dari dan masing-masing, di mana dan adalah vektor acak -dimensi. Kita tahu bahwa proses ini biasanya dibagi menjadi dua tahap:XXXYYYP(X|Y)P(X|Y)P(X|Y)P(Y|X)P(Y|X)P(Y|X)XXXYYYkkk Periode Bakar, di mana kami membuang semua sampel. sampel sebagai dan .X1∼XtX1∼XtX_1\sim X_tY1∼YtY1∼YtY_1\sim Y_t Periode …

2
"Kata sandi terkuat"
Saya memiliki aplikasi yang dilindungi oleh PIN empat digit dan pengguna mendapat lima upaya masuk sebelum akun dikunci. Sekarang, salah satu pelanggan saya ingin "memperkuat" keamanan dan mengadvokasi solusi lain: enam digit PIN TIDAK "angka yang sama di sebelah satu sama lain": mis: 11 3945 atau 39 55 94 TIDAK …


3
Visualisasikan distribusi binomial bivariat
Pertanyaan: seperti apa distribusi binomial bivariat dalam ruang 3 dimensi? Di bawah ini adalah fungsi spesifik yang ingin saya visualisasikan untuk berbagai nilai parameter; yaitu, , p 1 , dan p 2 .nnnp1p1p_{1}p2p2p_{2} f(x1,x2)=n!x1!x2!px11px22,x1+x2=n,p1+p2=1.f(x1,x2)=n!x1!x2!p1x1p2x2,x1+x2=n,p1+p2=1.f(x_{1},x_{2}) = \frac{n!}{x_{1}!x_{2}!}p_{1}^{x_{1}}p_{2}^{x_{2}}, \qquad x_{1}+x_{2}=n, \quad p_{1}+p_{2}=1. Perhatikan bahwa ada dua kendala; dan p 1 + p …

3
Mengapa istilah bias dalam SVM diperkirakan secara terpisah, alih-alih dimensi ekstra dalam vektor fitur?
Hyperplane optimal dalam SVM didefinisikan sebagai: w⋅x+b=0,w⋅x+b=0,\mathbf w \cdot \mathbf x+b=0, di mana merupakan ambang. Jika kita memiliki beberapa pemetaan yang memetakan ruang input ke beberapa ruang , kita dapat mendefinisikan SVM di ruang , di mana hiperplane optimal adalah:ϕ Z Zbbbϕϕ\mathbf \phiZZZZZZ w⋅ϕ(x)+b=0.w⋅ϕ(x)+b=0.\mathbf w \cdot \mathbf \phi(\mathbf x)+b=0. Namun, …
11 svm  threshold 


1
Kira-kira
Saya dengan santai membaca sebuah artikel (dalam bidang ekonomi) yang memiliki perkiraan :log(E(X))log⁡(E(X))\log(E(X)) ,log(E(X))≈E(log(X))+0.5var(log(X))log⁡(E(X))≈E(log⁡(X))+0.5var(log⁡(X))\log(E(X)) \approx E(\log(X))+0.5 \mathrm{var}(\log(X)) yang penulis katakan tepat jika X adalah log-normal (yang saya tahu). Apa yang saya tidak tahu adalah bagaimana mendapatkan perkiraan ini. Saya mencoba menghitung perkiraan urutan kedua Taylor dan yang saya dapatkan hanyalah …

4
Mengapa Tindakan Dispersi Kurang Intuitif Daripada Sentralitas?
Tampaknya ada sesuatu dalam pemahaman manusiawi kita yang menciptakan kesulitan dalam memahami secara intuitif gagasan varian. Dalam arti sempit, jawabannya langsung: mengkuadratkan kita dari pemahaman refleksif kita. Tapi, apakah itu hanya varian yang menghadirkan masalah, atau apakah itu seluruh gagasan penyebaran data? Kami berlindung di kisaran, atau hanya menyatakan minimum …

3
Memahami konjugat Beta sebelumnya dalam inferensi Bayesian tentang frekuensi
Berikut ini adalah kutipan dari Pengantar Bolstad untuk Statistik Bayesian . Untuk Anda yang ahli di luar sana, ini mungkin sepele tapi saya tidak mengerti bagaimana penulis menyimpulkan bahwa kami tidak perlu melakukan integrasi untuk menghitung probabilitas posterior untuk beberapa nilai . Saya mengerti ungkapan kedua yang proporsionalitas dan dari …



2
Mengapa regresi ridge tidak memberikan interpretasi yang lebih baik daripada LASSO?
Saya sudah punya ide tentang pro dan kontra regresi ridge dan LASSO. Untuk LASSO, istilah penalti L1 akan menghasilkan vektor koefisien jarang, yang dapat dilihat sebagai metode pemilihan fitur. Namun, ada beberapa batasan untuk LASSO. Jika fitur memiliki korelasi tinggi, LASSO hanya akan memilih salah satunya. Selain itu, untuk masalah …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.