Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

1
Mengapa orang tidak menggunakan RBF lebih dalam atau RBF dalam kombinasi dengan MLP?
Jadi ketika melihat Radial Basis Function Neural Networks, saya perhatikan bahwa orang hanya pernah merekomendasikan penggunaan 1 layer tersembunyi, sedangkan dengan multilayer perceptron neural networks lebih banyak layer dianggap lebih baik. Mengingat bahwa jaringan RBF dapat dilatih dengan versi back propagation apakah ada alasan mengapa jaringan RBF yang lebih dalam …


1
Ekstraksi kata kunci otomatis: menggunakan persamaan cosinus sebagai fitur
Saya punya matriks istilah-dokumen , dan sekarang saya ingin mengekstraksi kata kunci untuk setiap dokumen dengan metode pembelajaran yang dilindungi (SVM, Naif Bayes, ...). Dalam model ini, saya sudah menggunakan Tf-idf, tag Pos, ...M.M.M Tapi sekarang aku bertanya-tanya tentang selanjutnya. Saya punya matriks dengan persamaan cosinus antara istilah-istilah.CCC Apakah ada …

1
Kapan saya harus khawatir tentang paradoks Jeffreys-Lindley dalam pilihan model Bayesian?
Saya sedang mempertimbangkan ruang besar (tetapi terbatas) model kompleksitas yang berbeda yang saya jelajahi menggunakan RJMCMC . Sebelumnya pada vektor parameter untuk setiap model cukup informatif. Dalam kasus apa (jika ada) yang harus saya khawatirkan dengan paradoks Jeffreys-Lindley yang mendukung model yang lebih sederhana ketika salah satu model yang lebih …

1
Bagaimana menginterpretasikan ketinggian plot kepadatan
Bagaimana saya harus menginterpretasikan ketinggian plot kepadatan: Misalnya dalam plot di atas, puncaknya sekitar 0,07 pada x = 18. Dapatkah saya menyimpulkan bahwa sekitar 7% dari nilai sekitar 18? Bisakah saya lebih spesifik dari itu? Ada juga puncak kedua di x = 30 dengan tinggi 0,02. Apakah itu berarti bahwa …

2
Mengapa n-gram digunakan dalam identifikasi bahasa teks, bukan kata-kata?
Dalam dua perpustakaan identifikasi bahasa populer, Compact Language Detector 2 untuk C ++ dan bahasa detektor untuk java, keduanya menggunakan (berbasis karakter) n-gram untuk mengekstraksi fitur teks. Mengapa kantung kata-kata (satu kata / kamus) tidak digunakan, dan apa keuntungan dan kerugian kantung kata-kata dan n-gram? Juga, apa kegunaan lain dari …

1
Perkiraan distribusi produk N normal iid? Kasus khusus μ≈0
Diberikan iid , dan , mencari:X n ≈ N ( μ X , σ 2 X ) μ X ≈ 0N≥ 30N≥30N\geq30Xn≈ N( μX, σ2X)Xn≈N(μX,σX2)X_n\approx\mathcal{N}(\mu_X,\sigma_X^2)μX≈ 0μX≈0\mu_X \approx 0 perkiraan distribusi formulir tertutup akurat dari YN= ∏1NXnYN=∏1NXnY_N=\prod\limits_{1}^{N}{X_n} perkiraan asimtotik ( eksponensial ?) untuk produk yang sama Ini adalah kasus khusus dari …

3
Mengenai konvergensi dalam probabilitas
Biarkan {Xn}n≥1{Xn}n≥1\{X_n\}_{n\geq 1} menjadi urutan variabel acak st Xn→aXn→aX_n \to a dalam probabilitas, di mana a>0a>0a>0 adalah konstanta tetap. Saya mencoba menunjukkan yang berikut: Xn−−−√→a−−√Xn→a\sqrt{X_n} \to \sqrt{a} dan aXn→1aXn→1\frac{a}{X_n}\to 1 keduanya dalam probabilitas. Saya di sini untuk melihat apakah logika saya sehat. Ini pekerjaan saya MENCOBA Untuk bagian pertama, kami …

1
Apa nama metode estimasi kerapatan tempat semua pasangan kemungkinan digunakan untuk membuat distribusi campuran Normal?
Saya hanya memikirkan cara yang rapi (belum tentu bagus) untuk membuat perkiraan kepadatan satu dimensi dan pertanyaan saya adalah: Apakah metode estimasi kerapatan ini memiliki nama? Jika tidak, apakah ini merupakan kasus khusus dari beberapa metode lain dalam literatur? Berikut adalah metode: Kami memiliki vektor yang kami asumsikan diambil dari …

1
Varians dari Cohen
Cohen adalah salah satu cara paling umum untuk mengukur ukuran efek ( lihat Wikipedia ). Ini hanya mengukur jarak antara dua cara dalam hal standar deviasi terkumpul. Bagaimana kita bisa mendapatkan rumus matematika estimasi varians dari Cohen d ? dddddd Sunting Desember 2015: Terkait dengan pertanyaan ini adalah gagasan untuk …

2
Apa kelebihan menggunakan jaringan saraf Bayesian
Baru-baru ini saya membaca beberapa makalah tentang jaringan saraf Bayesian (BNN) [Neal, 1992] , [Neal, 2012] , yang memberikan kemungkinan hubungan antara input dan output dalam jaringan saraf. Pelatihan seperti jaringan saraf adalah melalui MCMC yang berbeda dari algoritma back-propagation tradisional. Pertanyaan saya adalah: Apa keuntungan menggunakan jaringan saraf seperti …

3
Mengukur kesamaan antara dua set data
Ringkasan : Mencoba menemukan metode terbaik merangkum kesamaan antara dua set data yang disejajarkan dengan menggunakan nilai tunggal. Detail : Pertanyaan saya paling baik dijelaskan dengan diagram. Grafik di bawah ini menunjukkan dua set data yang berbeda, masing-masing dengan nilai berlabel nfdan nr. Titik-titik di sepanjang sumbu x mewakili tempat …

2
Bagaimana cara menghitung bobot kriteria Fisher?
Saya mempelajari pengenalan pola dan pembelajaran mesin, dan saya mengalami pertanyaan berikut. Pertimbangkan masalah klasifikasi dua kelas dengan probabilitas kelas sebelumnya yang samaP(D1)=P(D2)=12P(D1)=P(D2)=12P(D_1)=P(D_2)= \frac{1}{2} dan distribusi instance di setiap kelas yang diberikan oleh p(x|D1)=N([00],[2001]),p(x|D1)=N([00],[2001]), p(x|D_1)= {\cal N} \left( \begin{bmatrix} 0 \\0 \end{bmatrix}, \begin{bmatrix} 2 & 0 \\ 0 & 1 …

3
mengapa metode peningkatan sensitif terhadap outlier
Saya menemukan banyak artikel yang menyatakan bahwa metode peningkatan sensitif terhadap outlier, tetapi tidak ada artikel yang menjelaskan mengapa. Dalam pengalaman saya, pencilan buruk untuk algoritma pembelajaran mesin, tetapi mengapa meningkatkan metode dipilih sebagai sangat sensitif? Bagaimana algoritma berikut akan memberi peringkat dalam hal sensitivitas terhadap pencilan: boost-tree, hutan acak, …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.