Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

2
Ukuran kinerja classifier yang menggabungkan sensitivitas dan spesifisitas?
Saya memiliki data 2-kelas berlabel di mana saya melakukan klasifikasi menggunakan beberapa pengklasifikasi. Dan datasetnya seimbang. Ketika menilai kinerja pengklasifikasi, saya perlu mempertimbangkan seberapa akurat pengklasifikasi dalam menentukan tidak hanya positif sejati, tetapi juga negatif sebenarnya. Oleh karena itu, jika saya menggunakan akurasi, dan jika pengklasifikasi cenderung positif dan mengklasifikasikan …

3
Rekomendasi untuk guru pertama kali (Pengantar Biostatistik)
Saya mengajar kelas pertama saya musim gugur ini (Pengantar Biostatistik). Adakah yang punya saran untuk mengajar statistik dengan lebih baik? Mungkin beberapa contoh Anda ingin guru pertama Anda telah digunakan? Saya menggunakan Principles of Biostatistics oleh Pagano dan Gauvreau. Sunting: Detail Kelas ini adalah kelas online yang bertemu dua kali …



2
Kebingungan terkait pengambilan sampel Gibbs
Saya menemukan artikel ini di mana dikatakan bahwa dalam pengambilan sampel Gibbs setiap sampel diterima. Saya sedikit bingung. Bagaimana jika setiap sampel yang diterima itu konvergen ke distribusi stasioner. Secara umum Algoritma Metropolis kami terima sebagai min (1, p (x *) / p (x)) di mana x * adalah titik …

1
Menggunakan persentil sebagai prediktor - ide bagus?
Saya berpikir tentang masalah yang memprediksi log (menghabiskan) pelanggan menggunakan regresi linier. Saya sedang mempertimbangkan fitur apa yang akan digunakan sebagai input dan bertanya-tanya apakah akan baik-baik saja untuk menggunakan persentil variabel sebagai input. Misalnya saya bisa menggunakan pendapatan perusahaan sebagai input. Yang saya pikirkan adalah apakah saya bisa menggunakan …


1
R / caret: set kereta dan uji vs validasi silang?
Ini mungkin pertanyaan yang konyol, tetapi ketika membuat model dengan tanda sisipan dan menggunakan sesuatu seperti LOOCVatau (bahkan lebih tepatnya) LGOCV, apa manfaat membagi data ke dalam kereta dan set tes jika ini pada dasarnya merupakan langkah validasi silang ngomong-ngomong Saya membaca beberapa pertanyaan terkait dan mereka menyarankan bahwa beberapa …


1
Istilah interaksi menggunakan analisis regresi hirarki terpusat variabel? Variabel apa yang harus kita pusatkan?
Saya menjalankan analisis regresi hirarkis dan saya memiliki sedikit keraguan: Apakah kita menghitung istilah interaksi menggunakan variabel terpusat? Apakah kita harus memusatkan SEMUA variabel kontinu yang kita miliki dalam dataset, kecuali variabel dependen? Ketika kita harus mencatat beberapa variabel (karena sdnya jauh lebih tinggi dari rata-rata), apakah kita kemudian memusatkan …


3
LDA vs perceptron
Saya mencoba untuk merasakan bagaimana LDA 'cocok' dengan teknik pembelajaran lainnya yang diawasi. Saya sudah membaca beberapa posting LDA-esque di sini tentang LDA. Saya sudah terbiasa dengan perceptron, tetapi baru belajar LDA sekarang. Bagaimana LDA 'cocok' ke dalam keluarga algoritma pembelajaran yang diawasi? Apa yang mungkin menjadi kelemahannya dibandingkan dengan …

2
Bagaimana keseragaman memimpin sebelumnya dengan perkiraan yang sama dari kemungkinan maksimum dan mode posterior?
Saya mempelajari berbagai metode estimasi titik dan membaca bahwa ketika menggunakan estimasi MAP vs ML, ketika kami menggunakan "uniform uniform", perkiraannya sama. Adakah yang bisa menjelaskan apa itu "seragam" sebelumnya dan memberikan beberapa contoh (sederhana) tentang kapan penduga MAP dan ML akan sama?


4
Mengapa akar kuadrat diambil untuk jumlah sampel "N" dalam rumus standar deviasi?
Saya mencoba memahami konsep dasar deviasi standar. Dari rumus σ=∑i=1n(xi−μ)2N−−−−−−−−−−⎷σ=∑i=1n(xi−μ)2N\sigma= \sqrt{ \dfrac{ \sum\limits_{i=1}^n (x_i-\mu)^2} N } Saya tidak mengerti mengapa kita harus membagi dua populasi "N" yaitu mengapa kita ingin mengambil N−−√N\sqrt{N} ketika kita tidak melakukanN2N2{N^2} ? Bukankah itu membuat populasi kita condong? Seharusnya formula tidak menjadi σ=∑i=1n(xi−μ)2−−−−−−−−−√Nσ=∑i=1n(xi−μ)2N\sigma= \dfrac{ \sqrt{ …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.