Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

2
Buku Teks berasal Sampling Metropolis-Hastings dan Gibbs
Saya memiliki pengalaman praktis yang cukup baik dengan sampel Metropolis-Hastings dan Gibbs, tetapi saya ingin mendapatkan pemahaman matematis yang lebih baik tentang algoritma ini. Apa saja buku teks atau artikel bagus yang membuktikan kebenaran sampler ini (lebih banyak algoritme juga bagus)?

1
Pada korelasi cophenetic untuk clustering dendrogram
Pertimbangkan konteks pengelompokan dendrogram. Mari kita sebut perbedaan asli jarak antara individu. Setelah membuat dendrogram, kami mendefinisikan ketidaksamaan cophenetic antara dua individu sebagai jarak antara kelompok-kelompok di mana individu-individu ini berada. Beberapa orang menganggap bahwa korelasi antara perbedaan asli dan perbedaan cophenetic (disebut korelasi cophenetic ) adalah "indeks kesesuaian" dari …

3
Berarti waktu bertahan hidup untuk fungsi bertahan hidup normal-log
Saya telah menemukan banyak formula yang menunjukkan bagaimana menemukan waktu bertahan hidup rata-rata untuk distribusi eksponensial atau Weibull, tetapi saya kurang beruntung untuk fungsi bertahan hidup normal-log. Diberi fungsi bertahan hidup sebagai berikut: S( t ) = 1 - ϕ [ ln( t ) - μσ]S(t)=1−ϕ[ln⁡(t)−μσ]S(t) = 1 - \phi …
10 survival 

2
Cara terbaik untuk menggabungkan respons biner dan kontinu
Saya mencoba menemukan cara terbaik untuk memperkirakan jumlah pembayaran untuk agen penagihan. Variabel dependen hanya non-nol ketika pembayaran telah dilakukan. Dapat dimengerti, ada banyak sekali angka nol karena kebanyakan orang tidak dapat dihubungi atau tidak dapat membayar kembali utangnya. Ada juga korelasi negatif yang sangat kuat antara jumlah hutang dan …

3
Bagaimana memodelkan koin bias dengan waktu yang bervariasi?
Model koin bias biasanya memiliki satu parameter . Salah satu cara untuk memperkirakan dari serangkaian undian adalah dengan menggunakan beta sebelum dan menghitung distribusi posterior dengan kemungkinan binomial.θ=P(Head|θ)θ=P(Head|θ)\theta = P(\text{Head} | \theta)θθ\theta Dalam pengaturan saya, karena beberapa proses fisik yang aneh, sifat koin saya perlahan berubah dan menjadi fungsi waktu …



4
Menyesuaikan distribusi log-normal di R vs. SciPy
Saya telah memasang model lognormal menggunakan R dengan satu set data. Parameter yang dihasilkan adalah: meanlog = 4.2991610 sdlog = 0.5511349 Saya ingin mentransfer model ini ke Scipy, yang belum pernah saya gunakan sebelumnya. Menggunakan Scipy, saya bisa mendapatkan bentuk dan skala 1 dan 3.1626716539637488e + 90 - angka yang …
10 r  python  numpy  scipy 



2
Mendeteksi Cluster kode sumber "mirip"
Asumsikan saya memiliki 400 siswa (yang ada di universitas besar) yang harus melakukan proyek ilmu komputer, dan bahwa mereka harus bekerja sendiri (tidak ada kelompok siswa). Contoh proyek dapat membiarkan "menerapkan algoritma transformasi fourier cepat di fortran" (Saya tahu, itu tidak terdengar seksi tetapi itu membuat pertanyaan saya lebih sederhana). …





Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.