Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data



1
Apa yang dimaksud dengan autoencoder variasional dan untuk tugas pembelajaran apa yang digunakan?
Sebagai per ini dan jawaban ini , autoencoder tampaknya menjadi teknik yang menggunakan jaringan saraf untuk pengurangan dimensi. Saya ingin juga tahu apa adalah variational autoencoder (perbedaan utama / manfaat lebih dari satu "tradisional" autoencoders) dan juga apa yang tugas belajar utama algoritma ini digunakan untuk.


2
Apakah model campuran bermanfaat sebagai model prediksi?
Saya agak bingung tentang kelebihan model campuran dalam hal pemodelan prediktif. Karena model prediktif biasanya dimaksudkan untuk memprediksi nilai dari pengamatan yang sebelumnya tidak diketahui maka tampak jelas bagi saya bahwa satu-satunya cara model campuran mungkin berguna adalah melalui kemampuannya untuk memberikan prediksi tingkat populasi (yaitu tanpa menambahkan efek acak). …

2
Regresi kuantitatif: Fungsi kerugian
Saya mencoba memahami regresi kuantitatif, tetapi satu hal yang membuat saya menderita adalah pilihan fungsi kerugian. ρτ( u ) = u ( τ- 1{ u &lt; 0 })ρτ(kamu)=kamu(τ-1{kamu&lt;0})\rho_\tau(u) = u(\tau-1_{\{u<0\}}) Saya tahu bahwa minimum harapan sama dengan -quantile, tetapi apa alasan intuitif untuk memulai dengan fungsi ini? Saya tidak melihat …

2
Siapa yang menemukan pohon keputusan?
Saya mencoba melacak siapa yang menemukan struktur dan algoritma data pohon keputusan. Dalam entri Wikipedia tentang pembelajaran pohon keputusan ada klaim bahwa "ID3 dan CART ditemukan secara independen pada waktu yang bersamaan (antara 1970 dan 1980)". ID3 disajikan kemudian di: Quinlan, JR 1986. Induksi Pohon Keputusan. Mach Belajar. 1, 1 …
24 cart  history 

2
Generalisasi berkelanjutan dari distribusi binomial negatif
Distribusi binomial negatif (NB) didefinisikan pada bilangan bulat non-negatif dan memiliki fungsi massa probabilitas f(k;r,p)=(k+r−1k)pk(1−p)r.f(k;r,p)=(k+r−1k)pk(1−p)r.f(k;r,p)={\binom {k+r-1}{k}}p^{k}(1-p)^{r}.Apakah masuk akal untuk mempertimbangkan distribusi kontinu pada real non-negatif yang didefinisikan oleh rumus yang sama (mengganti k∈N0k∈N0k\in \mathbb N_0 oleh x∈R≥0x∈R≥0x\in\mathbb R_{\ge 0} )? Koefisien binomial dapat ditulis ulang sebagai produk dari (k+1)⋅…⋅(k+r−1)(k+1)⋅…⋅(k+r−1)(k+1)\cdot\ldots\cdot(k+r-1) , …


3
Apa alasan bahwa Pengoptimal Adam dianggap kuat dengan nilai parameter hipernya?
Saya membaca tentang pengoptimal Adam untuk Deep Learning dan menemukan kalimat berikut dalam buku baru Deep Learning karya Bengio, Goodfellow dan Courville: Adam umumnya dianggap cukup kuat untuk memilih parameter hiper, meskipun tingkat pembelajaran kadang-kadang perlu diubah dari standar yang disarankan. jika ini benar, ini adalah masalah besar karena pencarian …

3
Sejarah teori sebelumnya yang tidak informatif
Saya menulis esai teoretis singkat untuk kursus Statistik Bayesian (dalam Ekonomi M.Sc.) tentang prior uninformative dan saya mencoba memahami yang merupakan langkah-langkah dalam pengembangan teori ini. Sekarang, garis waktu saya dibuat tiga langkah utama: Prinsip ketidakpedulian Laplace (1812), prior Non-Invariant (Jeffreys (1946)), referensi Bernardo sebelumnya (1979). Dari tinjauan literatur saya, …

3
Apa yang bisa disimpulkan tentang data ketika rata-rata aritmatika sangat dekat dengan rata-rata geometris?
Apakah ada sesuatu yang signifikan tentang rata-rata geometrik dan rata-rata aritmatika yang sangat dekat satu sama lain, katakan ~ 0,1%? Dugaan apa yang dapat dibuat tentang kumpulan data seperti itu? Saya telah bekerja menganalisis set data, dan saya perhatikan bahwa ironisnya nilainya sangat, sangat dekat. Tidak tepat, tapi tutup. Juga, …

7
Rekomendasi untuk artikel non-teknis namun mendalam dalam statistik
Inspirasi untuk pertanyaan ini datang dari artikel Leo-Breiman yang terkenal, Pemodelan Statistik: The Two Cultures (akses terbuka yang tersedia). Penulis membandingkan apa yang dilihatnya sebagai dua pendekatan berbeda untuk menganalisis data, menyentuh ide-ide kunci dalam statistik klasik dan pembelajaran mesin. Namun, artikel ini dapat dipahami oleh khalayak luas - dapat …
24 references 

4
ANOVA vs regresi linier berganda? Mengapa ANOVA begitu umum digunakan dalam studi eksperimental?
ANOVA vs regresi linier berganda? Saya mengerti bahwa kedua metode ini tampaknya menggunakan model statistik yang sama. Namun dalam keadaan apa saya harus menggunakan metode apa? Apa kelebihan dan kekurangan metode ini jika dibandingkan? Mengapa ANOVA begitu umum digunakan dalam studi eksperimental dan saya hampir tidak pernah menemukan studi regresi?

2
Beralih dari Memodelkan Proses menggunakan Distribusi Poisson untuk menggunakan Distribusi Binomial Negatif?
\newcommand{\P}{\mathbb{P}} Kami memiliki proses acak yang mungkin-atau-mungkin-tidak terjadi beberapa kali dalam jangka waktu TTT . Kami memiliki umpan data dari model yang sudah ada dari proses ini, yang menyediakan probabilitas sejumlah peristiwa yang terjadi pada periode 0≤t&lt;T0≤t&lt;T0 \leq t < T . Model yang ada ini sudah tua dan kita …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.