Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

2
Pengambilan sampel dari Distribusi yang Tidak Tepat (menggunakan MCMC dan lainnya)
Pertanyaan dasar saya adalah: bagaimana Anda akan mengambil sampel dari distribusi yang tidak tepat? Apakah masuk akal untuk mengambil sampel dari distribusi yang tidak tepat? Komentar Xi'an di sini semacam menjawab pertanyaan itu, tetapi saya sedang mencari beberapa detail lebih lanjut tentang ini. Lebih spesifik untuk MCMC: Dalam berbicara tentang …

1
Apa saja pertanyaan wawancara yang baik untuk kandidat pengembang algoritma statistik?
Saya mewawancarai orang-orang untuk posisi pengembang algoritma / peneliti dalam konteks statistik / pembelajaran mesin / data mining. Saya mencari pertanyaan untuk ditanyakan untuk menentukan, secara khusus, keakraban, pemahaman dan kelenturan kandidat dengan teori yang mendasarinya, misalnya sifat dasar dari harapan dan perbedaan, beberapa distribusi umum, dll. Saya saat masuk …




2
Prediksi dari model BSTS (dalam R) gagal total
Setelah membaca posting blog ini tentang model deret waktu struktural Bayesian, saya ingin melihat penerapan ini dalam konteks masalah yang sebelumnya saya gunakan untuk ARIMA. Saya memiliki beberapa data dengan beberapa komponen musiman yang diketahui (tetapi berisik) - pasti ada komponen tahunan, bulanan dan mingguan untuk ini, dan juga beberapa …
15 r  time-series  bayesian  mcmc  bsts 

5
Variasi statistik dalam dua format kualifikasi Formula 1
Saya baru saja membaca ini artikel BBC ini tentang format kualifikasi di Formula 1. Penyelenggara ingin membuat kualifikasi menjadi kurang dapat diprediksi, yaitu meningkatkan variasi statistik dalam hasilnya. Meliputi beberapa rincian yang tidak relevan, pada saat driver diberi peringkat oleh putaran tunggal terbaik mereka dari (untuk konkret) dua upaya. Salah …
15 variance 

3
Memperkirakan probabilitas dalam proses Bernoulli dengan mengambil sampel hingga 10 kegagalan: apakah bias?
Misalkan kita memiliki proses Bernoulli dengan probabilitas kegagalan qqq (yang akan menjadi kecil, katakanlah, q≤0.01q≤0.01q \leq 0.01 ) dari mana kita sampel sampai kita menemukan 101010 kegagalan. Kami dengan demikian memperkirakan probabilitas kegagalan sebagai q : = 10 / N di mana N adalah jumlah sampel.q^:=10/Nq^:=10/N\hat{q}:=10/NNNN Pertanyaan : Apakah q …

1
Mengapa regresi ini TIDAK gagal karena multikolinieritas sempurna, walaupun satu variabel adalah kombinasi linear dari yang lain?
Hari ini, saya bermain-main dengan dataset kecil dan melakukan regresi OLS sederhana yang saya harapkan gagal karena multikolinieritas sempurna. Namun, ternyata tidak. Ini menyiratkan bahwa pemahaman saya tentang multikolinieritas salah. Pertanyaan saya adalah: Di mana saya salah? Saya pikir saya dapat menunjukkan bahwa salah satu variabel saya adalah kombinasi linear …


2
Kapan harus berhenti memperbaiki model?
I have been studying statistics from many books for the last 3 years, and thanks to this site I learned a lot. Nevertheless one fundamental question still remains unanswered for me. It may have a very simple or a very difficult answer, but I know for sure it requires some …

2
Pdf dari
Misalkan X1,X2,...,XnX1,X2,...,XnX_1, X_2,...,X_n menjadi iid dari N(μ,σ2)N(μ,σ2)N(\mu,\sigma^2) dengan μ∈Rμ∈R\mu \in \mathcal R dan σ 2 > 0 yang tidak diketahuiσ2>0σ2>0\sigma^2>0 Biarkan Z=X1−X¯S,Z=X1−X¯S,Z=\frac{X_1-\bar{X}}{S},S adalah standar deviasi di sini. Dapat ditunjukkan bahwa ZZZ memiliki Lebesgue pdf f(z)=n−−√Γ(n−12)π−−√(n−1)Γ(n−22)[1−nz2(n−1)2]n/2−2I(0,(n−1)/n√)(|Z|)f(z)=nΓ(n−12)π(n−1)Γ(n−22)[1−nz2(n−1)2]n/2−2I(0,(n−1)/n)(|Z|)f(z)=\frac{\sqrt{n} \Gamma\left(\frac{n-1}{2}\right)}{\sqrt{\pi}(n-1)\Gamma\left(\frac{n-2}{2}\right)}\left[1-\frac{nz^2}{(n-1)^2}\right]^{n/2-2}I_{(0,(n-1)/\sqrt{n})}(|Z|) Pertanyaan saya lalu bagaimana cara mendapatkan pdf ini? Pertanyaannya adalah dari sini dalam contoh …
15 self-study  umvue 

2
Jika “Kesalahan standar” dan “Interval kepercayaan” mengukur ketepatan pengukuran, lalu apa ukuran ketelitiannya?
Dalam buku "Biostatistik untuk boneka" di halaman 40 saya membaca: Kesalahan standar (disingkat SE) adalah salah satu cara untuk menunjukkan seberapa akurat perkiraan Anda atau pengukuran sesuatu. dan Interval kepercayaan memberikan cara lain untuk menunjukkan ketepatan estimasi atau pengukuran sesuatu. Tetapi tidak ada tertulis apa pun bagaimana menunjukkan keakuratan pengukuran. …

1
Memahami Dekomposisi QR
Saya punya contoh yang berhasil (dalam R), yang saya coba mengerti lebih lanjut. Saya menggunakan Limma untuk membuat model linier dan saya mencoba memahami apa yang terjadi langkah demi langkah dalam perhitungan perubahan lipat. Saya kebanyakan berusaha mencari tahu apa yang terjadi untuk menghitung koefisien. Dari apa yang saya tahu, …

1
Pada Tingkat Apa tes
LATAR BELAKANG: Lewati dengan aman - ada di sini untuk referensi, dan untuk melegitimasi pertanyaan. Pembukaan makalah ini berbunyi: "Uji kontingensi chi-square Karl Pearson yang terkenal berasal dari statistik lain, yang disebut statistik z, berdasarkan pada distribusi Normal. Versi paling sederhana dari χ2χ2\chi^2 dapat ditunjukkan identik secara matematis dengan uji …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.