Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data


1
Nasihat Bagi Mahasiswa Pascasarjana dalam Statistik
Saya telah memulai PhD dalam statistik tahun ini, dan saya mencari praktik terbaik, saran, dan (saran meta) mengenai cara tumbuh dan menjadi peneliti akademis yang baik di bidang statistik / ML. Pikiran dan tautan umum disambut baik, tetapi untuk memulai penggulingan bola, berikut adalah banyak pertanyaan yang dikumpulkan dari artikel …
9 careers  phd  academia 

2
Bagaimana agar sesuai dengan regresi seperti di R?
Saya punya beberapa data deret waktu di mana variabel yang diukur adalah bilangan bulat positif (jumlah). Saya ingin menguji apakah ada tren naik dari waktu ke waktu (atau tidak). Variabel independen (x) berada dalam kisaran 0-500 dan variabel dependen (y) berada dalam kisaran 0-8. Saya pikir saya menjawab ini dengan …
9 r  regression  python 



1
Bagaimana cara menggabungkan prakiraan saat variabel respons dalam model peramalan berbeda?
pengantar Dalam peramalan kombinasi, salah satu solusi populer didasarkan pada penerapan beberapa kriteria informasi. Mengambil contoh kriteria Akaike diperkirakan untuk model , orang dapat menghitung perbedaan dari dan kemudian RP_j = e ^ {(AIC ^ * - AIC_j) / 2} dapat ditafsirkan sebagai probabilitas relatif model j menjadi yang benar. …

1
Distribusi kebalikan dari koefisien regresi
Misalkan kita memiliki model linier yang memenuhi semua asumsi regresi standar (Gauss-Markov). Kami tertarik pada θ = 1 / β 1 .yi=β0+β1xi+ϵiyi=β0+β1xi+ϵiy_i = \beta_0 + \beta_1 x_i + \epsilon_iθ=1/β1θ=1/β1\theta = 1/\beta_1 Pertanyaan 1: Apa asumsi yang diperlukan untuk distribusi θ didefinisikan dengan baik? β 1 ≠ 0 akan menjadi penting …


3
Apa yang mungkin menjadi definisi yang jelas dan praktis untuk "keluarga hipotesis" (berkenaan dengan tingkat kesalahan kekeluargaan)?
Ketika mencoba untuk mengevaluasi apa yang merupakan keluarga hipotesis dalam percobaan / proyek / analisis, saya telah menemukan "tujuan yang serupa" dan "konten yang serupa" yang diberikan sebagai pedoman untuk membatasi keluarga, tetapi ini meninggalkan cukup banyak terbuka untuk interpretasi ( untuk sedikitnya). Tampak jelas bahwa jika dalam analisis, saya …

2
Dapatkah saya mempercayai suatu regresi jika variabel berkorelasi otomatis?
Kedua variabel (dependen dan independen) menunjukkan efek autokorelasi. Data bersifat time-series dan stasioner Ketika saya menjalankan residu regresi tampaknya tidak berkorelasi. Statistik Durbin-Watson saya lebih besar dari nilai kritis atas, jadi ada bukti bahwa istilah kesalahan tidak berkorelasi positif. Juga ketika saya merencanakan ACF untuk kesalahan sepertinya tidak ada korelasi …


1
Memvisualisasikan proporsi berturut-turut
Saya mencoba memvisualisasikan beberapa data konsumen, yang memiliki 4 kategori. Pengguna bebas untuk beralih di antara berbagai kategori. Saya ingin memvisualisasikan tiga atau empat sakelar terakhir untuk setiap individu. Jadi kita akan mulai dengan plot dengan kolom dengan 4 proporsi ditumpuk. Setelah itu kita akan memiliki 16 karena setiap kategori …


1
Rasio kemungkinan log dalam peringkasan dokumen
Saya awalnya bertanya ini pada stack overflow dan dirujuk ke situs ini, jadi begini: Saya menerapkan beberapa metode yang tidak terawasi dari peringkasan dokumen berbasis pemilihan / ekstraksi konten dan saya bingung tentang apa yang disebut buku teks saya sebagai "rasio kemungkinan log". Buku Speech and Language Processing oleh Jurafsky …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.