Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

2
Data longitudinal: deret waktu, tindakan berulang, atau yang lainnya?
Dalam bahasa Inggris biasa: Saya memiliki regresi berganda atau model ANOVA tetapi variabel respons untuk setiap individu adalah fungsi waktu yang melengkung. Bagaimana saya bisa tahu mana dari variabel sisi kanan bertanggung jawab atas perbedaan signifikan dalam bentuk atau offset vertikal dari kurva? Apakah ini masalah rangkaian waktu, masalah tindakan …





4
Animasi efek mengubah lebar kernel di R
Saya memiliki beberapa data dalam R, disimpan dalam daftar. Berpikir d <- c(1,2,3,4) meskipun ini bukan data saya. Jika saya kemudian memasukkan perintah plot(density(d, kernel="gaussian", width=1)) kemudian saya mendapatkan estimasi kepadatan probabilitas kernel, di mana kernel adalah standar normal. Jika saya mengganti 1 dengan nomor lain, tentu saja gambarnya berubah. …

1
Apakah mungkin untuk mengintegrasikan
Pertama, dengan mengintegrasikan secara analitis, maksud saya, apakah ada aturan integrasi untuk menyelesaikan ini yang bertentangan dengan analisis numerik (seperti aturan trapesium, Gauss-Legendre atau Simpson)? Saya memiliki fungsi mana g ( x ; μ , σ ) = 1f( x ) = x g( x ; μ , σ)f(x)=xg(x;μ,σ)\newcommand{\rd}{\mathrm{d}}f(x) = …


1
Signifikansi koefisien regresi (GAM) ketika kemungkinan model tidak secara signifikan lebih tinggi dari nol
Saya menjalankan regresi berbasis GAM menggunakan gamls paket R dan mengasumsikan distribusi beta data nol. Saya hanya memiliki variabel penjelas tunggal dalam model saya, jadi pada dasarnya: mymodel = gamlss(response ~ input, family=BEZI). Algoritme memberi saya koefisien untuk dampak variabel penjelas ke dalam mean ( ) dan nilai-p terkait untuk …


5
Apakah regresi logistik bias ketika variabel hasil dibagi 5% - 95%?
Saya sedang membangun model kecenderungan menggunakan regresi logistik untuk klien utilitas. Kekhawatiran saya adalah bahwa dari total sampel, akun 'buruk' saya hanya 5%, dan sisanya baik. Saya memprediksi 'buruk'. Apakah hasilnya akan dibiasakan? Apa 'proporsi buruk ke baik' yang optimal untuk membangun model yang baik?


8
Ensiklopedia grafik
Saya harus membangun aplikasi web multi-pengguna yaitu tentang pengukuran lalu lintas, prognosis dll. Pada titik ini saya tahu bahwa saya akan menggunakan diagram batang dan pai. Sayangnya, tipe bagan tersebut tidak kaya dalam mengekspresikan semua data yang saya kumpulkan dan hitung. Saya mencari koleksi grafik grafik. Sangat ok jika saya …

1
Saran untuk mengidentifikasi bentuk kurva menggunakan quantreg
Saya menggunakan paket kuantreg untuk membuat model regresi menggunakan persentil ke-99 dari nilai-nilai saya dalam kumpulan data. Berdasarkan saran dari pertanyaan stackoverflow sebelumnya yang saya tanyakan, saya menggunakan struktur kode berikut. mod <- rq(y ~ log(x), data=df, tau=.99) pDF <- data.frame(x = seq(1,10000, length=1000) ) pDF <- within(pDF, y <- …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.