Pertanyaan yang diberi tag «r»

Gunakan tag ini untuk setiap * pada topik * pertanyaan yang (a) melibatkan `R` baik sebagai bagian penting dari pertanyaan atau jawaban yang diharapkan, & (b) bukan * hanya * tentang cara menggunakan` R`.

1
Pengujian untuk penyebaran berlebihan dalam regresi logistik
R in Action (Kabacoff, 2011) menyarankan rutinitas berikut untuk menguji penyebaran berlebihan dalam regresi logistik: Fit regresi logistik menggunakan distribusi binomial: model_binom <- glm(Species=="versicolor" ~ Sepal.Width, family=binomial(), data=iris) Fit regresi logistik menggunakan distribusi quasibinomial: model_overdispersed <- glm(Species=="versicolor" ~ Sepal.Width, family=quasibinomial(), data=iris) Gunakan chi-squared untuk menguji penyebaran berlebihan: pchisq(summary(model_overdispersed)$dispersion * model_binom$df.residual, …

5
Regresi linier tidak pas
Saya melakukan regresi linier menggunakan fungsi Rm: x = log(errors) plot(x,y) lm.result = lm(formula = y ~ x) abline(lm.result, col="blue") # showing the "fit" in blue tapi itu tidak pas. Sayangnya saya tidak bisa memahami manualnya. Bisakah seseorang mengarahkan saya ke arah yang benar agar lebih cocok? Maksud saya, saya …
9 r  regression 

1
Plot Ketergantungan Sebagian dan peningkatan Gradien (paket GBM)
Apakah mungkin untuk memplot plot dependensi parsial untuk menampilkan probabilitas kelas dan memperkirakan efek prediktor untuk model GBM ? Sesuatu yang mirip dengan partialPlotdari randomForestpaket. Menurut artikel ini , sebagian plot dapat dilakukan dengan gbm. Terima kasih sebelumnya atas bantuan Anda.
9 r  gbm 

5
Ratakan rangkaian waktu melingkar / periodik
Saya memiliki data kecelakaan kendaraan bermotor menurut jam sehari. Seperti yang Anda harapkan, mereka tinggi di tengah hari dan puncaknya pada jam sibuk. Geom_density default ggplot2 memuluskannya dengan baik Subset dari data, untuk crash terkait drive-minum, tinggi di kedua ujung hari (malam hari dan pagi hari) dan tertinggi di ekstrem. …




5
Bootstrap data hierarkis / multilevel (resampling cluster)
Saya memproduksi skrip untuk membuat sampel bootstrap dari catsdataset (dari -MASS-paket). Mengikuti buku teks Davidson dan Hinkley [1] Saya menjalankan regresi linier sederhana dan mengadopsi prosedur dasar non-parametrik untuk bootstrap dari pengamatan awal, yaitu pemasangan kembali pasangan . Sampel asli dalam bentuk: Bwt Hwt 2.0 7.0 2.1 7.2 ... 1.9 …

3
Saat menggunakan glmnet bagaimana melaporkan nilai-p signifikansi untuk mengklaim signifikansi prediktor?
Saya memiliki sejumlah besar prediktor (lebih dari 43.000) untuk memprediksi variabel dependen yang dapat mengambil 2 nilai (0 atau 1). Jumlah pengamatan lebih dari 45.000. Sebagian besar prediktor adalah unigrams, bigrams, dan trigram kata-kata, sehingga ada tingkat kolinearitas yang tinggi di antara mereka. Ada banyak sparsity di dataset saya juga. …



1
Interval kepercayaan sekitar centroid dengan kesamaan Gower yang dimodifikasi
Saya ingin memperoleh interval kepercayaan 95% untuk centroid berdasarkan pada kesamaan Gower antara beberapa sampel mulivariat (data komunitas dari inti sedimen). Saya sejauh ini menggunakan vegan{}paket dalam R untuk mendapatkan kesamaan Gower yang dimodifikasi antara core (berdasarkan Anderson 2006; sekarang termasuk dalam R sebagai bagian dari vegdist()). Adakah yang tahu …

1
Imputasi variabel yang disensor
Saya memiliki dataset medis dengan sekitar 200 variabel. Salah satu variabel adalah penanda-bio (konsentrasi enzim tertentu). Distribusinya condong ke kanan, dan masalahnya adalah bahwa nilai di atas level tertentu disensor / terputus pada level itu. Jadi, sementara rata-rata variabel sekitar 10, nilai apa pun yang lebih besar dari 50 dicatat …

1
Bagaimana cara kerja imputasi tikus?
Saya bertanya-tanya apakah ada yang punya pengalaman menggunakan fungsi mouse, seperti yang dijelaskan dalam mouse: Imputasi Multivarian oleh Chained Equations di R (JSS 2011 45 (3))? Saya memiliki dataset dengan sejumlah variabel, masing-masing dengan berbagai tingkat data yang hilang. Pertanyaan utama saya adalah: katakanlah saya menggunakan regresi linier Bayesian untuk …

5
ANCOVA dalam R menunjukkan penyadapan yang berbeda, tetapi 95% CI tumpang tindih ... bagaimana ini mungkin?
Kami memiliki kumpulan data dengan dua kovariat dan variabel pengelompokan kategoris dan ingin tahu apakah ada perbedaan yang signifikan antara kemiringan atau intersep di antara kovariat yang terkait dengan variabel pengelompokan yang berbeda. Kami telah menggunakan anova () dan lm () untuk membandingkan kecocokan dari tiga model yang berbeda: 1) …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.