Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

1
Plot dan interpretasikan regresi logistik ordinal
Saya memiliki variabel dependen ordinal, kemudahan, yang berkisar dari 1 (tidak mudah) hingga 5 (sangat mudah). Peningkatan nilai-nilai faktor independen terkait dengan peningkatan peringkat kemudahan. Dua variabel independen saya ( condAdan condB) adalah kategorikal, masing-masing dengan 2 level, dan 2 ( abilityA, abilityB) kontinu. Saya menggunakan paket ordinal dalam R, …

5
Apa yang dimaksud "kemungkinan hanya didefinisikan hingga konstanta proporsionalitas multiplikasi" dalam praktiknya?
Saya membaca makalah di mana penulis memimpin dari diskusi estimasi kemungkinan maksimum untuk Teorema Bayes, seolah-olah sebagai pengantar untuk pemula. Sebagai contoh kemungkinan, mereka mulai dengan distribusi binomial: p(x|n,θ)=(nx)θx(1−θ)n−xp(x|n,θ)=(nx)θx(1−θ)n−xp(x|n,\theta) = \binom{n}{x}\theta^x(1-\theta)^{n-x} dan kemudian login kedua sisi ℓ(θ|x,n)=xln(θ)+(n−x)ln(1−θ)ℓ(θ|x,n)=xln⁡(θ)+(n−x)ln⁡(1−θ)\ell(\theta|x, n) = x \ln (\theta) + (n-x)\ln (1-\theta) dengan alasan bahwa: "Karena kemungkinan …

2
Bagaimana Anda "mengendalikan" faktor / variabel?
Menurut pemahaman saya, "Kontrol" dapat memiliki dua arti dalam statistik. Kelompok kontrol: Dalam percobaan, tidak ada perawatan yang diberikan kepada anggota kelompok kontrol. Contoh: Placebo vs Obat: Anda memberikan obat ke satu kelompok dan bukan ke kelompok lain (kontrol), yang juga disebut sebagai "percobaan terkontrol". Kontrol untuk variabel: Teknik memisahkan …




2
Apa cara yang paling bebas rasa sakit untuk menyesuaikan kurva pertumbuhan logistik di R?
Ini tidak mudah bagi Google seperti beberapa hal lain, untuk lebih jelasnya, saya tidak berbicara tentang regresi logistik dalam arti menggunakan regresi untuk memprediksi variabel kategori. Saya berbicara tentang menyesuaikan kurva pertumbuhan logistik dengan poin data yang diberikan. Untuk lebih spesifik, adalah tahun tertentu dari 1958 hingga 2012 dan adalah …

1
Bahaya baseline Cox
Katakanlah saya memiliki kumpulan data "kateter ginjal". Saya mencoba memodelkan kurva bertahan hidup menggunakan model Cox. Jika saya mempertimbangkan model Cox: saya perlu perkiraan bahaya awal. Dengan menggunakan fungsi paket R bawaan , saya dapat dengan mudah melakukannya seperti ini:h ( t , Z) = h0exp( b′Z) ,h(t,Z)=h0exp⁡(b′Z),h(t,Z) = h_0 …
19 r  cox-model  hazard 

2
Tutorial untuk rekayasa fitur
Seperti diketahui oleh semua, rekayasa fitur sangat penting untuk pembelajaran mesin, namun saya menemukan beberapa bahan yang terkait dengan bidang ini. Saya berpartisipasi dalam beberapa kompetisi di Kaggle dan percaya bahwa fitur yang baik bahkan mungkin lebih penting daripada klasifikasi yang baik dalam beberapa kasus. Adakah yang tahu tutorial tentang …

1
Bagaimana cara mengatur argumen xreg di auto.arima () di R? [Tutup]
Tutup. Pertanyaan ini di luar topik . Saat ini tidak menerima jawaban. Ingin meningkatkan pertanyaan ini? Perbarui pertanyaan sehingga sesuai topik untuk Cross Validated. Ditutup 6 tahun yang lalu . Saya sedang mengerjakan proyek kecil dengan satu seri waktu yang mengukur data kunjungan pelanggan (setiap hari). Kovariat saya adalah variabel …

1
Korelasi yang diperoleh untuk variabel acak lognormal
Pertimbangkan variabel acak lognormal dan dengan , dan .X1X1X_1X2X2X_2catatan( X1) ∼ N( 0 , 1 )log⁡(X1)∼N(0,1)\log(X_1)\sim \mathcal{N}(0,1)catatan( X2) ∼ N( 0 , σ2)log⁡(X2)∼N(0,σ2)\log(X_2)\sim \mathcal{N}(0,\sigma^2) Saya mencoba menghitung dan untuk \ rho (X_1, X_2) . Satu langkah dalam solusi yang saya miliki adalah:ρmaksρmax\rho_{\max}ρminρmin\rho_{\min}ρ ( X1, X2)ρ(X1,X2)\rho (X_1,X_2) ρmaks= ρ ( exp( …

2
Mengapa regresi tentang varians?
Saya membaca catatan ini . Pada halaman 2, ini menyatakan: "Berapa banyak varian dalam data dijelaskan oleh model regresi yang diberikan?" "Interpretasi regresi adalah tentang rata-rata koefisien; kesimpulannya adalah tentang varians mereka." Saya telah membaca tentang pernyataan seperti itu berkali-kali, mengapa kita peduli tentang "seberapa banyak perbedaan dalam data dijelaskan …

2
Apa itu entropi empiris?
Dalam definisi set bersama (dalam "Elemen Teori Informasi", bab 7.6, hal. 195), kita menggunakan np(xn)=∏ n i = 1 p(xi)- 1ncatatanp ( xn)-1ncatatan⁡hal(xn)-\frac{1}{n} \log{p(x^n)} sebagai entropi empiris dari sebuah -berikutnya dengan . Saya tidak pernah menemukan terminologi ini sebelumnya. Itu tidak didefinisikan secara eksplisit di mana saja sesuai dengan indeks …

2
Apa definisi distribusi simetris?
Apa definisi distribusi simetris? Seseorang mengatakan kepada saya bahwa variabel acak berasal dari distribusi simetris jika dan hanya jika dan memiliki distribusi yang sama. Tetapi saya pikir definisi ini sebagian benar. Karena saya dapat menyajikan contoh tandingan dan . Jelas, ia memiliki distribusi simetris, tetapi dan memiliki distribusi yang berbeda! …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.