Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data


2
Menafsirkan output langkah dalam R
Dalam R, stepperintah ini dimaksudkan untuk membantu Anda memilih variabel input ke model Anda, bukan? Berikut ini berasal dari example(step)#-> swiss& step(lm1) > step(lm1) Start: AIC=190.69 Fertility ~ Agriculture + Examination + Education + Catholic + Infant.Mortality Df Sum of Sq RSS AIC - Examination 1 53.03 2158.1 189.86 <none> …

1
Bagaimana cara mengelompokkan U-Matrix secara otomatis?
Setelah melatih peta yang dapat diatur sendiri, seseorang dapat menghitung U-Matriks . Ada beberapa alat untuk memvisualisasikannya secara manual dan mengidentifikasi cluster, tetapi saya bertanya-tanya apakah ada algoritma untuk melakukan proses ini secara otomatis (yaitu tidak ada manusia yang melihat gambar untuk mengidentifikasi cluster). Apakah ada cara untuk melakukan ini? …



1
Menafsirkan dekomposisi deret waktu menggunakan TBATS dari paket perkiraan R.
Saya ingin menguraikan data deret waktu berikut ke dalam komponen musiman, tren, dan residual. Data tersebut adalah Profil Energi Pendinginan setiap jam dari sebuah bangunan komersial: TotalCoolingForDecompose.ts <- ts(TotalCoolingForDecompose, start=c(2012,3,18), freq=8765.81) plot(TotalCoolingForDecompose.ts) Oleh karena itu ada efek musiman harian dan mingguan yang didasarkan pada saran dari: Bagaimana cara menguraikan rangkaian …


2
Solusi untuk Masalah Tank Jerman
Apakah ada bukti matematis formal bahwa solusi untuk Masalah Tank Jerman adalah fungsi dari hanya parameter k (jumlah sampel yang diamati) dan m (nilai maksimum di antara sampel yang diamati)? Dengan kata lain, dapatkah seseorang membuktikan bahwa solusinya tidak tergantung pada nilai sampel lain selain nilai maksimum?

1
Apakah MLE
Misalkan (X,Y)(X,Y)(X,Y) memiliki pdf fθ(x,y)=e−(x/θ+θy)1x>0,y>0,θ>0fθ(x,y)=e−(x/θ+θy)1x>0,y>0,θ>0f_{\theta}(x,y)=e^{-(x/\theta+\theta y)}\mathbf1_{x>0,y>0}\quad,\,\theta>0 Karenanya kepadatan sampel (X,Y)=(Xi,Yi)1≤i≤n(X,Y)=(Xi,Yi)1≤i≤n(\mathbf X,\mathbf Y)=(X_i,Y_i)_{1\le i\le n} diambil dari populasi ini gθ(x,y)=∏i=1nfθ(xi,yi)=exp[−∑i=1n(xiθ+θyi)]1x1,…,xn,y1,…,yn>0=exp[−nx¯θ−θny¯]1x(1),y(1)>0,θ>0gθ(x,y)=∏i=1nfθ(xi,yi)=exp⁡[−∑i=1n(xiθ+θyi)]1x1,…,xn,y1,…,yn>0=exp⁡[−nx¯θ−θny¯]1x(1),y(1)>0,θ>0\begin{align} g_{\theta}(\mathbf x,\mathbf y)&=\prod_{i=1}^n f_{\theta}(x_i,y_i) \\&=\exp\left[{-\sum_{i=1}^n\left(\frac{x_i}{\theta}+\theta y_i\right)}\right]\mathbf1_{x_1,\ldots,x_n,y_1,\ldots,y_n>0} \\&=\exp\left[-\frac{n\bar x}{\theta}-\theta n\bar y\right]\mathbf1_{x_{(1)},y_{(1)}>0}\quad,\,\theta>0 \end{align} Estimasi kemungkinan maksimum θθ\theta dapat diturunkan sebagai θ^( X , Y ) = X¯¯¯¯Y¯¯¯¯---√θ^(X,Y)=X¯Y¯\hat\theta(\mathbf X,\mathbf Y)=\sqrt\frac{\overline X}{\overline Y} Saya ingin …

1
Tindakan berulang anova: lm vs lmer
Saya mencoba mereproduksi beberapa uji interaksi antara keduanya lmdan lmerpada tindakan berulang (2x2x2). Alasan saya ingin membandingkan kedua metode ini adalah karena GLM SPSS untuk tindakan berulang menghasilkan hasil yang sama persis dengan lmpendekatan yang disajikan di sini, jadi pada akhirnya saya ingin membandingkan SPSS vs R-lmer. Sejauh ini, saya …



2
Mengapa lemma Neyman-Pearson lemma dan bukan teorema?
Ini lebih merupakan pertanyaan sejarah daripada pertanyaan teknis. Mengapa lemma Neyman-Pearson adalah Lemma dan bukan Teorema? tautan ke wiki: https://en.wikipedia.org/wiki/Neyman%E2%80%93Pearson_lemma NB : Pertanyaannya bukan tentang apa itu lemma dan bagaimana lemma digunakan untuk membuktikan teorema, tetapi tentang sejarah lemma Neyman-Pearson. Apakah ini digunakan untuk membuktikan teorema dan kemudian ternyata lebih …

4
Apakah "proyeksi acak" secara ketat bukan proyeksi?
Implementasi saat ini dari algoritma Proyeksi Acak mengurangi dimensi sampel data dengan memetakannya dari hingga menggunakan matriks proyeksi matriks yang entri-entrinya dari distribusi yang sesuai (misalnya dari ):RdRd\mathbb R^dRkRk\mathbb R^kd×kd×kd\times kRRRN(0,1)N(0,1)\mathcal N(0,1) x′=1k√xRx′=1kxRx^\prime = \frac{1}{\sqrt k}xR Secara mudah, ada bukti teoritis yang menunjukkan bahwa pemetaan ini kira-kira mempertahankan jarak berpasangan. …

2
Apa yang terjadi dengan Fuzzy Logic?
Logika fuzzy tampak seperti bidang aktif dalam pembelajaran mesin dan penggalian data ketika saya masih di sekolah menengah (awal 2000-an). Sistem inferensi fuzzy, fuzzy c-means, versi fuzzy dari berbagai jaringan saraf dan dukungan arsitektur mesin vektor semua diajarkan dalam kursus pascasarjana dan dibahas dalam konferensi. Sejak saya mulai memperhatikan ML …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.