Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data


1
Topologi di mana ensemble distribusi probabilitas selesai
Saya telah berjuang sedikit dengan mendamaikan pemahaman intuitif saya tentang distribusi probabilitas dengan sifat aneh yang dimiliki hampir semua topologi pada distribusi probabilitas. Misalnya, pertimbangkan variabel acak campuran : pilih Gaussian yang berpusat pada 0 dengan varians 1, dan dengan probabilitas 1XnXnX_n , tambahkannke hasilnya. Urutan variabel acak akan konvergen …

2
Hambatan menerapkan pembelajaran yang mendalam dalam praktik
Setelah membaca banyak makalah pembelajaran yang mendalam, semacam perasaan kasar adalah bahwa ada banyak trik dalam melatih jaringan untuk mendapatkan kinerja yang lebih baik dari biasanya. Dari perspektif aplikasi industri, sangat sulit untuk mengembangkan trik semacam ini kecuali kelompok-kelompok penelitian elit di perusahaan teknologi besar, misalnya, google atau facebook. Lalu …

3
Jika dan , apakah ?
Ini bukan pekerjaan rumah. Biarkan XXX menjadi variabel acak. Jika E[X]=k∈RE[X]=k∈R\mathbb{E}[X] = k \in \mathbb{R} dan Var[X]=0Var[X]=0\text{Var}[X] = 0 , apakah itu mengikuti Pr(X=k)=1Pr(X=k)=1\Pr\left(X = k\right) = 1 ? Secara intuitif, ini tampak jelas, tetapi saya tidak yakin bagaimana saya akan membuktikannya. Saya tahu pasti bahwa dari asumsi, maka mengikuti …

2
Mengubah Statistik Pesanan
X1,...,XnX1,...,XnX_1, ... , X_nY1,...,YnY1,...,YnY_1, ..., Y_nU(0,a)U(0,a)U(0,a)Zn=nlogmax(Y(n),X(n))min(Y(n),X(n))Zn=nlog⁡max(Y(n),X(n))min(Y(n),X(n))Z_n= n\log\frac{\max(Y_{(n)},X_{(n)})}{\min(Y_{(n)},X_{(n)})}Exp(1)Exp(1)\text{Exp}(1) Saya telah memulai masalah ini dengan mengatur Kemudian akan didistribusikan sebagai dan akan didistribusikan sebagai Kepadatan dapat ditemukan dengan mudah seperti dan{X1,...,Xn,Y1,...Yn}={Z1,...,Zn}{X1,...,Xn,Y1,...Yn}={Z1,...,Zn}\{X_1,...,X_n,Y_1,...Y_n\} = \{Z_1,...,Z_n\}max(Yn,Xn)=Z(2n)max(Yn,Xn)=Z(2n)\max(Y_n,X_n)= Z_{(2n)}(za)2n(za)2n(\frac{z}{a})^{2n}min(Yn,Xn)=Z(1)min(Yn,Xn)=Z(1)\min(Y_n,X_n)= Z_{(1)}1−(1−za)2n1−(1−za)2n1 - (1 - \frac{z}{a})^{2n}fZ1(z)=(2n)(1−za)2n−11afZ1(z)=(2n)(1−za)2n−11af_{Z_{1}}(z) = (2n)(1-\frac{z}{a})^{2n-1}\frac{1}{a}fZ(2n)(z)=(2n)(za)2n−11afZ(2n)(z)=(2n)(za)2n−11af_{Z_{(2n)}}(z) = (2n)(\frac{z}{a})^{2n-1} \frac{1}{a} Di sinilah saya mengalami kesulitan mengetahui ke mana …


2
Apa bidang ilmiah yang mempelajari bagaimana orang menafsirkan ringkasan kuantitatif dan visualisasi?
Ada banyak sumber daya terkenal yang menawarkan saran tentang visualisasi data. (Eg. Tufte, Stephen Few et al , Nathan Yau .) Tetapi ke bidang apa seseorang dapat mencari jawaban atas pertanyaan seperti ini: Apakah kritik diagram lingkaran relevan dalam praktik? Apakah orang yang jauh lebih baik dalam menafsirkan panjang skala …

1
Apakah kontur
Saya berasumsi pengaturan umum regresi, yaitu, fungsi kontinu hθ:X→Rnhθ:X→Rnh_\theta:X\to \mathbb R^n dipilih dari keluarga {hθ}θ{hθ}θ\{h_\theta\}_\theta agar sesuai dengan data yang diberikan (xi,yi)∈X×Rn,i=1,…,k(xi,yi)∈X×Rn,i=1,…,k(x_i,y_i)\in X\times \mathbb R^n, i=1,\ldots, k ( XXX dapat berupa ruang seperti kubus [0,1]m[0,1]m[0,1]^m atau bahkan ruang topologi yang masuk akal) menurut beberapa kriteria alami. Apakah ada aplikasi regresi …


1
Apa yang harus menjadi program pascasarjana dalam desain sampul eksperimental?
Saya telah diminta untuk mengusulkan kursus dalam desain eksperimental untuk mahasiswa pascasarjana lanjutan dalam agronomi dan ekologi. Saya tidak pernah mengikuti kursus seperti itu, dan terkejut menemukan bahwa kursus tersebut mungkin lebih tepat dinamai "Beyond one-way ANOVA", dan itu mencakup materi yang saya pelajari dalam kursus pascasarjana tingkat lanjut tentang …


1
invariansi korelasi dengan transformasi linear:
Ini sebenarnya adalah salah satu masalah di Gujarati's Basic Econometrics edisi ke-4 (Q3.11) dan mengatakan bahwa koefisien korelasi tidak berubah sehubungan dengan perubahan asal dan skala, yaitu mana a , b , c , d adalah konstanta arbitrer.corr(aX+b,cY+d)=corr(X,Y)corr(aX+b,cY+d)=corr(X,Y)\text{corr}(aX+b, cY+d) = \text{corr}(X,Y)aaabbbcccddd Tetapi pertanyaan utama saya adalah sebagai berikut: Biarkan dan …


3
Membagi dua variabel acak diskrit?
Mari adalah variabel acak diskrit mengambil nilai-nilai di N . Saya ingin membagi dua variabel ini, yaitu, untuk menemukan variabel acak Y seperti:XXXNN\mathbb{N}YYY X= Y+ Y∗X=Y+Y∗X = Y + Y^* di mana adalah salinan Y yang independen .Y∗Y∗Y^*YYY Saya menyebut proses ini sebagai membagi dua ; ini adalah terminologi yang …

2
Pemilihan fitur untuk masalah pengelompokan
Saya mencoba untuk membuat kelompok kumpulan data yang berbeda menggunakan algoritma yang tidak diawasi (clustering). Masalahnya adalah saya memiliki banyak fitur (~ 500) dan sejumlah kecil case (200-300). Sejauh ini saya hanya melakukan masalah klasifikasi yang selalu saya beri label data sebagai set pelatihan. Di sana saya menggunakan beberapa kriteria …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.