Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data

2
Bagaimana cara menunjukkan bahwa matriks ini adalah semidefinit positif?
Membiarkan K=(K11K21K12K22)K=(K11K12K21K22)K=\begin{pmatrix} K_{11} & K_{12}\\ K_{21} & K_{22} \end{pmatrix} menjadi positif semidefinite nyata matriks simetris (PSD) dengan . Lalu, untuk ,K12=KT21K12=K21TK_{12}=K_{21}^T|r|≤1|r|≤1|r| \le 1 K∗=(K11rK21rK12K22)K∗=(K11rK12rK21K22)K^*=\begin{pmatrix} K_{11} & rK_{12}\\ rK_{21} & K_{22} \end{pmatrix} juga merupakan matriks PSD. Matriks dan adalah dan menunjukkan matriks transpos. Bagaimana saya membuktikan ini?KKKK∗K∗K^*2×22×22 \times 2KT21K21TK_{21}^T


1
Apa konsekuensi dari peristiwa langka dalam regresi logistik?
Saya tahu bahwa ukuran sampel mempengaruhi daya dalam metode statistik apa pun. Ada aturan praktis untuk berapa banyak sampel yang dibutuhkan regresi untuk setiap prediktor. Saya juga sering mendengar bahwa jumlah sampel dalam setiap kategori dalam variabel dependen dari regresi logistik adalah penting. Kenapa ini? Apa konsekuensi aktual dari model …


3
Pembelajaran Penguatan pada Data Historis
Saya telah bekerja mempelajari kebijakan komunikasi optimal untuk pelanggan (pemberitahuan mana yang harus dikirim, berapa yang harus dikirim dan kapan harus dikirim). Saya memiliki data historis pemberitahuan sebelumnya yang dikirim (dengan cap waktu) dan kinerjanya. Sedang mencoba menerapkan RL untuk masalah ini untuk mempelajari kebijakan yang optimal. Namun, satu kendala …

1
Apa perbedaan antara berbagai jenis residu dalam analisis survival (regresi Cox)?
Saya cukup baru dalam analisis survival. Saya disarankan untuk mencari dan mempelajari residu Schoenfeld sebagai bagian dari model diagnosis untuk melihat apakah asumsi bahaya proporsional telah dipenuhi. Sementara melihat ini, saya telah melihat referensi untuk berbagai jenis residu termasuk: Cox-Snell Penyimpangan Martingale Skor Schoenfeld Apa perbedaan antara residu ini dan …

1
Apa sajakah kelemahan dari optimasi parameter hyper bayesian?
Saya cukup baru dalam pembelajaran mesin dan statistik, tetapi saya bertanya-tanya mengapa optimasi bayesian tidak disebut lebih sering online ketika belajar mesin belajar untuk mengoptimalkan algoritma hyperparameters Anda? Misalnya menggunakan kerangka kerja seperti ini: https://github.com/fmfn/BayesianOptimization Apakah optimasi bayesian dari hiperparameter Anda memiliki batasan atau kelemahan utama atas teknik seperti pencarian …


1
Bagaimana membuktikan apakah rata-rata fungsi kepadatan probabilitas ada
Diketahui bahwa diberikan variabel acak bernilai nyata XXX dengan pdf fff, rata-rata XXX (jika ada) ditemukan oleh E[X]=∫Rxf(x)dx.E[X]=∫Rxf(x)dx.\begin{equation} \mathbb{E}[X]=\int_{\mathbb{R}}x\,f(x)\,\mathrm{d}x\,. \end{equation} Pertanyaan umum: Sekarang, jika seseorang tidak dapat menyelesaikan integral di atas dalam bentuk tertutup tetapi ingin hanya menentukan apakah mean ada dan terbatas, adakah cara untuk membuktikannya? Apakah ada (mungkin) …

1
Apakah Faktor Penentu Kovarian dan Matriks Korelasi dan / atau Kebalikannya Memiliki Interpretasi yang Bermanfaat?
Sambil belajar menghitung kovarian dan matriks korelasi dan inversinya dalam VB dan T-SQL beberapa tahun yang lalu, saya belajar bahwa berbagai entri memiliki sifat menarik yang dapat membuatnya berguna dalam skenario penambangan data yang tepat. Salah satu contoh yang jelas adalah adanya varian pada diagonal matriks kovarians; beberapa contoh yang …

4
Dapatkah regresi berbasis pohon berkinerja lebih buruk daripada regresi linier biasa?
Hai, saya sedang mempelajari teknik regresi. Data saya memiliki 15 fitur dan 60 juta contoh (tugas regresi). Ketika saya mencoba banyak teknik regresi yang dikenal (gradient boosted tree, Decision tree regression, AdaBoostRegressor dll) regresi linier dilakukan dengan sangat baik. Skor hampir terbaik di antara algoritma tersebut. Apa yang bisa menjadi …

1
Apa prediksi padat dalam pembelajaran mendalam?
Saya menggunakan model TensorFlow yang telah dilatih sebelumnya dari Jaringan Neural Konvolusional. https://github.com/tensorflow/models/blob/master/slim/nets/resnet_v2.py#L130 Saya menemukan kalimat berikut: Namun, untuk tugas prediksi yang padat kami menyarankan agar seseorang menggunakan input dengan dimensi spasial yang merupakan kelipatan dari 32 ditambah 1, misalnya, [321, 321]. Adakah yang tahu apa prediksi padat dalam literatur …

2
Apa penyebab masalah perbandingan multipel?
Saya memahami intuisi di balik MCP tetapi saya mengalami kesulitan menentukan dengan tepat penyebabnya, apa yang harus dihindari, atau setidaknya diperhitungkan. Dalam definisi yang paling blak-blakan, saya setuju bahwa jika saya mengambil data apa pun dan menerapkan pendekatan brute force untuknya mencoba setiap hipotesis nol yang mungkin, saya akhirnya akan …


1
Diferensiasi Lintas Entropi
Saya telah mencoba membuat program untuk melatih Neural Networks di komputer saya. Untuk Jaringan yang dimaksud, saya telah memutuskan untuk menggunakan fungsi Cross Entropy Error: E=−∑jtjlnojE=−∑jtjln⁡ojE = -\sum_jt_j\ln o_j Di mana adalah output target untuk Neuron , dan adalah output dari neuron itu, mencoba untuk memprediksi .tjtjt_jjjjojojo_jtjtjt_j Saya ingin tahu …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.