Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data



5
Mengapa regresi linier menggunakan fungsi biaya berdasarkan jarak vertikal antara hipotesis dan titik input data?
Katakanlah kita memiliki input (prediktor) dan output (respons) titik data A, B, C, D, E dan kami ingin menyesuaikan garis melalui titik-titik tersebut. Ini adalah masalah sederhana untuk menggambarkan pertanyaan, tetapi dapat diperluas ke dimensi yang lebih tinggi juga. Pernyataan masalah Paling cocok saat ini atau hipotesis diwakili oleh garis …


3
Definisi keluarga suatu distribusi?
Apakah keluarga dari suatu distribusi memiliki definisi yang berbeda untuk statistik daripada di disiplin ilmu lain? Secara umum, keluarga kurva adalah seperangkat kurva, yang masing-masing diberikan oleh fungsi atau parametriisasi di mana satu atau lebih parameter bervariasi. Keluarga semacam itu digunakan, misalnya, untuk mengkarakterisasi komponen elektronik . Untuk statistik, keluarga …

4
Probabilitas bahwa Null Hipotesis Benar
Jadi, ini mungkin pertanyaan umum, tetapi saya belum pernah menemukan jawaban yang memuaskan. Bagaimana Anda menentukan probabilitas bahwa hipotesis nol itu benar (atau salah)? Katakanlah Anda memberi siswa dua versi ujian yang berbeda dan ingin melihat apakah versinya setara. Anda melakukan Uji-t dan memberikan nilai-p 0,02. Nilai p yang bagus! …


4
Bagaimana bisa terperangkap di sadel?
Saat ini saya agak bingung dengan bagaimana mini-batch gradient descent dapat terperangkap di titik sadel. Solusinya mungkin terlalu sepele sehingga saya tidak mengerti. Anda mendapatkan sampel baru setiap zaman, dan menghitung kesalahan baru berdasarkan batch baru, sehingga fungsi biaya hanya statis untuk setiap batch, yang berarti bahwa gradien juga harus …


1
Berapakah
Tentukan perkiraan lasso ß λ = arg min ß ∈ R p 1β^λ=argminβ∈Rp12n∥y−Xβ∥22+λ∥β∥1,β^λ=arg⁡minβ∈Rp12n‖y−Xβ‖22+λ‖β‖1,\hat\beta^\lambda = \arg\min_{\beta \in \mathbb{R}^p} \frac{1}{2n} \|y - X \beta\|_2^2 + \lambda \|\beta\|_1,manaithithi^{th}barisxi∈Rpxi∈Rpx_i \in \mathbb{R}^pdari matriks desainX∈Rn×pX∈Rn×pX \in \mathbb{R}^{n \times p}adalah vektor kovariat untuk menjelaskan respons stokastikyiyiy_i(untuki=1,…ni=1,…ni=1, \dots n). Kita tahu bahwa untuk λ≥1n∥XTy∥∞λ≥1n‖XTy‖∞\lambda \geq \frac{1}{n} \|X^T y\|_\infty, …



6
Apakah kita pernah menggunakan estimasi kemungkinan maksimum?
Saya bertanya-tanya apakah estimasi kemungkinan maksimum pernah digunakan dalam statistik. Kami belajar konsep itu tetapi saya bertanya-tanya kapan itu benar-benar digunakan. Jika kita mengasumsikan distribusi data, kita menemukan dua parameter, satu untuk mean dan satu untuk varians, tetapi apakah Anda benar-benar menggunakannya dalam situasi nyata? Adakah yang bisa memberi tahu …

2
Apakah ada alasan matematis untuk konvolusi dalam jaringan saraf di luar kemanfaatan?
Dalam convolutional neural networks (CNN), matriks bobot pada setiap langkah mendapatkan baris dan kolom terbalik untuk mendapatkan matriks kernel, sebelum melanjutkan dengan konvolusi. Ini dijelaskan pada serangkaian video oleh Hugo Larochelle di sini : Menghitung peta yang tersembunyi akan sesuai dengan melakukan konvolusi diskrit dengan saluran dari lapisan sebelumnya, menggunakan …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.