Statistik dan Big Data

T&J untuk orang-orang yang tertarik dalam statistik, pembelajaran mesin, analisis data, penambangan data, dan visualisasi data



3
Bagaimana membuktikan bahwa
Saya telah mencoba untuk membangun ketidaksetaraan |Ti|=∣∣Xi−X¯∣∣S≤n−1n−−√|Ti|=|Xi−X¯|S≤n−1n\left| T_i \right|=\frac{\left|X_i -\bar{X} \right|}{S} \leq\frac{n-1}{\sqrt{n}} di mana adalah mean sampel dan standar deviasi sampel, yaitu .X¯X¯\bar{X}SSSS=∑ni=1(Xi−X¯)2n−1−−−−−−−−−√S=∑i=1n(Xi−X¯)2n−1S=\sqrt{\frac{\sum_{i=1}^n \left( X_i -\bar{X} \right)^2}{n-1}} Sangat mudah untuk melihat bahwa dan seterusnya tapi ini tidak terlalu dekat dengan apa yang saya cari, juga bukan ikatan yang berguna. Saya …





1
Bagaimana meningkatkan gradien seperti gradient descent?
Saya membaca entri Wikipedia yang berguna tentang peningkatan gradien ( https://en.wikipedia.org/wiki/Gradient_boosting ), dan mencoba memahami bagaimana / mengapa kita dapat memperkirakan residu dengan langkah penurunan paling curam (juga disebut pseudo-gradient) ). Adakah yang bisa memberi saya intuisi tentang bagaimana keturunan paling curam terkait / mirip dengan residu? Bantuan sangat dihargai!



5
Apa cara yang baik untuk secara grafis mewakili sejumlah besar titik data berpasangan?
Di bidang saya, cara yang biasa untuk memplot data berpasangan adalah sebagai serangkaian segmen garis miring tipis, menimpanya dengan median dan CI median untuk dua kelompok: Namun, plot semacam ini menjadi lebih sulit dibaca karena jumlah titik data menjadi sangat besar (dalam kasus saya yang saya miliki di urutan 10.000 …

1
Menjinakkan kemiringan ... Mengapa ada begitu banyak fungsi kemiringan?
Saya berharap memiliki wawasan lebih tentang empat jenis kemiringan dari komunitas ini. Jenis yang saya rujuk disebutkan dalam http://www.inside-r.org/packages/cran/e1071/docs/skewness help page. Metode lama tidak disebutkan di halaman bantuan, tapi saya tetap memasukkannya. require(moments) require(e1071) x=rnorm(100) n=length(x) hist(x) ###############type=1 e1071::skewness(x,type=1) sqrt(n) * sum((x-mean(x))^3)/(sum((x - mean(x))^2)^(3/2)) #from e1071::skewness source m_r=function(x,r) {n=length(x); sum((x …
9 skewness 



7
Jika semua 1000 pasien uji tidak disembuhkan dengan obat, tidak bisakah kita mengatakan bahwa kita menerima hipotesis nol?
Di banyak tempat saya telah membaca bahwa kita tidak pernah dapat mengatakan bahwa kita "menerima" hipotesis nol. Sebaliknya, kita harus mengatakan bahwa kita "gagal menolak" hipotesis nol. Tetapi saya tidak melihat bagaimana itu cocok dengan contoh sederhana ini: Misalkan kita sedang menguji obat yang seharusnya menyembuhkan diabetes sepenuhnya dalam waktu …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.