Pertanyaan yang diberi tag «data-visualization»

Membangun representasi data yang bermakna dan bermanfaat. (Jika pertanyaan Anda hanya tentang cara mendapatkan perangkat lunak tertentu untuk menghasilkan efek tertentu, kemungkinan besar tidak pada topik di sini.)


4
Model Sejarah Acara Diskrit-Waktu (Bertahan Hidup) di R
Saya mencoba menyesuaikan model waktu-diskrit dalam R, tapi saya tidak yakin bagaimana melakukannya. Saya telah membaca bahwa Anda dapat mengatur variabel dependen dalam baris yang berbeda, satu untuk setiap pengamatan waktu, dan menggunakan glmfungsi dengan logit atau tautan cloglog. Dalam hal ini, saya memiliki tiga kolom: ID, Event(1 atau 0, …
10 r  survival  pca  sas  matlab  neural-networks  r  logistic  spatial  spatial-interaction-model  r  time-series  econometrics  var  statistical-significance  t-test  cross-validation  sample-size  r  regression  optimization  least-squares  constrained-regression  nonparametric  ordinal-data  wilcoxon-signed-rank  references  neural-networks  jags  bugs  hierarchical-bayesian  gaussian-mixture  r  regression  svm  predictive-models  libsvm  scikit-learn  probability  self-study  stata  sample-size  spss  wilcoxon-mann-whitney  survey  ordinal-data  likert  group-differences  r  regression  anova  mathematical-statistics  normal-distribution  random-generation  truncation  repeated-measures  variance  variability  distributions  random-generation  uniform  regression  r  generalized-linear-model  goodness-of-fit  data-visualization  r  time-series  arima  autoregressive  confidence-interval  r  time-series  arima  autocorrelation  seasonality  hypothesis-testing  bayesian  frequentist  uninformative-prior  correlation  matlab  cross-correlation 


1
Nilai variabel tersembunyi regresi linear R "bernilai"
Ini hanya contoh yang saya temui beberapa kali, jadi saya tidak punya data sampel. Menjalankan model regresi linier di R: a.lm = lm(Y ~ x1 + x2) x1adalah variabel kontinu. x2bersifat kategorikal dan memiliki tiga nilai, mis. "Rendah", "Sedang" dan "Tinggi". Namun output yang diberikan oleh R akan menjadi seperti: …
10 r  regression  categorical-data  regression-coefficients  categorical-encoding  machine-learning  random-forest  anova  spss  r  self-study  bootstrap  monte-carlo  r  multiple-regression  partitioning  neural-networks  normalization  machine-learning  svm  kernel-trick  self-study  survival  cox-model  repeated-measures  survey  likert  correlation  variance  sampling  meta-analysis  anova  independence  sample  assumptions  bayesian  covariance  r  regression  time-series  mathematical-statistics  graphical-model  machine-learning  linear-model  kernel-trick  linear-algebra  self-study  moments  function  correlation  spss  probability  confidence-interval  sampling  mean  population  r  generalized-linear-model  prediction  offset  data-visualization  clustering  sas  cart  binning  sas  logistic  causality  regression  self-study  standard-error  r  distributions  r  regression  time-series  multiple-regression  python  chi-squared  independence  sample  clustering  data-mining  rapidminer  probability  stochastic-processes  clustering  binary-data  dimensionality-reduction  svd  correspondence-analysis  data-visualization  excel  c#  hypothesis-testing  econometrics  survey  rating  composite  regression  least-squares  mcmc  markov-process  kullback-leibler  convergence  predictive-models  r  regression  anova  confidence-interval  survival  cox-model  hazard  normal-distribution  autoregressive  mixed-model  r  mixed-model  sas  hypothesis-testing  mediation  interaction 

1
Mengapa kita menghitung nilai Informasi?
Saya memiliki data dengan variabel kategori dan variabel kontinu, tetapi adalah kebutuhan untuk menemukan nilai informasi dalam analisis data penjelasan. Berikan saja alasan mengapa kami menghitung nilai informasi untuk setiap variabel pada awal analisis data dan apa yang akan menjadi titik cutoff dari INFORMASI NILAI untuk mengurus analisis

3
Cara membuat diagram barplot di mana bar berdampingan di R
Terkunci . Pertanyaan ini dan jawabannya dikunci karena pertanyaannya di luar topik tetapi memiliki signifikansi historis. Saat ini tidak menerima jawaban atau interaksi baru. Saya ingin membuat bardiagram untuk data ini dalam R (baca dari file CVS): Metric Experiment_NameA MetricB Just_X 2 10 Just_X_and_Y 3 20 untuk memiliki diagram berikut: …

1
Model pembelajaran dalam mana yang dapat mengklasifikasikan kategori yang tidak eksklusif satu sama lain
Contoh: Saya memiliki kalimat dalam deskripsi pekerjaan: "Java senior engineer in UK". Saya ingin menggunakan model pembelajaran yang mendalam untuk memperkirakannya sebagai 2 kategori: English dan IT jobs. Jika saya menggunakan model klasifikasi tradisional, hanya dapat memprediksi 1 label dengan softmaxfungsi di lapisan terakhir. Dengan demikian, saya dapat menggunakan 2 …
9 machine-learning  deep-learning  natural-language  tensorflow  sampling  distance  non-independent  application  regression  machine-learning  logistic  mixed-model  control-group  crossover  r  multivariate-analysis  ecology  procrustes-analysis  vegan  regression  hypothesis-testing  interpretation  chi-squared  bootstrap  r  bioinformatics  bayesian  exponential  beta-distribution  bernoulli-distribution  conjugate-prior  distributions  bayesian  prior  beta-distribution  covariance  naive-bayes  smoothing  laplace-smoothing  distributions  data-visualization  regression  probit  penalized  estimation  unbiased-estimator  fisher-information  unbalanced-classes  bayesian  model-selection  aic  multiple-regression  cross-validation  regression-coefficients  nonlinear-regression  standardization  naive-bayes  trend  machine-learning  clustering  unsupervised-learning  wilcoxon-mann-whitney  z-score  econometrics  generalized-moments  method-of-moments  machine-learning  conv-neural-network  image-processing  ocr  machine-learning  neural-networks  conv-neural-network  tensorflow  r  logistic  scoring-rules  probability  self-study  pdf  cdf  classification  svm  resampling  forecasting  rms  volatility-forecasting  diebold-mariano  neural-networks  prediction-interval  uncertainty 


1
Apa yang ditunjukkan oleh bentuk seperti plot PCA?
Dalam mereka kertas autoencoders untuk klasifikasi teks Hinton dan Salakhutdinov menunjukkan plot yang dihasilkan oleh 2-dimensi LSA (yang berkaitan erat dengan PCA): . Menerapkan PCA ke data dimensi sedikit tinggi yang benar-benar berbeda, saya memperoleh plot yang mirip: (kecuali dalam hal ini saya benar-benar ingin tahu apakah ada struktur internal). …

2
Apa bidang ilmiah yang mempelajari bagaimana orang menafsirkan ringkasan kuantitatif dan visualisasi?
Ada banyak sumber daya terkenal yang menawarkan saran tentang visualisasi data. (Eg. Tufte, Stephen Few et al , Nathan Yau .) Tetapi ke bidang apa seseorang dapat mencari jawaban atas pertanyaan seperti ini: Apakah kritik diagram lingkaran relevan dalam praktik? Apakah orang yang jauh lebih baik dalam menafsirkan panjang skala …

5
Apa cara yang baik untuk secara grafis mewakili sejumlah besar titik data berpasangan?
Di bidang saya, cara yang biasa untuk memplot data berpasangan adalah sebagai serangkaian segmen garis miring tipis, menimpanya dengan median dan CI median untuk dua kelompok: Namun, plot semacam ini menjadi lebih sulit dibaca karena jumlah titik data menjadi sangat besar (dalam kasus saya yang saya miliki di urutan 10.000 …

2
Bagaimana cara mewakili penggunaan kWh per tahun terhadap suhu rata-rata?
Hanya untuk bersenang-senang, saya ingin memetakan konsumsi daya rumah tangga bulanan saya dari tahun ke tahun. Namun, saya ingin memasukkan beberapa referensi untuk suhu bulanan sehingga saya dapat menentukan apakah rumah atau perilaku saya membaik, memburuk, atau tetap stabil dalam hal penggunaan kWh. Data yang saya kerjakan: +----------+--------+-----------+----------------+----------+-----------+------------+ | Month …

3
Fungsi transfer dalam model peramalan - interpretasi
Saya sibuk dengan pemodelan ARIMA ditambah dengan variabel eksogen untuk tujuan pemodelan promosi dan saya sulit menjelaskannya kepada pengguna bisnis. Dalam beberapa kasus paket perangkat lunak berakhir dengan fungsi transfer sederhana yaitu parameter * Variabel Eksogen. Dalam hal ini interpretasinya mudah yaitu kegiatan promosi X (diwakili oleh variabel biner eksogen) …

2
Bagaimana grafik "Amerika Serikat Reddit" ini dibuat?
Di bawah ini adalah grafik dari hal. Dataclysm milik Christian Rudder , meskipun dibuat oleh James Dowdell. Ini menggambarkan hubungan antara berbagai 200 subreddit teratas, yang merupakan bidang yang diminati reddit.com di mana pengguna dapat mengirimkan tautan, komentar, dan suara. Ini mirip dengan tag di situs ini. Ukuran wilayah subreddit …


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.