Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados

3
Como usar R gbm com distribution = “adaboost”?
A documentação afirma que R gbm com distribution = "adaboost" pode ser usado para o problema de classificação 0-1. Considere o seguinte fragmento de código: gbm_algorithm <- gbm(y ~ ., data = train_dataset, distribution = "adaboost", n.trees = 5000) gbm_predicted <- predict(gbm_algorithm, test_dataset, n.trees = 5000) Pode ser encontrado na …
9 r  gbm 

1
Como comparar eventos observados x eventos esperados?
Suponha que eu tenha uma amostra de frequências de 4 eventos possíveis: Event1 - 5 E2 - 1 E3 - 0 E4 - 12 e tenho as probabilidades esperadas de meus eventos ocorrerem: p1 - 0.2 p2 - 0.1 p3 - 0.1 p4 - 0.6 Com a soma das frequências …
9 r  statistical-significance  chi-squared  multivariate-analysis  exponential  joint-distribution  statistical-significance  self-study  standard-deviation  probability  normal-distribution  spss  interpretation  assumptions  cox-model  reporting  cox-model  statistical-significance  reliability  method-comparison  classification  boosting  ensemble  adaboost  confidence-interval  cross-validation  prediction  prediction-interval  regression  machine-learning  svm  regularization  regression  sampling  survey  probit  matlab  feature-selection  information-theory  mutual-information  time-series  forecasting  simulation  classification  boosting  ensemble  adaboost  normal-distribution  multivariate-analysis  covariance  gini  clustering  text-mining  distance-functions  information-retrieval  similarities  regression  logistic  stata  group-differences  r  anova  confidence-interval  repeated-measures  r  logistic  lme4-nlme  inference  fiducial  kalman-filter  classification  discriminant-analysis  linear-algebra  computing  statistical-significance  time-series  panel-data  missing-data  uncertainty  probability  multivariate-analysis  r  classification  spss  k-means  discriminant-analysis  poisson-distribution  average  r  random-forest  importance  probability  conditional-probability  distributions  standard-deviation  time-series  machine-learning  online  forecasting  r  pca  dataset  data-visualization  bayes  distributions  mathematical-statistics  degrees-of-freedom 



1
"Como
Pergunta curta: por que isso é verdade? Pergunta longa: Muito simplesmente, estou tentando descobrir o que justifica essa primeira equação. O autor do livro que estou lendo (contexto aqui, se você quiser, mas não é necessário), afirma o seguinte: Devido à suposição de quase gaussianidade, podemos escrever: p0(ξ)=Aϕ ( ξ)e …







2
Alguns dos meus preditores estão em escalas muito diferentes - preciso transformá-los antes de ajustar um modelo de regressão linear?
Eu gostaria de executar a regressão linear sobre um conjunto de dados multidimensional. Existem diferenças entre diferentes dimensões em termos de magnitude de ordem. Por exemplo, a dimensão 1 geralmente possui um intervalo de valores de [0, 1] e a dimensão 2 possui um intervalo de valores de [0, 1000]. …


1
Modelando uma tendência espacial por regressão com as coordenadas como preditores
Pretendo incluir coordenadas como covariáveis ​​na equação de regressão para ajustar a tendência espacial que existe nos dados. Depois disso, quero testar os resíduos na autocorrelação espacial em variação aleatória. Eu tenho várias perguntas: Devo realizar a regressão linear em que apenas variáveis independentes são e coordenadas e, em seguida, …


Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.