Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados

2
O que é o erro Bayes no aprendizado de máquina?
http://www.deeplearningbook.org/contents/ml.html página 116 explica o erro de bayes como abaixo O modelo ideal é um oráculo que simplesmente conhece a verdadeira distribuição de probabilidade que gera os dados. Mesmo esse modelo ainda apresentará algum erro em muitos problemas, porque ainda pode haver algum ruído na distribuição. No caso de aprendizado …

3
Métodos para solucionar o problema de falta de dados no aprendizado de máquina
Praticamente qualquer banco de dados que desejamos fazer previsões usando algoritmos de aprendizado de máquina encontrará valores ausentes para algumas das características. Existem várias abordagens para resolver esse problema, para excluir linhas que possuem valores ausentes até que sejam preenchidas com os valores médios das características. Gostaria de usar para …


3
Como o `predict.randomForest` estima probabilidades de classe?
Como o randomForestpacote estima probabilidades de classe quando uso predict(model, data, type = "prob")? Eu estava usando rangerpara treinar florestas aleatórias usando o probability = Targumento para prever probabilidades. rangerdiz na documentação que: Cultive uma floresta de probabilidade como em Malley et al. (2012). Simulei alguns dados e tentei ambos …

1
Qual método de comparação múltipla usar para um modelo mais antigo: lsmeans ou glht?
Estou analisando um conjunto de dados usando um modelo de efeitos mistos com um efeito fixo (condição) e dois efeitos aleatórios (participante devido ao design do sujeito e ao par). O modelo foi gerado com o lme4pacote: exp.model<-lmer(outcome~condition+(1|participant)+(1|pair),data=exp). Em seguida, realizei um teste de razão de verossimilhança desse modelo em …




1
Problema incidental nos parâmetros
Eu sempre luto para obter a verdadeira essência do problema incidental dos parâmetros. Li em várias ocasiões que os estimadores de efeitos fixos de modelos de dados de painel não lineares podem ser severamente influenciados por causa do "bem conhecido" problema de parâmetros incidentais. Quando peço uma explicação clara desse …



1
O que é "Expectativa de máxima verossimilhança direcionada"?
Estou tentando entender alguns trabalhos de Mark van der Laan. Ele é um estatístico teórico em Berkeley, trabalhando com problemas que se sobrepõem significativamente ao aprendizado de máquina. Um problema para mim (além da matemática profunda) é que ele muitas vezes acaba descrevendo abordagens familiares de aprendizado de máquina usando …

2
Qual é a definição de precisão Top-n?
Estou lendo um artigo científico sobre classificação de imagens. Nos resultados experimentais, eles falam da precisão entre o top 1 e o top 5, mas nunca ouvi falar do termo, nem consigo encontrá-lo usando o google. Alguém pode me dar uma definição ou me apontar para algum lugar? :)

1
Como interpretar um ACF negativo (função de autocorrelação)?
Então, plotei o ACF / PACF dos retornos de petróleo e esperava ver alguma autocorrelação positiva, mas, para minha surpresa, só recebo autocorrelação significativa negativa. Como devo interpretar o gráfico acima? Eles parecem indicar que há uma tendência para o retorno do petróleo aumentar quando diminui anteriormente e vice-versa, portanto, …


Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.