Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados


6
Quão problemático é controlar covariáveis ​​não independentes em um estudo observacional (ou seja, não randomizado)?
Miller e Chapman (2001) argumentam que é absolutamente inapropriado controlar covariáveis ​​não independentes relacionadas a variáveis ​​independentes e dependentes em um estudo observacional (não randomizado) - mesmo que isso seja feito rotineiramente nas ciências sociais. Quão problemático é fazê-lo? Como é a melhor maneira de lidar com esse problema? Se …




5
Referências sobre como planejar um estudo
Em uma conversa média (mediana?) Sobre estatísticas, muitas vezes você se encontra discutindo esse ou aquele método de analisar esse ou aquele tipo de dados. Na minha experiência, o desenho cuidadoso do estudo, com um pensamento especial em relação à análise estatística, é frequentemente negligenciado (trabalhando em biologia / ecologia, …

4
ANOVA com observações não independentes
Desculpe pelo histórico detalhado desta pergunta: Ocasionalmente, nas investigações do comportamento animal, um experimentador está interessado na quantidade de tempo que um sujeito passa em diferentes zonas predefinidas em um aparelho de teste. Eu sempre vi esse tipo de dados analisados ​​usando ANOVA; no entanto, nunca fui totalmente convencido da …
11 anova 

2
Como entender uma rede de crenças convolucionais profundas para classificação de áudio?
Em " Redes de crenças profundas convolucionais para o aprendizado não supervisionado e escalável de representações hierárquicas ", de Lee et. al. ( PDF ) São propostos DBNs convolucionais. O método também é avaliado para a classificação de imagens. Isso parece lógico, pois existem recursos naturais da imagem local, como …

10
Razões além da previsão para construir modelos?
Joshua Epstein escreveu um artigo intitulado "Why Model?" disponível em http://www.santafe.edu/media/workingpapers/08-09-040.pdf, no qual são apresentadas 16 razões: Explique (muito diferente de prever) Guia de coleta de dados Ilumine a dinâmica do núcleo Sugerir analogias dinâmicas Descubra novas perguntas Promover um hábito científico da mente Resultados limitados (colchetes) a intervalos plausíveis …
11 modeling 


3
Existe uma técnica padrão para depurar programas MCMC?
A depuração de programas MCMC é notoriamente difícil. A dificuldade surge devido a vários problemas, alguns dos quais são: a) Natureza cíclica do algoritmo Iterativamente, desenhamos parâmetros condicionais para todos os outros parâmetros. Portanto, se uma implementação não estiver funcionando corretamente, é difícil isolar o bug, pois o problema pode …
11 mcmc 




3
A centralização significa reduzir a covariância?
Assumindo que tenho duas variáveis ​​aleatórias não independentes e que desejo reduzir a covariância entre elas o máximo possível, sem perder muito "sinal", significa centralizar a ajuda? Eu li em algum lugar que a centralização média reduz a correlação por um fator significativo, então acho que deve fazer o mesmo …

Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.