Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados

1
Dados correlacionados de alta dimensão e principais recursos / covariáveis ​​descobertos; teste de múltiplas hipóteses?
Eu tenho um conjunto de dados com cerca de 5.000 recursos / covariáveis ​​frequentemente correlacionados e uma resposta binária. Os dados foram dados para mim, eu não os coletei. Uso Lasso e aumento de gradiente para construir modelos. Eu uso a validação cruzada iterada e aninhada. Relato os maiores coeficientes …


1
Ajude a interpretar os dados de contagem GLMM usando lme4 glmer e glmer.nb - Binomial negativo versus Poisson
Eu tenho algumas perguntas sobre especificação e interpretação de GLMMs. Definitivamente, três perguntas são estatísticas e duas são mais específicas sobre R. Estou publicando aqui porque, em última análise, acho que a questão é a interpretação dos resultados do GLMM. Atualmente, estou tentando ajustar um GLMM. Estou usando os dados …


1
Por que o intervalo credível bayesiano nessa regressão polinomial é enviesado, enquanto o intervalo de confiança está correto?
Considere o gráfico abaixo no qual simulei os dados da seguinte maneira. Observamos um resultado binário para o qual a verdadeira probabilidade de ser 1 é indicada pela linha preta. A relação funcional entre uma covariável e é 3 polinomial ordem com ligação logístico (por isso é não linear num …

1
GAM adaptável suaviza em mgcv
O livro de Simon Wood sobre GAMs e seu pacote R associado mgcv são altamente detalhados e informativos quando se trata da teoria do GAM e do ajuste de modelos a dados reais e simulados. Para suavizações 1D, não há realmente muito com o que se preocupar, exceto decidir se …
9 r  mgcv 

2
GAMM com dados inflados a zero
É possível ajustar um GAMM (Modelo Misto de Aditivo Generalizado) para dados inflados com zero em R? Caso contrário, é possível ajustar um GAM (Modelo Aditivo Generalizado) para dados inflados com zero com uma distribuição binomial negativa ou quase Poisson em R? (Encontrei funções COZIGAM :: zigam e mgcv: ziP …


1
Podemos concluir a partir de que são independentes?
Bem, não podemos, por exemplo, https://en.wikipedia.org/wiki/Subindependence para um contra-exemplo interessante. Mas a verdadeira questão é: existe alguma maneira de fortalecer a condição para que a independência se siga? Por exemplo, existe algum conjunto de funções modo que se para todos os , segue a independência? E quão grande deve ser …

2
Investigando diferenças entre populações
Digamos que temos uma amostra de duas populações: Ae B. Vamos supor que essas populações sejam feitas de indivíduos e optamos por descrevê-los em termos de recursos. Alguns desses recursos são categóricos (por exemplo, eles dirigem para o trabalho?) E outros são numéricos (por exemplo, sua altura). Vamos chamar esses …

4
Regularização: por que multiplicar por 1 / 2m?
Nas notas da terceira semana de aula da aula Coursera Machine Learning de Andrew Ng , um termo é adicionado à função de custo para implementar a regularização: J+( θ ) = J( θ ) + λ2 m∑j = 1nθ2jJ+(θ)=J(θ)+λ2m∑j=1nθj2J^+(\theta) = J(\theta) + \frac{\lambda}{2m} \sum_{j=1}^n \theta_j^2 As notas da palestra …




1
Valores-P e princípio da verossimilhança
Esta pergunta surgiu na aula: se usarmos valores-p para avaliar hipóteses em um experimento, que parte do Princípio da Probabilidade não estamos obedecendo: Suficiência ou Condicionalidade ? Minha intuição seria dizer Suficiência , uma vez que calcular um valor-p baseia-se em resultados não observados de um experimento, e Suficiência parece …

Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.