Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados

3
O que poderia ser uma definição prática e clara para uma "família de hipóteses" (com relação à taxa de erro familiar)?
Ao tentar avaliar o que constitui uma família de hipóteses em um experimento / projeto / análise, descobri "similar em propósito" e "semelhante em conteúdo", fornecidas como diretrizes para a delimitação de famílias, mas elas deixam bastante em aberto a interpretação ( para dizer o mínimo). Parece claro que, no …


2
Posso confiar em uma regressão se as variáveis ​​forem correlacionadas automaticamente?
Ambas as variáveis ​​(dependentes e independentes) mostram efeitos de autocorrelação. Os dados são séries temporais e estacionários Quando executo, os resíduos da regressão parecem não estar correlacionados. Minha estatística de Durbin-Watson é maior que o valor crítico superior; portanto, há uma evidência de que os termos de erro não estão …


1
Visualizando Proporções Sucessivas
Estou tentando visualizar alguns dados do consumidor, que tem quatro categorias. Os usuários podem alternar entre diferentes categorias. Gostaria de visualizar os últimos três ou quatro comutadores para cada indivíduo. Então começamos com um gráfico com uma coluna com 4 proporções empilhadas. Depois disso, teríamos 16, conforme cada categoria se …


2
Validação cruzada para modelos mistos?
Meu colega e eu estamos ajustando uma variedade de modelos de efeitos mistos lineares e não-lineares em R. Somos solicitados a realizar validação cruzada nos modelos ajustados, para que se possa verificar se os efeitos observados são relativamente generalizáveis. Normalmente, essa é uma tarefa trivial, mas, no nosso caso, precisamos …

3
Um problema de estimativa no rastreamento por GPS
Problema: considere dois carros (considerados objetos pontuais), chamados líder e seguidor F , ambos equipados com dispositivos GPS que se comunicam. O objetivo de F é seguir L o mais próximo possível, pois este se move arbitrariamente no plano. Dado que todos os dispositivos GPS têm uma distribuição de erro …



1
Cálculo manual do PACF
Estou tentando replicar o cálculo que o SAS e o SPSS fazem para a função de autocorrelação parcial (PACF). No SAS, é produzido através do Proc Arima. Os valores PACF são os coeficientes de uma auto-regressão da série de interesse em valores defasados ​​da série. Minha variável de interesse é …

4
Encontre intervalos de densidade de probabilidade
Eu tenho o vetor x <- c(1,2,3,4,5,5,5,6,6,6,6, 7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7, 7,7,7,7,7,7,7,7,8,8,8,8,9,9,9,10) (meu vetor real tem um comprimento> 10.000) e gostaria de encontrar os intervalos em que estão os 90% da densidade. É quantile(x, probs=c(0.05,0.95), type=5)o mais apropriado ou existe outra maneira?
9 r 



1
Computando a confiabilidade entre avaliadores em R com número variável de classificações?
A Wikipedia sugere que uma maneira de analisar a confiabilidade entre avaliadores é usar um modelo de efeitos aleatórios para calcular a correlação intraclasse . O exemplo da correlação intraclasse fala sobre olhar para σ2ασ2α+σ2ϵσα2σα2+σϵ2\frac{\sigma_\alpha^2}{\sigma_\alpha^2+\sigma_\epsilon^2} de um modelo Yeu j= μ + αEu+ ϵeu jYEuj=μ+αEu+ϵEujY_{ij} = \mu + \alpha_i + …

Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.