Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados


4
Clusters que podem ser causados ​​por meios K
Eu recebi a seguinte pergunta como uma pergunta de teste para o meu exame e simplesmente não consigo entender a resposta. Um gráfico de dispersão dos dados projetados nos dois primeiros componentes principais é mostrado abaixo. Desejamos examinar se existe alguma estrutura de grupo no conjunto de dados. Para fazer …



4
Escolhendo um modelo de regressão
Como alguém pode objetivamente (ler "algoritmicamente") selecionar um modelo apropriado para fazer uma regressão linear de mínimos quadrados simples com duas variáveis? Por exemplo, digamos que os dados pareçam mostrar uma tendência quadrática e é gerada uma parábola que se ajusta muito bem aos dados. Como justificamos fazer dessa regressão? …

1
Interpretando um gráfico residual binned na regressão logística
Estou realizando uma regressão logística com variáveis ​​independentes e 123 , 996 observações. Estou avaliando o ajuste do modelo para determinar se os dados atendem às premissas do modelo e produziram o seguinte gráfico de resíduos binados usando o pacote:242424123 , 996123,996123,996arm R Obviamente, existem alguns sinais ruins nesse gráfico: …

2
Teorema da expectativa total para processos de Poisson
Eu tenho dois processos Poisson independentes e com taxas de chegada e , respectivamente. Agora, o tempo esperado para a chegada do próximo item para o processo mesclado deve ser .AAABBBλAλA\lambda_AλBλB\lambda_B1λA+λB1λA+λB\frac {1}{\lambda_A+\lambda_B} Supondo que seja a hora de chegada do próximo item do processo combinado e ou como os eventos …


1
Detecção de outlier em distribuições beta
Digamos que eu tenha uma grande amostra de valores em . Gostaria de estimar a distribuição subjacente . A maioria das amostras vem dessa distribuição assumida , enquanto o restante são discrepantes que eu gostaria de ignorar na estimativa de e .Beta ( α , β ) Beta ( α …



1
Censura de intervalo
Corri uma curva de sobrevivência do censor de intervalo com R, JMP e SAS. Ambos me deram gráficos idênticos, mas as tabelas diferiram um pouco. Essa é a tabela que o JMP me deu. Start Time End Time Survival Failure SurvStdErr . 14.0000 1.0000 0.0000 0.0000 16.0000 21.0000 0.5000 0.5000 …

1
Quando / por que a tendência central de uma simulação de reamostragem difere acentuadamente do valor observado?
Deve-se sempre esperar que a tendência central (isto é, média e / ou mediana) de uma amostra com bootstrap seja semelhante ao valor observado? Nesse caso em particular, tenho respostas distribuídas exponencialmente para sujeitos em duas condições (não realizei o experimento, só tenho os dados). Fui encarregado de ajustar o …



Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.