Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados



1
Distribuição da diferença de duas variáveis ​​uniformes independentes, truncadas em 0
Seja e Y duas variáveis ​​aleatórias independentes com a mesma distribuição uniforme U ( 0 , 1 ) com densidadeXXXYYYU(0,1)U(0,1)U(0,1) se 0 ≤ x ≤ 1 (e 0 em outro lugar).f(x)=1f(x)=1f(x)=10≤x≤10≤x≤10≤x≤1000 Seja uma variável aleatória real definida por:ZZZ se X > Y (e 0 em outro lugar).Z=X−YZ=X−YZ=X-YX>YX>YX>Y000 Derivar a distribuição …

1
Então, como você incluiria estimativas bayesianas em uma meta-análise?
Inspirado por esta pergunta e pelo "Problema 3" em particular: As distribuições posteriores são um pouco mais difíceis de incorporar em uma meta-análise, a menos que uma descrição paramétrica e freqüentista da distribuição tenha sido fornecida. Recentemente, estive pensando bastante em incorporar a meta-análise a um modelo bayesiano - principalmente …


3
Como agrupar variáveis ​​longitudinais?
Eu tenho um monte de variáveis ​​que contêm dados longitudinais do dia 0 ao dia 7. Estou procurando uma abordagem de cluster apropriada que possa agrupar essas variáveis ​​longitudinais (não casos) em grupos diferentes. Tentei analisar esses dados separadamente por tempo, mas o resultado foi bastante difícil de ser razoavelmente …
10 clustering 


2
Como fazer análise ROC em R com um modelo de Cox
Eu criei alguns modelos de regressão de Cox e gostaria de ver o desempenho desses modelos e pensei que talvez uma curva ROC ou uma estatística c possa ser útil semelhante ao uso deste artigo: JN Armitage e JH van der Meulen, “Identificando comorbidades em pacientes cirúrgicos usando dados administrativos …
10 r  survival  roc 


2
Teste de hipótese e distância total da variação vs. divergência Kullback-Leibler
Na minha pesquisa, encontrei o seguinte problema geral: tenho duas distribuições e no mesmo domínio e um grande (mas finito) número de amostras dessas distribuições. As amostras são distribuídas de forma independente e idêntica a partir de uma dessas duas distribuições (embora as distribuições possam estar relacionadas: por exemplo, pode …

1
Boas práticas ao fazer previsões de séries temporais
Trabalho há meses na previsão de carga de curto prazo e no uso de dados climáticos / climáticos para melhorar a precisão. Eu tenho formação em ciência da computação e, por esse motivo, estou tentando não cometer grandes erros e comparações injustas trabalhando com ferramentas de estatística como os modelos …


2
Potência para teste t de duas amostras
Estou tentando entender o cálculo de potência para o caso do teste t de duas amostras independentes (não assumindo variações iguais, então usei Satterthwaite). Aqui está um diagrama que eu encontrei para ajudar a entender o processo: Então, assumi que, considerando o seguinte sobre as duas populações e os tamanhos …



Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.