Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados


4
A aposta de Blackwell
Eu li sobre o paradoxo da aposta de Blackwell no armário da Futility . Aqui está o resumo: você dois envelopes, e . Os envelopes contêm uma quantia aleatória de dinheiro, mas você não sabe nada sobre a distribuição do dinheiro. Você abre um, verifica quanto dinheiro há ( ) …


2
Significado real da elipse de confiança
Lendo sobre o verdadeiro significado da elipse de 95% de confiança, costumo encontrar duas explicações: A elipse que contém 95% dos dados Não é o acima, mas a elipse que explica a variação dos dados. Não sei se entendi direito, mas eles parecem significar que, se um novo ponto de …

2
Que fração das experiências repetidas terá um tamanho de efeito dentro do intervalo de confiança de 95% da primeira experiência?
Vamos nos ater a uma situação ideal com amostragem aleatória, populações gaussianas, variações iguais, sem hackers P etc. Etapa 1. Você realiza uma experiência, digamos, comparando duas médias de amostra e calcula um intervalo de confiança de 95% para a diferença entre as duas médias da população. Etapa 2. Você …






1
Alguma vez haverá um Tribble infeliz em Oz?
Aqui está um problema divertido trazido a mim por um aluno. Embora tenha sido originalmente redigido em termos de balas mutuamente aniquiladoras disparadas a intervalos regulares por uma arma, achei que você poderia desfrutar de uma apresentação mais pacífica. No mundo infinito e plano de Oz, a Estrada dos Tijolos …


4
detectar número de picos na gravação de áudio
Estou tentando descobrir como detectar o número de sílabas em um corpus de gravações de áudio. Eu acho que um bom proxy pode ter picos no arquivo wave. Aqui está o que eu tentei com um arquivo meu falando em inglês (meu caso de uso real é em kiswahili). A …

3
A suposição de erros normais implica que Y também é normal?
A menos que eu esteja enganado, em um modelo linear, presume-se que a distribuição da resposta tenha um componente sistemático e um componente aleatório. O termo de erro captura o componente aleatório. Portanto, se assumirmos que o termo de erro é normalmente distribuído, isso não implica que a resposta também …

1
Como lidar com a super-dispersão na regressão de Poisson: quase-probabilidade, GLM binomial negativo ou efeito aleatório no nível do sujeito?
Encontrei três propostas para lidar com a super-dispersão em uma variável de resposta de Poisson e um modelo inicial de efeitos fixos: Use um modelo quase; Use GLM binomial negativo; Use um modelo misto com um efeito aleatório no nível de assunto. Mas qual escolher, e por quê? Existe algum …

Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.