Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados


3
Deduzir a variação do boxplot
Eu queria saber como deduzir a variação de uma variável usando um boxplot. É pelo menos possível deduzir se duas variáveis ​​têm a mesma variação observando seu boxplot?
12 variance  boxplot 

1
Se a distribuição da estatística de teste é bimodal, o valor de p significa alguma coisa?
O valor P é definido como a probabilidade de obter uma estatística de teste pelo menos tão extrema quanto a observada, assumindo que a hipótese nula é verdadeira. Em outras palavras, Mas e se a estatística-teste for bimodal na distribuição? valor-p significa alguma coisa neste contexto? Por exemplo, vou simular …

1
Clopper-Pearson para não matemáticos
Fiquei imaginando se alguém poderia me explicar a intuição além do IC de Clopper-Pearson para proporções. Até onde eu sei, todo IC inclui uma variação nele. No entanto, para proporções, mesmo que minha proporção seja 0 ou 1 (0% ou 100%), o IC de Clopper-Pearson pode ser calculado. Tentei examinar …


4
Estimativa da densidade do kernel incorporando incertezas
Ao visualizar dados unidimensionais, é comum usar a técnica de Estimativa de densidade do kernel para contabilizar larguras de compartimento escolhidas incorretamente. Quando meu conjunto de dados unidimensional tem incertezas de medição, existe uma maneira padrão de incorporar essas informações? Por exemplo (e me perdoe se meu entendimento for ingênuo), …


2
Identificação de perguntas inúteis de um questionário
Estou desenvolvendo um questionário. Para melhorar sua confiabilidade e validade, quero usar métodos estatísticos. Quero eliminar perguntas cujas respostas sejam sempre as mesmas. Isso significa que quase todos os participantes deram as mesmas respostas sobre essas perguntas. Agora minhas perguntas são: Qual é o termo técnico para essas perguntas inúteis …

4
Você pode comparar diferentes métodos de armazenamento em cluster em um conjunto de dados sem uma verdade básica por validação cruzada?
Atualmente, estou tentando analisar um conjunto de dados de documento de texto que não tem nenhuma verdade. Disseram-me que você pode usar a validação cruzada k-fold para comparar diferentes métodos de armazenamento em cluster. No entanto, os exemplos que eu vi no passado usam uma verdade básica. Existe uma maneira …

2
Estatísticas de pizza para as massas
Uma pequena entrada no site do NY Times fornece os fatos e números do consumo de pizza nos Estados Unidos. Tenho um interesse casual em como as estatísticas são usadas (ou abusadas) para fornecer informações ao público em geral, e surgiram algumas perguntas com base nas estatísticas apresentadas: Se 1 …

1
Inversão de Berry
Eu tenho um grande conjunto de dados de mercado agregados sobre as vendas de vinhos nos EUA e gostaria de estimar a demanda por determinados vinhos de alta qualidade. Estas partes de mercado foram basicamente derivadas a partir de um modelo de utilidade aleatória da forma vocêeu j t= X′j …

1
Calcular probabilidade logarítmica "à mão" para regressão não-linearizada dos mínimos quadrados generalizada (nlme)
Estou tentando calcular a probabilidade de log para uma regressão de mínimos quadrados não linear generalizada para a função f(x)=β1(1+xβ2)β3f(x)=β1(1+xβ2)β3f(x)=\frac{\beta_1}{(1+\frac x\beta_2)^{\beta_3}}otimizado pelagnlsfunção no pacote Rnlme, usando a matriz de covariância de variância gerada pelas distâncias em uma árvore filogenética assumindo movimento browniano (corBrownian(phy=tree)daapeembalagem). O seguinte código R reprodutível se ajusta …




Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.