Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados



2
Boxplots como tabelas
Estamos preparando um manuscrito e o editor nos pediu para converter uma figura com um boxplot em uma tabela "por causa do conteúdo mais exato dos dados". Enquanto eu acho que os boxplots são bastante decentes em revelar algo sobre os dados, fiquei pensando o que vocês acham disso? Você …

2
A curtose da amostra é irremediavelmente tendenciosa?
Estou observando a curtose de amostra de uma variável aleatória bastante distorcida e os resultados parecem inconsistentes. Para ilustrar o problema, observei a amostra de curtose de um RV log-normal. Em R (que estou aprendendo lentamente): library(moments); samp_size = 2048; n_trial = 4096; kvals <- rep(NA,1,n_trial); #preallocate for (iii in …

2
Como calcular o tamanho da amostra para simulação, a fim de afirmar algum nível de bondade nos meus resultados?
Eu sou um novato em estatísticas, então peço desculpas antecipadamente se estou fazendo uma pergunta ousada. Procurei respostas para minha pergunta, mas acho que muitos dos tópicos são muito específicos ou vão rapidamente além do que eu entendo atualmente. Eu tenho alguns trabalhos de simulação que incluem grandes conjuntos de …


4
Procurando uma distribuição, talvez incomum, consistente com dois pontos de dados e restrições de especialistas?
Estou tentando declarar uma distribuição anterior para uma meta-análise bayesiana. Eu tenho as seguintes informações sobre uma variável aleatória: Duas observações: 3.0, 3.6 um cientista que estuda a variável me disse que , e que valores tão altos quanto 6 têm probabilidade diferente de zero.P(X&lt;2)=P(X&gt;8)=0P(X&lt;2)=P(X&gt;8)=0P(X<2)=P(X>8)=0 Eu usei a seguinte abordagem …

3
Teste de frequências emparelhadas para independência
Espero que isso não seja muito básico ou redundante. Eu tenho procurado por orientação, mas até agora ainda não tenho certeza de como proceder. Meus dados consistem em contagens de uma estrutura específica usada em conversas entre pares de interlocutores. A hipótese que eu quero testar é a seguinte: o …

1
Quais são os benefícios da ANOVA sobre um modelo linear normal?
Estou experimentando R e descobri que uma anova () precisa de um objeto do tipo lm. Mas por que devo continuar com uma anova depois disso: &gt; x &lt;- data.frame(rand=rnorm(100), factor=sample(c("A","B","C"),100,replace=TRUE)) &gt; head(x) rand factor 1 0.9640502 B 2 -0.5038238 C 3 -1.5699734 A 4 -0.8422324 B 5 0.2489113 B …
8 r  anova 


1
Viés para o estimador de densidade do kernel (caso periódico)
O estimador de densidade do kernel é dado por onde identificou com alguma densidade desconhecida , - largura de banda,f^(x,h)=1nh∑i=1nK(x−Xih)f^(x,h)=1nh∑i=1nK(x−Xih)\hat{f}(x,h)=\frac{1}{nh}\sum_{i=1}^{n}K(\frac{x-X_{i}}{h})X1,...XnX1,...XnX_1,...X_nfffhhh ∫ ∞ - ∞ K ( x ) d x = 1 ∫ ∞ - ∞ K ( x ) x d x = 0 ∫ ∞ - ∞ K …





Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.