Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados

2
Quando usar a técnica bootstrap vs. bayesiana?
Eu tenho um problema de análise de decisão bastante complicado que envolve testes de confiabilidade e a abordagem lógica (para mim) parece envolver o uso do MCMC para apoiar uma análise bayesiana. No entanto, foi sugerido que seria mais apropriado usar uma abordagem de inicialização. Alguém poderia sugerir uma referência …

3
Quais são as distribuições no quadrante k-dimensional positivo com matriz de covariância parametrizável?
Após a pergunta de zzk sobre seu problema com simulações negativas, estou me perguntando quais são as famílias parametrizadas de distribuições no quadrante k-dimensional positivo, R k +, para o qual a matriz de covariância Σ pode ser definida.Rk+R+k\mathbb{R}_+^kΣΣ\Sigma Como discutido com ZZK , partindo de uma distribuição em Rk+R+k\mathbb{R}_+^k …


2
Modelo Bayesiano Hierárquico (?)
Por favor, peço desculpas pelo meu massacre da linguagem estatística :) Encontrei aqui algumas perguntas relacionadas à publicidade e taxas de cliques. Mas nenhum deles me ajudou muito com minha compreensão da minha situação hierárquica. Há uma pergunta relacionada. São essas representações equivalentes do mesmo modelo bayesiano hierárquico? , mas …

2
Analisando coeficientes de regressão logística
Aqui está uma lista de coeficientes de regressão logística (o primeiro é um intercepto) -1059.61966694592 -1.23890500515482 -8.57185269220438 -7.50413155570413 0 1.03152408392552 1.19874787949191 -4.88083274930613 -5.77172565873336 -1.00610998453393 Acho estranho como a interceptação é tão baixa e tenho um coeficiente igual a 0. Não tenho muita certeza de como interpretaria isso. O 0 indica …

1
Pacotes Python para trabalhar com modelos de mistura gaussianos (GMMs)
Parece haver várias opções disponíveis para trabalhar com GMMs (Gaussian Mixture Models) em Python. À primeira vista, existem pelo menos: PyMix - http://www.pymix.org/pymix/index.php Ferramentas para modelagem de mistura PyEM - http://www.ar.media.kyoto-u.ac.jp/members/david/softwares/em/, que faz parte da caixa de ferramentas Scipy e parece se concentrar na atualização dos GMMs : Agora conhecida …




1
Passos para descobrir uma distribuição posterior quando pode ser simples o suficiente para ter uma forma analítica?
Isso também foi solicitado na Ciência da Computação. Estou tentando calcular uma estimativa bayesiana de alguns coeficientes para uma regressão automática, com 11 amostras de dados: Yi=μ+α⋅Yi−1+ϵiYi=μ+α⋅Yi−1+ϵi Y_{i} = \mu + \alpha\cdot{}Y_{i-1} + \epsilon_{i} ondeϵiϵi\epsilon_{i} é normal de média 0 e variânciaσ2eσe2\sigma_{e}^{2} A distribuição antes de o vector(μ,α)t(μ,α)t(\mu, \alpha)^{t} é …

1
Um conjunto de treinamento escasso afeta adversamente um SVM?
Estou tentando classificar mensagens em diferentes categorias usando um SVM. Eu compilei uma lista de palavras / símbolos desejáveis ​​do conjunto de treinamento. Para cada vetor, que representa uma mensagem, defino a linha correspondente como 1se a palavra estiver presente: "corpus" é: [mary, pequena, cordeiro, estrela, brilho] primeira mensagem: "mary …



2
Ajustando o valor-p para análise sequencial adaptativa (para teste do qui-quadrado)?
Desejo saber que literatura estatística é relevante para o seguinte problema, e talvez até uma idéia de como resolvê-lo. Imagine o seguinte problema: Temos 4 tratamentos possíveis para algumas doenças. Para verificar qual o melhor tratamento, realizamos um teste especial. No julgamento, começamos por não ter sujeitos e, um por …


Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.