Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados


3
Por que
Nesta página central do AP Variações Aleatórias vs. Variáveis ​​Algébricas , o autor Peter Flanagan-Hyde faz uma distinção entre variáveis ​​algébricas e aleatórias. Em parte ele diz x+x=2xx+x=2xx + x = 2x , mas X+X≠2XX+X≠2XX + X \neq 2X - de fato, é o subtítulo do artigo. Qual é a …

3
Fazendo o MCMC: use jags / stan ou implemente-o eu mesmo
Eu sou novo na pesquisa estatística bayesiana. Ouvi de pesquisadores que pesquisadores bayesianos implementam melhor o MCMC por eles mesmos do que usando ferramentas como JAGS / Stan. Posso perguntar qual é o benefício de implementar o algoritmo MCMC por si mesmo (em linguagens "não muito rápidas" como R), exceto …
13 bayesian  mcmc 


5
Por que estudar regressão linear?
Dadas duas variáveis ​​aleatórias ξξ\xi e ηη\eta , podemos calcular seu "coeficiente de correlação" ccc e formar a linha de melhor ajuste entre essas duas variáveis ​​aleatórias. Minha pergunta é por que? 1) Existem variáveis ​​aleatórias, ξξ\xi e ηη\eta que são dependentes da pior maneira possível, ou seja, ξ=f(η)ξ=f(η)\xi = …
13 regression 



2
Qual é o benefício da distribuição normal truncada na inicialização de pesos em uma rede neural?
Ao inicializar pesos de conexão em uma rede neural de feedforward, é importante inicializá-los aleatoriamente para evitar simetrias que o algoritmo de aprendizado não seria capaz de quebrar. A recomendação que vi em vários locais (por exemplo, no tutorial MNIST do TensorFlow ) é usar a distribuição normal truncada usando …


1
Cálculo de gênios de Steve Hsu na China
Em seu blog , o físico Steve Hsu escreveu o seguinte: Supondo uma distribuição normal, existem apenas cerca de 10.000 pessoas nos EUA que atuam no + 4SD e um número semelhante na Europa, portanto essa é uma população bastante selecionada (aproximadamente, as poucas centenas de idosos do ensino médio …




1
Por que a média aritmética é menor que a média da distribuição em uma distribuição log-normal?
Então, eu tenho um processo aleatório gerando variáveis ​​aleatórias normalmente distribuídas em log XXX. Aqui está a função de densidade de probabilidade correspondente: Eu queria estimar a distribuição de alguns momentos dessa distribuição original, digamos o primeiro momento: a média aritmética. Para isso, desenhei 100 variáveis ​​aleatórias 10.000 vezes, para …


Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.