Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados




3
Detectando Clusters em uma Sequência Binária
Eu tenho uma sequência binária como 11111011011110101100000000000100101011011111101111100000000000011010100000010000000011101111 Onde clusters de 1s são seguidos por um número maior de zeros, como na figura abaixo (preto significa 1): Eu gostaria de aplicar uma técnica (preferencialmente em R ou em Python) em que eu possa detectar automaticamente esses clusters de 1s e produzir …

2
Simular caminhos de amostra de previsão do modelo tbats
Usando o excelente pacote de previsões de Rob Hyndman, deparei-me com a necessidade de não apenas ter intervalos de previsão, mas simular vários caminhos futuros, considerando observações passadas de uma série temporal com sazonalidades complexas. Há algo para séries temporais menos complexas com apenas uma ou duas sazonalidades (simulate.ets () …


2
R como uma alternativa ao SAS para grandes dados
Eu sei que R não é particularmente útil para analisar grandes conjuntos de dados, uma vez que R carrega todos os dados na memória, enquanto algo como o SAS faz análise sequencial. Dito isto, existem pacotes como o bigmemory que permitem aos usuários realizar análises de grandes dados (análise estatística) …
8 r  sas  large-data 

2
Para que distribuição é uma média aparada, o estimador de probabilidade máxima?
A média da amostra é o estimador de probabilidade máxima de para uma distribuição normal . A mediana da amostra é o estimador de probabilidade máxima de para uma distribuição de Laplace (também chamada de distribuição exponencial dupla).μμ\muNormal(μ,σ)Normal(μ,σ)\text{Normal}(\mu,\sigma)mmm Laplace(m,s)Laplace(m,s)\text{Laplace}(m,s) Existe uma distribuição com um parâmetro de localização para o qual …


1
Aplicando Recência na Regressão Logística
Existem conceitos ou teorias estatísticas sobre como medir efetivamente a atualidade para onde eventos recentes ganham mais peso que os mais antigos. Estou criando um modelo de regressão logística e gostaria de aplicar um ajuste a vários fatores com base na recorrência dos eventos. ... ou, é puramente minha decisão …



1
Trabalho de casa: Análise Bayesiana de Dados: Priores em ambos os parâmetros binomiais
O seguinte é um problema de Bayesian Data Analysis 2nd ed , p. 97. Andrew Gelman não incluiu sua solução no guia em seu site e isso me deixou louco o dia todo. Literalmente o dia todo. yyyNNNθθ\thetaNNNPr(N|μ)=Poisson(μ)Pr(N|μ)=Poisson(μ)\Pr(N|\mu) = Poisson(\mu)μμ\mu(N,θ)(N,θ)(N, \theta)λ=μθλ=μθ\lambda=\mu\thetaNNNp(λ,θ)∝1/λp(λ,θ)∝1/λp(\lambda, \theta) \varpropto 1/\lambda . A parte do problema em …



Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.