Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados

5
Por que
eu suponho que P(A|B)=P(A|B,C)∗P(C)+P(A|B,¬C)∗P(¬C)P(A|B)=P(A|B,C)∗P(C)+P(A|B,¬C)∗P(¬C)P(A|B) = P(A | B,C) * P(C) + P(A|B,\neg C) * P(\neg C) está correto, enquanto P(A|B)=P(A|B,C)+P(A|B,¬C)P(A|B)=P(A|B,C)+P(A|B,¬C)P(A|B) = P(A | B,C) + P(A|B,\neg C) está incorreto. No entanto, tenho uma "intuição" sobre a mais recente, ou seja, você considera a probabilidade P (A | B) dividindo dois …







5
O que significa variação combinada "realmente"?
Eu sou um noob em estatística, então vocês poderiam me ajudar aqui. Minha pergunta é a seguinte: O que realmente significa variação combinada ? Quando procuro uma fórmula para variação combinada na Internet, encontro muita literatura usando a seguinte fórmula (por exemplo, aqui: http://math.tntech.edu/ISR/Mathematical_Statistics/Introduction_to_Statistical_Tests/thispage/newnode19.html ): S2p=S21(n1−1)+S22(n2−1)n1+n2−2Sp2=S12(n1−1)+S22(n2−1)n1+n2−2\begin{equation} \label{eq:stupidpooledvar} \displaystyle S^2_p = …
15 variance  mean  pooling 

1
Agrupando gráficos de calibração após imputação múltipla
Gostaria de obter conselhos sobre como agrupar os gráficos / estatísticas de calibração após imputação múltipla. No cenário do desenvolvimento de modelos estatísticos para prever um evento futuro (por exemplo, usando dados de registros hospitalares para prever a sobrevivência ou eventos após a alta hospitalar), pode-se imaginar que há algumas …




5
Erro de aproximação do intervalo de confiança para a média quando
Seja {Xi}ni=1{Xi}i=1n\{X_i\}_{i=1}^n uma família de variáveis ​​aleatórias iid assumindo valores em [0,1][0,1][0,1] , tendo uma média e variância . Um intervalo de confiança simples para a média, usando sempre que for conhecido, é dado por μμ\muσ2σ2\sigma^2σσ\sigmaP(|X¯−μ|>ε)≤σ2nε2≤1nε2(1).P(|X¯−μ|>ε)≤σ2nε2≤1nε2(1). P( | \bar X - \mu| > \varepsilon) \le \frac{\sigma^2}{n\varepsilon^2} \le\frac{1}{n \varepsilon^2} \qquad (1). …

2
Boa precisão apesar do alto valor de perda
Durante o treinamento de um classificador binário de rede neural simples, recebo um alto valor de perda usando entropia cruzada. Apesar disso, o valor da precisão no conjunto de validação é bastante bom. Isso tem algum significado? Não existe uma correlação estrita entre perda e precisão? Tenho no treinamento e …

1
Qual é a diferença entre PCA regular e PCA probabilístico?
Eu sei que o PCA regular não segue o modelo probabilístico dos dados observados. Então, qual é a diferença básica entre PCA e PPCA ? No PPCA, o modelo de variável latente contém, por exemplo, variáveis ​​observadas yyy , latentes (variáveis ​​não observadas ) e uma matriz que não precisa …
15 pca 

Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.