Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados


1
Existe alguma abordagem significativamente robusta para conduzir uma meta-análise de rede de estudos de precisão de testes de diagnóstico?
Antecedentes: Estou trabalhando em uma revisão sistemática, incluindo várias modalidades de imagem para doença arterial coronariana, mas a rede de evidências é bastante grande, incluindo diferentes modalidades, geralmente comparada entre si em uma ampla rede. A metanálise de rede é uma abordagem estabelecida para ensaios clínicos randomizados, com várias abordagens …

2
algoritmo k-means ++ e valores discrepantes
É sabido que o algoritmo k-means sofre na presença de outliers. O k-means ++ é um método eficaz para a initalização do centro de cluster. Eu estava analisando o PPT pelos fundadores do método, Sergei Vassilvitskii e David Arthur http://theory.stanford.edu/~sergei/slides/BATS-Means.pdf (slide 28), que mostra que a inicialização do centro de …

1
Como funciona a validação cruzada no trem (circunflexo)?
Eu li várias postagens sobre o pacote de sinal de intercalação e estou especificamente interessado na função de trem . No entanto, não tenho certeza se entendi corretamente como a função do trem funciona. Para ilustrar meus pensamentos atuais, compus um exemplo rápido. Primeiro, um especifica uma grade de parâmetros. …



3
Intuição da constante de normalização bayesiana
No problema de triagem de mamografia comumente mencionado, com uma probabilidade de triagem de 80%, um valor anterior a 10% e uma taxa de falsos positivos de 50%, ou suas variantes, é fácil explicar que a probabilidade condicional posterior de uma triagem positiva indicar um câncer está presente é de …

2
Cálculo dos valores de probabilidade de emissão para o modelo de Markov oculto (HMM)
Eu sou novo no HMM e ainda estou aprendendo. Atualmente, estou usando o HMM para marcar parte do discurso. Para implementar o algoritmo viterbi, preciso de probabilidades de transição ( ai,jai,j a_{i,j} \newcommand{\Count}{\text{Count}} ) e de probabilidades de emissão ( bi(o)bi(o) b_i(o) ). Estou gerando valores para essas probabilidades usando …



2
Qual é a diferença entre o regressor estocástico e o regressor não estocástico na regressão linear?
Suponha que a especificação de regressão seja yEu=β0 0+β1 1xEu+ϵEu,yi=β0+β1xi+ϵi,y_i=\beta_0+\beta_1x_i+\epsilon_i, Não importa xEuxix_i estocástico ou não, precisaremos assumir que ϵEuϵi\epsilon_i é distribuído da mesma forma para todos Euii. No entanto, sexEuxix_ié uma variável aleatória estocástica em vez de um valor fixo; é necessário outro pressuposto, a saber, que o termo …


2
Compare o modelo MLR com o modelo
Se eu tiver razões teóricas para supor que os dados possam se encaixar em uma equação incomum, como a seguinte: YEu= (β0 0+β1 1x1 i+β2x2 i+ϵEu)β3Yi=(β0+β1x1i+β2x2i+ϵi)β3Y_i = (\beta_0 + \beta_1x_{1i} + \beta_2x_{2i} + \epsilon_i)^{\beta_3} Posso usar a regressão linear múltipla de mínimos quadrados ordinários após uma transformação para estimar os …



Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.