Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados



2
Elementos das alternativas de aprendizagem estatística
O Elements of Statistical Learning (ESL) é um livro com amplitude e profundidade fantásticas. Ele aborda o essencial dos métodos muito modernos, citando os documentos onde esses estudos originais ocorrem. No entanto, eu realmente acho a linguagem do livro muito, muito proibitiva. Eu acredito que existe uma maneira mais fácil …


1
Visualizando PCA em R: pontos de dados, vetores próprios, projeções, elipse de confiança
Eu tenho um conjunto de dados de 17 pessoas, classificando 77 declarações. Eu quero extrair componentes principais em uma matriz de correlação transposta de correlações entre pessoas (como variáveis) entre instruções (como casos). Eu sei, é estranho, chama-se Q Methodology . Quero ilustrar como o PCA funciona nesse contexto, extraindo …

1
Por que o Lucene IDF tem um +1 aparentemente adicional?
Dos documentos Lucene IDF=1+log(numDocsdocFreq+1)IDF=1+log⁡(numDocsdocFreq+1)\text{IDF} = 1 + \log\left(\frac{\text{numDocs}}{\text{docFreq}+1}\right) Em outras referências (isto é, wikipedia ), o IDF é normalmente calculado como ou para evitar mergulhar em 0.log(numDocsdocFreq)log⁡(numDocsdocFreq)\log\left(\frac{\text{numDocs}}{\text{docFreq}}\right)log(numDocsdocFreq+1)log⁡(numDocsdocFreq+1)\log\left(\frac{\text{numDocs}}{\text{docFreq}+1}\right) Também percebo que o Lucene usa vez de para calcular o TF, mas meu entendimento é que essa é apenas uma transformação preferida, …





1
Regularização e de projecção para o
Eu estou tentando entender como funciona regularização em termos de projeções em um l∗l∗l_* bola, e projeção euclidiana para o simplex. Não sei ao certo o que queremos dizer quando projetamos o vetor de peso nas bolas ou .l 2l1l1l_1l2l2l_2 Eu posso entender o conceito de programa de regularização de …

2
Por que relatar R ao quadrado?
Se R ao quadrado ajustado é superior a R ao quadrado, por que o software estatístico continua relatando o último? Existe algum tipo de situação em que um pesquisador pode preferir usar R ao quadrado em vez de R ao quadrado ajustado?

2
Como alguém usa o teorema de Bayes com um contínuo contínuo?
Se o meu prior é modelado como uma distribuição de probabilidade contínua, digamos, uma distribuição beta distorcida para refletir meu viés em relação a determinados modelos, como posso calcular a probabilidade posterior? O desafio para mim é calcular a probabilidade de um determinado modelo, uma vez que a distribuição contínua …
8 bayesian  prior 



Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.