Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados


4
Por que os métodos de regressão Mínimos Quadrados e Máxima Verossimilhança não são equivalentes quando os erros não são normalmente distribuídos?
O título diz tudo. Entendo que os mínimos quadrados e a máxima verossimilhança fornecerão o mesmo resultado para os coeficientes de regressão se os erros do modelo forem normalmente distribuídos. Mas, o que acontece se os erros não forem normalmente distribuídos? Por que os dois métodos não são mais equivalentes?





3
Por que a probabilidade no filtro Kalman é calculada usando resultados de filtro em vez de resultados mais suaves?
Estou usando o filtro Kalman de uma maneira muito padrão. O sistema é representado pela equação de estado e a equação de observação .xt+1=Fxt+vt+1xt+1=Fxt+vt+1x_{t+1}=Fx_{t}+v_{t+1}yt=Hxt+Azt+wtyt=Hxt+Azt+wty_{t}=Hx_{t}+Az_{t}+w_{t} Os livros didáticos ensinam que, depois de aplicar o filtro Kalman e obter as "previsões um passo à frente" (ou "estimativa filtrada"), devemos usá-los para calcular …

4
Correlação entre X e XY
Se eu tenho duas variáveis ​​aleatórias independentes X e Y, qual é a correlação entre X e o produto XY? Se isso for desconhecido, eu estaria interessado em saber pelo menos o que acontece no caso específico de X e Y serem normais com média zero, se isso for mais …

5
Por que rejeitamos a hipótese nula no nível 0,05 e não no nível 0,5 (como fazemos na Classificação)
O teste de hipóteses é semelhante a um problema de classificação. Digamos, temos 2 rótulos possíveis para uma observação (assunto) - Culpado vs. Não culpado. Seja Não-Culpado a hipótese nula. Se visualizarmos o problema do ponto de vista da Classificação, treinaremos um Classificador que preverá a probabilidade do sujeito pertencer …

5
Como gerar uma sequência de
Eu sei como gerar uma seqüência ±1±1\pm 1 com média 000 . Por exemplo, no Matlab, se eu quiser gerar uma sequência ±1±1\pm 1 de comprimento 100001000010000 , é: 2*(rand(1, 10000, 1)<=.5)-1 No entanto, como gerar uma sequência ±1±1\pm 1 com média de 0.050.050.05 , ou seja, com 111 sendo …

2
A divisão dos dados em conjuntos de teste e treinamento é puramente uma coisa de "estatísticas"?
Eu sou um estudante de física estudando aprendizado de máquina / ciência de dados, por isso não pretendo que esta pergunta inicie conflitos :) No entanto, uma grande parte de qualquer programa de graduação em física é fazer laboratórios / experimentos, o que significa muitos dados processamento e análise estatística. …

5
Mostrando que o estimador OLS é equivalente em escala?
Não tenho uma definição formal de equivalência de escala, mas eis o que a Introdução à aprendizagem estatística diz sobre isso na p. 217: Os coeficientes padrão de mínimos quadrados ... são equivalentes à escala : multiplicar por uma constante simplesmente leva a uma escala das estimativas do coeficiente de …

2
Informação mútua como probabilidade
Poderia a informação mútua sobre a entropia conjunta: 0 ≤ I( X, Y)H( X, Y)≤ 10≤I(X,Y)H(X,Y)≤1 0 \leq \frac{I(X,Y)}{H(X,Y)} \leq 1 ser definido como: "A probabilidade de transmitir uma informação de X para Y"? Sinto muito por ser tão ingênuo, mas nunca estudei teoria da informação e estou apenas tentando …

1
RandomForest e pesos de classe
Pergunta em uma frase: alguém sabe como determinar bons pesos de classe para uma floresta aleatória? Explicação: Estou brincando com conjuntos de dados desequilibrados. Eu quero usar o Rpacote randomForestpara treinar um modelo em um conjunto de dados muito assimétrico, com apenas alguns exemplos positivos e muitos negativos. Eu sei, …
11 r  random-forest 


Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.