Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados

4
Kurtosis de distribuição inventada
Dê uma olhada na imagem abaixo. A linha azul indica o pdf normal padrão. Supõe-se que a zona vermelha seja igual à soma das áreas cinzentas (desculpe pelo desenho horrível). Será que podemos criar uma nova distribuição com pico mais alto deslocando as zonas cinzas para o topo (zona vermelha) …

2
Causa de singularidade na matriz para regressão quantílica
Estou realizando regressões quantílicas em R usando o pacote quantreg. Meu conjunto de dados inclui 12.328 observações, variando de 0,12 a 330. Os pontos no tempo para meus dados não são exatamente contínuos; todos os dados se enquadram em uma das dezenas de posições que variam de 73 a 397. …
8 r  regression 


2
Função de probabilidade de dados truncados
Estou com problemas para entender o conceito e a derivação da probabilidade de dados truncados. Por exemplo, se eu quiser encontrar a função de probabilidade com base em uma amostra de uma distribuição, mas ao retirar uma amostra da distribuição, observo os valores truncados (onde há um corte de , …




2
Modelo de fatoração de matriz para sistemas de recomendação como determinar o número de recursos latentes?
Estou tentando projetar uma técnica de fatoração matricial para um sistema simples de recomendação de itens de usuário. Eu tenho 2 perguntas sobre isso. Primeiro, em uma implementação simples que vi da técnica de fatoração matricial para recomendação de filme, o autor acabou de inicializar as dimensões dos recursos latentes, …

1
Probabilidades de regressão logística
Eu construí um modelo de regressão logística em R e, embora o resultado pareça ser satisfatório até certo ponto, há uma pergunta que não consigo resolver. Não tenho certeza se minha abordagem está correta. Eu sei que o objetivo geral do modelo logístico é prever a probabilidade de sucesso de …



2
Quando n aumenta, o valor t aumenta em um teste de hipótese, mas a tabela t é exatamente o oposto. Por quê?
A fórmula para em um teste de hipótese é dada por: t = ˉ X - μtttt = X¯- μσ^/ n--√.t=X¯−μσ^/n. t=\frac{\bar{X}-\mu}{\hat \sigma/\sqrt{n}}. Quando aumenta, o valor aumenta de acordo com a fórmula acima. Mas por que o valor crítico diminui na tabela medida que (que é uma função de …

2
Combinação de valores p de diferentes testes estatísticos aplicados nos mesmos dados
Embora o título da pergunta pareça trivial, gostaria de explicar que não é tão trivial no sentido de que é diferente da questão de aplicar o mesmo teste estatístico em conjuntos de dados semelhantes para testar contra uma hipótese nula total (meta-análise, por exemplo, usando o método de Fisher para …

2
Exemplos para uma classe SVM em R
Estou tentando fazer o SVM de uma classe em R. Eu tenho tentado usar o pacote e1071 / ksvm kernlab. Mas não tenho certeza se estou fazendo isso corretamente. Existe algum exemplo de trabalho para SVM de uma classe em R? Além disso, Estou dando uma grande matriz de preditores …
8 r  svm 

1
Visualização de dados longitudinais com resultado binário
Para dados longitudinais com resultado numérico, posso usar gráficos de espaguete para visualizar os dados. Por exemplo, algo assim (extraído do site Estatísticas da UCLA): tolerance<-read.table("http://www.ats.ucla.edu/stat/r/faq/tolpp.csv",sep=",", header=T) head(tolerance, n=10) interaction.plot(tolerance$time, tolerance$id, tolerance$tolerance, xlab="time", ylab="Tolerance", legend=F) Mas e se meu resultado for binário 0 ou 1? Por exemplo, nos dados "ohio" …

Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.