Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados


1
A variável de código na função nlm ()
Em R existe uma função nlm () que realiza uma minimização de uma função f usando o algoritmo de Newton-Raphson. Em particular, essa função gera o valor do código da variável definido da seguinte maneira: codifique um número inteiro indicando por que o processo de otimização foi encerrado. 1: o …
9 r  minimum 

1
Como um teste Tukey HSD poderia ser mais significativo que o valor P não corrigido de t.test?
Eu vim pelo post " Comparações Post-hoc Pairwise da ANOVA de duas vias " (respondendo a esta postagem ), que mostra o seguinte: dataTwoWayComparisons <- read.csv("http://www.dailyi.org/blogFiles/RTutorialSeries/dataset_ANOVA_TwoWayComparisons.csv") model1 <- aov(StressReduction~Treatment+Age, data =dataTwoWayComparisons) summary(model1) # Treatment is signif pairwise.t.test(dataTwoWayComparisons$StressReduction, dataTwoWayComparisons$Treatment, p.adj = "none") # no signif pair TukeyHSD(model1, "Treatment") # mental-medical is …




3
Como acelerar o cálculo dos efeitos fixos em um GLMM?
Estou fazendo um estudo de simulação que requer estimativas de bootstrapping obtidas de um modelo misto linear generalizado (na verdade, o produto de duas estimativas para efeitos fixos, um de um GLMM e outro de um LMM). Para fazer o estudo, seria necessário cerca de 1000 simulações com 1000 ou …
9 r  mixed-model 

2
R: atualiza um gráfico dinamicamente [fechado]
Fechadas. Esta questão está fora de tópico . No momento, não está aceitando respostas. Deseja melhorar esta pergunta? Atualize a pergunta para que ela esteja no tópico de Validação cruzada. Fechado há 7 meses . Esta é uma questão de visualização de dados. Eu tenho um banco de dados que …




1
Quais são as diferenças práticas e de interpretação entre alternativas e regressão logística?
Uma pergunta recente sobre alternativas à regressão logística em R produziu uma variedade de respostas, incluindo randomForest, gbm, rpart, bayesglm e modelos aditivos generalizados. Quais são as diferenças práticas e de interpretação entre esses métodos e a regressão logística? Que suposições elas fazem (ou não fazem) em relação à regressão …

2
Ponderar um sistema de classificação para favorecer itens com classificação alta por mais pessoas do que itens com classificação alta por menos pessoas?
Agradecemos antecipadamente por me acompanhar, não sou um estatístico de nenhum tipo e não sei como descrever o que estou imaginando; portanto, o Google não está me ajudando aqui ... Estou incluindo um sistema de classificação em um aplicativo da Web em que estou trabalhando. Cada usuário pode avaliar cada …
9 scales  rating 



Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.