Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados


2
A descida do gradiente pode ser aplicada a funções não convexas?
Estou apenas aprendendo sobre otimização e tendo problemas para entender a diferença entre otimização convexa e não convexa. Pelo meu entendimento, uma função convexa é aquela em que "o segmento de linha entre dois pontos no gráfico da função está acima ou no gráfico". Nesse caso, um algoritmo de descida …



2
REML ou ML para comparar dois modelos de efeitos mistos com diferentes efeitos fixos, mas com o mesmo efeito aleatório?
Histórico: Nota: Meu conjunto de dados e código-r estão incluídos abaixo do texto Desejo usar o AIC para comparar dois modelos de efeitos mistos gerados usando o pacote lme4 em R. Cada modelo tem um efeito fixo e um efeito aleatório. O efeito fixo difere entre os modelos, mas o …

5
Será -squared ter um -valor?
Parece que me confundi tentando entender se um valor de quartzo também tem um valor- .rrrppp Pelo que entendi, na correlação linear com um conjunto de pontos de dados pode ter um valor que varia de a e esse valor, seja o que for, pode ter um valor- que mostra …

5
Variabilidade nos resultados do cv.glmnet
Estou usando cv.glmnetpara encontrar preditores. A configuração que eu uso é a seguinte: lassoResults<-cv.glmnet(x=countDiffs,y=responseDiffs,alpha=1,nfolds=cvfold) bestlambda<-lassoResults$lambda.min results<-predict(lassoResults,s=bestlambda,type="coefficients") choicePred<-rownames(results)[which(results !=0)] Garantir que os resultados sejam reprodutíveis set.seed(1). Os resultados são altamente variáveis. Corri exatamente o mesmo código 100 para ver como os resultados eram variáveis. Nas corridas 98/100, sempre havia um preditor …



4
"Amostra aleatória" e "variável aleatória iid" são sinônimos?
Tenho enfrentado dificuldades para entender o significado de "amostra aleatória" e "variável aleatória iid". Tentei descobrir o significado de várias fontes, mas fiquei cada vez mais confuso. Estou postando aqui o que tentei e conheci: A Probabilidade e Estatísticas de Degroot diz: Amostras aleatórias / iid / tamanho da amostra: …



2
Calcular coeficientes em uma regressão logística com R
Em uma regressão linear múltipla, é possível descobrir o coeficiente com a seguinte fórmula. b=(X′X)−1(X′)Yb=(X′X)−1(X′)Yb = (X'X)^{-1}(X')Y beta = solve(t(X) %*% X) %*% (t(X) %*% Y) ; beta Por exemplo: > y <- c(9.3, 4.8, 8.9, 6.5, 4.2, 6.2, 7.4, 6, 7.6, 6.1) > x0 <- c(1,1,1,1,1,1,1,1,1,1) > x1 <- …


3
O que significa “normalização” e como verificar se uma amostra ou uma distribuição está normalizada?
Eu tenho uma pergunta na qual ele pede para verificar se a distribuição Uniform ( ) está normalizada.Uniform(a,b)Uniform(a,b){\rm Uniform}(a,b) Por um lado, o que significa que qualquer distribuição seja normalizada? E segundo, como vamos verificar se uma distribuição é normalizada ou não? Entendo que ao calcular obtemos dados normalizados , …

Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.