Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados

4
Como se verifica a causa?
Depois de mostrarmos que duas quantidades estão correlacionadas, como inferimos que o relacionamento é causal? E, além disso, qual causa o quê? Agora, em teoria, pode-se usar uma "atribuição aleatória" (seja qual for a palavra certa), para quebrar qualquer vínculo de acidente que possa existir entre duas variáveis. Mas, em …

2
Selecionando nós para um GAM
Ao selecionar um número apropriado de nós para um GAM, convém levar em consideração o número de dados e incrementos no eixo x. E se tivermos 100 incrementos no eixo x com 1000 pontos de dados em cada incremento. A informação aqui diz: Se eles não forem fornecidos, os nós …
9 r  gam  splines 

1
Derivadas de gradiente e vetor: vetor de linha ou coluna?
Muitas referências (incluindo a wikipedia e http://www.atmos.washington.edu/~dennis/MatrixCalculus.pdf e http://michael.orlitzky.com/articles/the_derivative_of_a_quadratic_form.php ) definem a derivada de um função por um vetor como derivadas parciais da função organizada em uma linha (portanto, uma derivada de uma função com valor escalar é um vetor de linha). Nesta convenção, o gradiente e a derivada do …


1
Interpretação de causalidade de Granger usando R
Eu tenho três variáveis ​​macroeconômicas (ICS - sentimento do consumidor, ER - taxa de emprego, DGO - pedido de bens duráveis) e executei testes de causalidade de Granger em R sobre eles. Eu realmente não sei como interpretar os resultados de um teste de Granger. Alguém poderia me ajudar com …

1
Sobreposição de rede neural
Aprendi que o ajuste excessivo pode ser detectado plotando o erro de treinamento e o erro de teste versus as épocas. Como em: Eu estive lendo este post do blog onde eles dizem que a rede neural, net5 é excessiva e eles fornecem esta figura: O que é estranho para …

1
Podemos modelar fatores não aleatórios como aleatórios em um design multinível / hierárquico?
A distinção entre variáveis ​​estritamente aleatórias (que devem ser modeladas como tais) e variáveis ​​não aleatórias que alguns argumentam que poderiam ser modeladas como aleatórias se for um modelo hierárquico / multinível, é pouco clara para mim. Bates e Bolker exemplificam efeitos aleatórios com casos de verdadeira aleatoriedade, por exemplo, …



1
Qualidade do ajuste para dados discretos: melhor abordagem
Os dados: Para os fins desta pergunta / comunicação, podemos assumir que os dados se parecem com rnbinom(1000,size=0.1,prob=0.01)R, o que gera uma amostra aleatória de 1.000 observações a partir de uma distribuição binomial negativa (com size=0.1e probabilidade de sucesso prob=0.01). Essa é a parametrização em que a variável aleatória representa …

1
Equivalência entre um modelo anova de medidas repetidas e um modelo misto: lmer vs lme e simetria composta
Estou com problemas para obter resultados equivalentes entre um aovmodelo de medidas repetidas entre dentro e um lmermodelo misto. Meus dados e script têm a seguinte aparência data=read.csv("https://www.dropbox.com/s/zgle45tpyv5t781/fitness.csv?dl=1") data$id=factor(data$id) data id FITNESS TEST PULSE 1 1 pilates CYCLING 91 2 2 pilates CYCLING 82 3 3 pilates CYCLING 65 4 …




1
Devo excluir efeitos aleatórios de um modelo se eles não forem estatisticamente significativos?
Devo incluir efeitos aleatórios em um modelo, mesmo que não sejam estatisticamente significativos? Eu tenho um desenho experimental de medidas repetidas, no qual cada indivíduo experimenta três tratamentos diferentes em ordem aleatória. Eu gostaria de controlar quaisquer efeitos individuais e de ordem, mas nenhum deles parece ser estatisticamente significativo em …

Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.