Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados

2
Validação cruzada em dimensão muito alta (para selecionar o número de variáveis ​​usadas na classificação dimensional muito alta)
Minha pergunta é sobre validação cruzada quando há muito mais variáveis ​​que observações. Para fixar idéias, proponho restringir a estrutura de classificação em uma dimensão muito alta (mais recursos do que observação). Problema: Suponha que, para cada variável , você tenha uma medida de importância T [ i ] do …



1
Alguma desvantagem da rede elástica sobre o laço?
Quais são as desvantagens do uso de rede elástica em comparação com o laço. Eu sei que a rede elástica é capaz de selecionar grupos de variáveis ​​quando elas são altamente correlacionadas. Não tem o problema de selecionar mais de nnn preditores quando p≫np≫np \gg n. Considerando que o laço …





3
Suporte à regressão vetorial em dados com distorção / alta curtose
Estou usando a regressão de vetores de suporte para modelar alguns dados bastante distorcidos (com alta curtose). Eu tentei modelar os dados diretamente, mas estou recebendo previsões errôneas, principalmente devido à distribuição dos dados, que é distorcida com caudas muito grossas. Tenho certeza de que alguns discrepantes (que são pontos …


1
Quais são as principais diferenças entre análises taxométricas (por exemplo, MAXCOV, MAXEIG) e análises de classe latente?
Pesquisas recentes tentaram determinar se certas construções psicológicas são latentemente dimensionais ou taxônicas (isto é, incluindo táxons ou classes). Por exemplo, os pesquisadores podem estar interessados ​​em descobrir se existe uma certa "classe" de pessoas com maior probabilidade de desenvolver dor crônica após uma lesão ou se o risco de …

1
Como o valor é convertido em p-value?
Sou novato em estatística e estou estudando a matemática por trás dos testes divididos (A / B e multivariados). Aprendi como calcular com dados de teste fornecidos e entendo como traduzir isso em uma probabilidade por meio de uma tabela, mas eu gostaria de poder calcular a probabilidade pessoalmente. Eu …

2
Bootstrap vs integração numérica
Meu entendimento da abordagem de bootstrap é baseado na estrutura de Wasserman (quase literalmente): Seja uma estatística ( é a amostra iid retirada da distribuição ). Suponha que queremos estimar - a variação de dada .Tn= g(X1, . . . ,Xn)Tn=g(X1,...,Xn)T_n = g(X_1, ..., X_n)XEuXEuX_iFFFVF(Tn)VF(Tn)V_F(T_n)TnTnT_nFFF A abordagem de autoinicialização segue …



Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.