Estatísticas e Big Data

Perguntas e respostas para pessoas interessadas em estatística, aprendizado de máquina, análise de dados, mineração de dados e visualização de dados


2
Cálculo da precisão e recuperação em R
Suponha que eu esteja construindo um classificador de regressão logística que preveja se alguém é casado ou solteiro. (1 = casado, 0 = solteiro) Quero escolher um ponto na curva de precisão-recall que me dê pelo menos 75% de precisão, portanto, desejo escolher os limites e , para que:t 2t1t1t_1t2t2t_2 …




3
Como padronizar uma matriz se o desvio padrão é zero?
Estou tentando padronizar colunas de conjunto de dados para regressão linear. Uma das colunas possui desvio padrão = 0. def standardize(X): return (X - mean(X)) / std(X) Portanto, esse código não funciona. Existem truques para resolver este problema? Eu tentei duas coisas Jogue sempre a coluna com desvio padrão 0 …



1
Quais distribuições em [0,1] que não a distribuição beta formam bons compostos com a distribuição binomial?
Para quais distribuições x, exceto beta, a distribuição x-binomial é boa? As distribuições beta e binomial são famosamente conjugadas, mas estou curioso para saber se outras distribuições não conjugadas fornecerão pmfs compostos comparativamente simples. Por legal, quero dizer que é agradável calcular o pmf sem recorrer à integração numérica; Não …

1
detecção de plágio em teste de múltipla escolha
Suponha que um investigador suspeite que um aluno copie respostas do trabalho de outro aluno durante um exame de múltipla escolha. Mais tarde, ela verifica as respostas e encontra algumas semelhanças - mas, por outro lado, é provável que haja semelhanças, dada a natureza do exame. Como ela deveria determinar …

1
Regularização de coletores usando o gráfico da Lapônia no SVM
Estou tentando implementar a regularização múltipla em máquinas de vetores de suporte (SVMs) no Matlab. Estou seguindo as instruções no artigo de Belkin et al. (2006), há a equação: f∗=argminf∈Hk∑li=1V(xi,yi,f)+γA∥f∥2A+γI∥f∥2If∗=argminf∈Hk∑i=1lV(xi,yi,f)+γA‖f‖A2+γI‖f‖I2f^{*} = \text{argmin}_{f \in H_k}\sum_{i=1}^{l}V\left(x_i,y_i,f\right)+\gamma_{A}\left\| f \right\|_{A}^{2}+\gamma_{I}\left\| f \right\|_{I}^{2} onde V é alguma função de perda e γAγA\gamma_A é o peso …

1
Compreendendo o problema de Behrens – Fisher
Esta seção de este artigo diz: Ronald Fisher, em 1935, introduziu inferência fiducial para aplicá-la a esse problema. Ele se referiu a um artigo anterior de WV Behrens de 1929. Behrens e Fisher propuseram encontrar a distribuição de probabilidade de onde e são as duas médias de amostra e e …

1
Intervalos de confiança ao usar o teorema de Bayes
Estou computando algumas probabilidades condicionais e intervalos de confiança associados a 95%. Para muitos de meus casos, tenho contagens diretas de xsucessos fora dos ntestes (de uma tabela de contingência), para que eu possa usar um intervalo de confiança binomial, como é fornecido por binom.confint(x, n, method='exact')in R. Em outros …

4
valor-p como distância?
Os valores de p entre vários testes em pares podem ser considerados como uma medida de similaridade / distância e o dimensionamento multidimensional pode ser aplicado sobre uma matriz em pares de valores de p para reduzir a dimensionalidade? Essa é uma pergunta fácil, mas qual seria o maior problema …

2
Dirichlet processos para aprendizagem supervisionada?
Parece que quando olho aqui os algoritmos da aprendizagem da moda, coisas como redes neurais, árvores potencializadas, máquinas de vetores de suporte, florestas aleatórias e amigos são promovidas por problemas de aprendizagem supervisionados. Os processos de Dirichlet e seus tipos parecem ser mencionados principalmente em problemas de aprendizado não supervisionado, …

Ao utilizar nosso site, você reconhece que leu e compreendeu nossa Política de Cookies e nossa Política de Privacidade.
Licensed under cc by-sa 3.0 with attribution required.