Estou procurando uma maneira de fazer o equivalente ao SQL
SELECT DISTINCT col1, col2 FROM dataframe_table
A comparação pandas sql não tem nada sobre distinct.
.unique() só funciona para uma única coluna, então suponho que poderia concatá-las ou colocá-las em uma lista / tupla e comparar dessa forma, mas isso parece algo que os pandas deveriam fazer de uma forma mais nativa.
Estou perdendo algo óbvio ou não há como fazer isso?
df.apply(pd.Series.unique)mas isso não funcionará se o número de valores únicos variar nas colunas, então você teria que construir um dicionário dos nomes das colunas como chaves e os valores únicos como os valores