Estou começando com dados de entrada como este
df1 = pandas.DataFrame( {
"Name" : ["Alice", "Bob", "Mallory", "Mallory", "Bob" , "Mallory"] ,
"City" : ["Seattle", "Seattle", "Portland", "Seattle", "Seattle", "Portland"] } )
Que quando impresso aparece assim:
City Name
0 Seattle Alice
1 Seattle Bob
2 Portland Mallory
3 Seattle Mallory
4 Seattle Bob
5 Portland Mallory
O agrupamento é bastante simples:
g1 = df1.groupby( [ "Name", "City"] ).count()
e a impressão produz um GroupBy
objeto:
City Name
Name City
Alice Seattle 1 1
Bob Seattle 2 2
Mallory Portland 2 2
Seattle 1 1
Mas o que eu quero eventualmente é outro objeto DataFrame que contenha todas as linhas no objeto GroupBy. Em outras palavras, quero obter o seguinte resultado:
City Name
Name City
Alice Seattle 1 1
Bob Seattle 2 2
Mallory Portland 2 2
Mallory Seattle 1 1
Não vejo como fazer isso na documentação dos pandas. Qualquer dica seria bem-vinda.
Empty DataFrame
Columns: []
Index: [(Alice, Seattle), (Bob, Seattle), (Mallory, Portland), (Mallory, Seattle)]