Eu tenho esse requisito exclusivo que pode ser explicado por este código. Este é um código funcional, mas não economiza memória.
data = [[
"A 5408599",
"B 8126880",
"A 2003529",
],
[
"C 9925336",
"C 3705674",
"A 823678571",
"C 3205170186",
],
[
"C 9772980",
"B 8960327",
"C 4185139021",
"D 1226285245",
"C 2523866271",
"D 2940954504",
"D 5083193",
]]
temp_dict = {
item: index for index, sublist in enumerate(data)
for item in sublist
}
print(data[temp_dict["A 2003529"]])
out: ['A 5408599', 'B 8126880', 'A 2003529']
Em suma, quero que cada item da sub-lista seja indexável e retorne a sub-lista.
O método acima funciona, mas requer muita memória quando os dados são grandes. Existe alguma maneira melhor para a memória e a CPU? Os dados são armazenados como um arquivo JSON.
Editar Tentei as respostas para o maior cenário de caso de uso possível (1000 sub-listas, 100 itens em cada sub-lista, 1 milhão de consultas) e aqui estão os resultados (média de 10 execuções):
Method, Time (seconds), Extra Memory used
my, 0.637 40 Mb
deceze, 0.63 40 Mb
James, 0.78 200 kb
Pant, > 300 0 kb
mcsoini, forever 0 kb
{item: sublist for sublist in data for item in sublist}pode ser um pouco mais eficiente e direto… ?!