Mam ten wyjątkowy wymóg, który można wyjaśnić za pomocą tego kodu. To działa kod, ale nie jest wydajne pod względem pamięci.
data = [[
"A 5408599",
"B 8126880",
"A 2003529",
],
[
"C 9925336",
"C 3705674",
"A 823678571",
"C 3205170186",
],
[
"C 9772980",
"B 8960327",
"C 4185139021",
"D 1226285245",
"C 2523866271",
"D 2940954504",
"D 5083193",
]]
temp_dict = {
item: index for index, sublist in enumerate(data)
for item in sublist
}
print(data[temp_dict["A 2003529"]])
out: ['A 5408599', 'B 8126880', 'A 2003529']
Krótko mówiąc, chcę, aby każdy element listy podrzędnej był indeksowalny i powinien zwrócić podlistę.
Powyższa metoda działa, ale zajmuje dużo pamięci, gdy dane są duże. Czy jest jakiś lepszy sposób, przyjazny dla pamięci i procesora? Dane są przechowywane jako plik JSON.
Edytuj Próbowałem odpowiedzi dla największego możliwego scenariusza przypadku użycia (1000 list podrzędnych, 100 pozycji w każdej liście podrzędnej, 1 milion zapytań) i oto wyniki (średnio 10 przebiegów):
Method, Time (seconds), Extra Memory used
my, 0.637 40 Mb
deceze, 0.63 40 Mb
James, 0.78 200 kb
Pant, > 300 0 kb
mcsoini, forever 0 kb
{item: sublist for sublist in data for item in sublist}może być nieco bardziej wydajny i bezpośredni… ?!