Tengo este requisito único que puede explicarse con este código. Este es un código de trabajo pero no es eficiente en memoria.
data = [[
"A 5408599",
"B 8126880",
"A 2003529",
],
[
"C 9925336",
"C 3705674",
"A 823678571",
"C 3205170186",
],
[
"C 9772980",
"B 8960327",
"C 4185139021",
"D 1226285245",
"C 2523866271",
"D 2940954504",
"D 5083193",
]]
temp_dict = {
item: index for index, sublist in enumerate(data)
for item in sublist
}
print(data[temp_dict["A 2003529"]])
out: ['A 5408599', 'B 8126880', 'A 2003529']
En resumen, quiero que cada elemento de la sublista sea indexable y debería devolver la sublista.
El método anterior funciona pero requiere mucha memoria cuando los datos son grandes. ¿Hay alguna forma mejor para la memoria y la CPU? Los datos se almacenan como un archivo JSON.
Editar Probé las respuestas para el escenario de caso de uso más grande posible (1000 sublistas, 100 elementos en cada sublista, 1 millón de consultas) y aquí están los resultados (media de 10 ejecuciones):
Method, Time (seconds), Extra Memory used
my, 0.637 40 Mb
deceze, 0.63 40 Mb
James, 0.78 200 kb
Pant, > 300 0 kb
mcsoini, forever 0 kb
{item: sublist for sublist in data for item in sublist}¿podría ser un poco más eficiente y directo ...?