FocusLM

La memoria de IA, explicada

Qué es la memoria de IA y por qué una ventana de contexto más grande no basta

«Memoria de IA» es la capacidad de un asistente de retener con el tiempo lo que te importa —tus documentos, tus decisiones, tu historia— y traer de vuelta la pieza correcta cuando preguntas. La versión ingenua consiste en pegarlo todo en un único prompt larguísimo. La investigación dice que eso falla en silencio. Este es el modelo mejor.

La ventana de contexto no es memoria

La ventana de contexto de un modelo es su espacio de trabajo a corto plazo. Es limitada, y en cuanto algo se sale de ella el modelo se comporta como si nunca hubiera ocurrido. Agrandar la ventana ayuda un poco, pero no convierte el contexto a corto plazo en memoria duradera, y trae problemas propios.

La memoria de verdad está estructurada y gestionada

La alternativa, tomada de décadas de diseño de sistemas, es una jerarquía de memoria: mantener un conjunto de trabajo pequeño dentro de la ventana y un almacén grande y organizado fuera de ella, y sacar a la superficie las piezas relevantes cuando hacen falta. El valor no está en cuánto logras meter en un prompt, sino en lo bien que se selecciona la porción correcta. Lo que hace que la memoria funcione es la estructura, no el volumen.

Eso es lo que construye FocusLM: un agente te entrevista para entender el problema, diseña una ontología de carpetas, escribe sus propias reglas de archivado y ordena todo lo que le das en una memoria estructurada de markdown inspeccionable y exportable. Cuando preguntas, saca a la superficie las piezas relevantes con su cita, vengan de donde vengan.

Empezar gratis

La investigación, en lenguaje claro

Explicaciones breves y fundamentadas de los artículos que hay detrás, cada una con un diagrama original.

Cifrar la memoria de la IA: por qué una clave por proyecto supera a una por base de datos

Una IA que recuerda tu vida guarda material que no entregarías a un desconocido. Ciframos cada archivo de memoria y cada mensaje de chat con una clave que pertenece solo a ese proyecto, y la investigación explica por qué las alternativas obvias filtran.

Más contexto no siempre es mejor: qué ocurre más allá de los 64k tokens

Un amplio estudio con más de 20 modelos descubrió que amontonar más texto recuperado en el prompt a menudo deja de ayudar —y en muchos modelos empieza a perjudicar— mucho antes de que la ventana esté llena. Más grande no es lo mismo que mejor.

¿Y si un LLM gestionara la memoria como un sistema operativo?

La ventana de contexto es pequeña y fija. MemGPT toma prestada una idea de hace 40 años de los sistemas operativos —una jerarquía de memoria con paginación— para que un modelo trabaje con mucha más información de la que cabe en la ventana.

RAG frente a contexto largo: ¿cuál deberías usar realmente?

Cuando un modelo puede leer un millón de tokens, ¿queda obsoleta la recuperación? Un estudio de Google DeepMind dice que no: el contexto largo gana en calidad cuando puedes permitírtelo, la recuperación gana en coste y un enrutador sencillo consigue casi lo mejor de ambos.

Perdidos en el medio: por qué las ventanas de contexto largo fallan en silencio

Los LLM aprovechan mucho mejor el inicio y el final de un contexto largo que el medio: un efecto en forma de U que persiste incluso en modelos diseñados para contexto largo. Esto es lo que muestra la investigación y lo que significa.

Cómo se compara FocusLM