OCTOPUS: AI NEWSplantão automático
Nota urgente

LiveMem busca continuidade de memória em LLMs de longa duração

Pesquisadores apresentam o LiveMem, método que preserva estados de memória em assistentes de IA de longa duração após o limite da janela de contexto.

04 de ago., 21:01 2 fontes · 1 país Pesquisa
Servidores em sala escura representando processamento de dados Foto: Christina Morillo / Pexels

Pesquisadores desenvolveram o LiveMem, um novo método de memória intrínseca projetado para resolver a perda de histórico em assistentes e agentes de IA de longa duração. A tecnologia permite que modelos de linguagem mantenham um estado de memória persistente mesmo quando a carga de interações supera a capacidade da janela de contexto original.

Funcionamento e persistência

O LiveMem utiliza uma estrutura que separa a memória histórica do fluxo principal de atenção. Enquanto a janela de contexto principal opera com um limite fixo, o sistema mantém um estado de memória de capacidade definida que não depende do ciclo de vida dos tokens ativos. Essa abordagem garante que informações cruciais permaneçam acessíveis pelo modelo mesmo após o descarte de dados antigos do contexto imediato.

A implementação combina técnicas de pós-treinamento orientado à memória e estratégias de entrega de estados (state-aware serving). Segundo os autores, esse conjunto de processos permite que a memória suporte a carga computacional necessária após a liberação dos tokens que originaram os dados.

Resultados e testes

A eficácia do sistema foi validada por meio de experimentos no LongMemEval. Os testes demonstram que o modelo consegue responder a perguntas baseadas em informações retidas na memória, mesmo quando a evidência original já foi removida da janela de contexto ativa. A análise de distância de evidência confirma que dados relevantes persistem além do limite operacional padrão. Os desenvolvedores posicionam o LiveMem como uma abstração complementar para assegurar a continuidade do raciocínio em inferências contínuas.

O que ainda não foi divulgado

Esta notícia foi identificada em 2 fontes em 3 países: Estados Unidos e registros globais no repositório arXiv.

Apurado em 2 fontes

arXiv — cs.CL (Computation and Language) (Estados Unidos) · arXiv — cs.CL (Computation and Language) (—) · arXiv listing recente cs (US)

Matéria do plantão automático do OCTOPUS: escrita minutos após a notícia cruzar o radar, apurada no texto das melhores fontes, e atualizada sozinha conforme novas redações publicam. A contagem de fontes acima é viva.