Memento: agentes LLM sem fine-tuning via memória

#ai-agents · #agent-memory · #llm

Memento: Fine-tuning LLM Agents without Fine-tuning LLMs

Paper que propõe um paradigma para agentes LLM adaptativos eliminando a necessidade de fine-tuning do modelo subjacente, usando adaptação contínua de baixo custo via aprendizado por reforço baseado em memória e uma política de seleção de casos.

Acesse a fonte original

Código (Memento) no GitHub

Implementação do framework/agent apresentado no paper.

Acesse a fonte original

Versão no arXiv

Página no arXiv com o texto do paper.

Acesse a fonte original

Página no Hugging Face

Resumo/landing page do paper.

Acesse a fonte original