Memento: agentes LLM sem fine-tuning via memória
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
Paper que propõe um paradigma para agentes LLM adaptativos eliminando a necessidade de fine-tuning do modelo subjacente, usando adaptação contínua de baixo custo via aprendizado por reforço baseado em memória e uma política de seleção de casos.
Código (Memento) no GitHub
Implementação do framework/agent apresentado no paper.
Versão no arXiv
Página no arXiv com o texto do paper.
Página no Hugging Face
Resumo/landing page do paper.