Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States
QUESTION — Comment maintenir des états de croyance explicites pour aider les agents LLM dans des tâches à long horizon sans s'enliser ni perdre de progression ?
Les auteurs présentent PoS, un cadre d'inférence qui construit et maintient continuellement des états de croyance explicites comme contexte de décision pour les agents LLM. Chaque croyance combine des estimations de l'état du monde avec les exigences de tâches non résolues, tandis que la validation de la cohérence détecte l'enlisement. Des expériences sur quatre benchmarks d'exécution et de diagnostic montrent que PoS atteint la performance globale la plus élevée sur chaque benchmark avec tous les backbones LLM évalués.
PoS atteint la performance globale la plus élevée sur chaque benchmark avec les trois backbones LLM.
IDKTreeDP · 01 oct. 2026
lire l'original ↗