
reflexion
noahshinn
[NeurIPS 2023] Reflexion: Language Agents with Verbal Reinforcement Learning
AI 简介
Reflexion 是一种面向语言智能体的口头强化学习框架,通过让模型在失败后生成自我反思并将其作为后续尝试的上下文,提升推理与决策能力。核心功能包括支持 ReAct、CoT 等多种基线代理类型,并提供四种反射策略(如仅上次尝试、仅反思、两者结合等),可适配 HotPotQA 多跳问答与 AlfWorld 交互式决策任务。技术特点在于无需外部奖励信号,仅依赖自然语言形式的自我反馈实现迭代优化。适用于需要多步推理、错误恢复与长期记忆的复杂任务场景,如开放域问答、具身智能环境交互和程序化问题求解。
Python
MIT License3.2k
Stars
310
Forks
31
Watchers
21
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分29.48
默认分支main