
axrl
XYZ-AI-Lab
AxisRL is an agentic RL post-training framework built on SGLang rollout, Megatron training, and real-world agent workflows.
AI 简介
AxisRL 是一个面向智能体强化学习(Agentic RL)的后训练框架,专注于多轮交互场景下的高效策略优化。它基于 SGLang 实现高吞吐量多步 rollout,依托 Megatron 支持百B级参数的大规模分布式训练,并内置 rollout-训练协同调度、上下文打包、路由回放、不一致分析与轻量控制平面等系统级能力。支持 PPO、GRPO、GSPO 等多种策略优化目标,兼容白盒环境与黑盒工具调用(通过 OpenAI 兼容代理)。适用于需要长程决策、工具调用与延迟奖励建模的智能体训练场景,如复杂任务自动化、AI Agent 开发与仿真环境训练。
Python
Apache License 2.0566
Stars
21
Forks
8
Watchers
0
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分48.03
默认分支main