PrimeIntellect-ai

prime-rl

PrimeIntellect-ai

Agentic RL Training at Scale

AI 简介

PRIME-RL 是一个面向大规模智能体强化学习(Agentic RL)训练的开源框架,支持千卡级 GPU 异步分布式训练。其核心特点包括:基于 FSDP2 和 vLLM 的高性能训练与推理栈,原生支持 MoE 模型的专家并行(EP)与上下文并行(CP),内置 SWE 等 agentic 环境集成,以及端到端的 SFT、RLHF 和评估流水线。适用于需要高吞吐、低延迟的智能体行为建模场景,如代码生成代理、多步决策系统和复杂任务自动化训练。

Python
1.7k
Stars
356
Forks
9
Watchers
31
Issues

Star 增长

今日0
近 7 天+14
近 30 天+14
综合评分61.06
默认分支main