
verifiers
PrimeIntellect-ai
Our library for RL environments + evals
AI 简介
Verifiers 是一个面向大语言模型(LLM)强化学习(RL)的专用环境与评估库,提供可复现、模块化的 RL 训练环境(如 MultiTurnEnv、RLMEnv)和标准化评估框架。核心特点包括任务集/驾驭器(Taskset/Harness)API、沙箱安全执行、多轮交互时序控制、自动指标采集(如 pass@k)、OpenAI 兼容接口及 CLI/TUI 评估工具。适用于 LLM 智能体在复杂决策场景(如多步推理、工具调用、代码生成)中的训练与基准测试,尤其适合研究者和工程师构建可控、可度量的 RL for LLM 流程。
Python
MIT License4.3k
Stars
572
Forks
28
Watchers
38
Issues
Star 增长
今日0
近 7 天0
近 30 天+36
综合评分63.87
默认分支main