PrimeIntellect-ai/verifiers
Our library for RL environments + evals
解决的问题
提供一个标准化的库,用于创建用于训练和评估大型语言模型(LLMs)的环境,特别针对强化学习工作流设计。
如何工作
该库作为一个框架,用于构建可与 Prime Intellect 生态系统(包括其训练框架 prime-rl 和托管训练平台)集成的环境。它设计为与 CLI 工具配合使用,以实现交互和管理。
适用人群
专注于 LLM 强化学习,需要一种结构化方式来定义和测试模型在特定环境中的性能的开发者和研究人员。
主要亮点
- 与 Environments Hub、prime-rl 和托管训练平台集成。
- 支持创建用于训练和评估的环境。
- 通过专用技能和文档,特别支持编码代理。
相关
- 项目
- 项目
- 项目
- 项目
- 项目