PrimeIntellect-ai/verifiers
Our library for RL environments + evals
何を解決するか
大規模言語モデル(LLM)の訓練および評価に使用される環境を作成するための標準化されたライブラリを提供し、特に強化学習ワークフロー向けに設計されています。
仕組み
このライブラリは、Prime Intellectエコシステム(そのトレーニングフレームワークである prime-rl およびホストされたトレーニングプラットフォーム)と統合できる環境を構築するためのフレームワークとして機能します。CLIツールとの連携により、インタラクションや管理が可能になっています。
対象ユーザー
特定の環境でモデルのパフォーマンスを定義・テストするための構造化された方法を必要とする、LLM強化学習に注力する開発者および研究者。
特徴
- Environments Hub、prime-rl、Hosted Trainingプラットフォームと統合済み。
- 訓練および評価の両方の環境作成をサポート。
- 専用のスキルとドキュメントによるコーディングエージェントのサポートを特別に備えています。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト