Farama-Foundation/Gymnasium
A standard API for single-agent reinforcement learning environments, with popular reference environments and related utilities (formerly Gym)
解決する課題
Gymnasiumは、強化学習(RL)の研究者や開発者が、異なる学習アルゴリズムを構築、テスト、比較するための標準化された方法を提供します。これにより、新しい環境ごとにカスタムの通信コードを記述する必要がなくなり、アルゴリズムを異なるシミュレーションタスク間で容易に移植できるようになります。
仕組み
学習アルゴリズム(エージェント)と環境の間の架け橋として機能する標準的なPython APIを定義します。環境を reset() や step() といった一貫したメソッドを持つPythonクラスとしてモデル化することで、環境が単純なテキストゲームであっても複雑な物理シミュレーションであっても、エージェントが統一された方法で世界と対話し、観測と報酬を受け取り、アクションを実行できるようにします。
対象者
リファレンス実装を使用する初心者から、物理環境やゲーム環境向けの複雑なエージェントを構築するエキスパートまで、強化学習に取り組む開発者や研究者向けに設計されています。
特徴
- 多様な環境ライブラリ: Classic Control、Box2D物理、デバッグ用のToy Text、MuJoCo多関節制御、Atari 2600エミュレーションを含む幅広い組み込み環境が含まれています。
- 厳格なバージョニング: 環境にバージョニングシステム(例: "-v0")を使用し、学習結果に影響を与える変更が再現性を損なわないようにします。
- 拡張可能なエコシステム: Gymnasium APIに準拠した膨大な数のサードパーティ環境をサポートしています。
- 幅広い互換性: LinuxおよびmacOS上の複数のPythonバージョン(3.10から3.14まで)をサポートしています。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト