Farama-Foundation/Gymnasium

A standard API for single-agent reinforcement learning environments, with popular reference environments and related utilities (formerly Gym)

解決する課題

Gymnasiumは、強化学習(RL)の研究者や開発者が、異なる学習アルゴリズムを構築、テスト、比較するための標準化された方法を提供します。これにより、新しい環境ごとにカスタムの通信コードを記述する必要がなくなり、アルゴリズムを異なるシミュレーションタスク間で容易に移植できるようになります。

仕組み

学習アルゴリズム(エージェント)と環境の間の架け橋として機能する標準的なPython APIを定義します。環境を reset()step() といった一貫したメソッドを持つPythonクラスとしてモデル化することで、環境が単純なテキストゲームであっても複雑な物理シミュレーションであっても、エージェントが統一された方法で世界と対話し、観測と報酬を受け取り、アクションを実行できるようにします。

対象者

リファレンス実装を使用する初心者から、物理環境やゲーム環境向けの複雑なエージェントを構築するエキスパートまで、強化学習に取り組む開発者や研究者向けに設計されています。

特徴

  • 多様な環境ライブラリ: Classic Control、Box2D物理、デバッグ用のToy Text、MuJoCo多関節制御、Atari 2600エミュレーションを含む幅広い組み込み環境が含まれています。
  • 厳格なバージョニング: 環境にバージョニングシステム(例: "-v0")を使用し、学習結果に影響を与える変更が再現性を損なわないようにします。
  • 拡張可能なエコシステム: Gymnasium APIに準拠した膨大な数のサードパーティ環境をサポートしています。
  • 幅広い互換性: LinuxおよびmacOS上の複数のPythonバージョン(3.10から3.14まで)をサポートしています。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト