microsoft/TextWorld
TextWorld is a sandbox learning environment for the training and evaluation of reinforcement learning (RL) agents on text-based games.
何を解決するか
TextWorld は、強化学習(RL)エージェントのトレーニングとテストに使えるスケーラブルなサンドボックスを構築するために、テキストベースのゲームを自動生成する方法を提供します。AIがテキストベースの世界を理解し、それにインタラクションする能力を評価するための多様で構造的な環境が必要な問題を解決します。
動作方法
このフレームワークは、tw-make スクリプトを使ってカスタムゲームを生成できるようにし、世界のサイズ、オブジェクト数、クエストの長さなどのパラメータを指定できます。これらのゲームは Z-machine ファイルとしてエクスポートされます。ユーザーはターミナルまたは OpenAI Gym 標準に従う Python API を通じてゲームと対話でき、RL エージェントはコマンドを送信し、観測結果、スコア、状態の更新を受け取ることができます。
対象ユーザー
強化学習、自然言語理解、およびシミュレートされたテキスト環境での相互作用から学習する必要がある AI エージェントに取り組む研究者や開発者向けに設計されています。
特徴
- 自動ゲーム生成: 複雑さを調整可能なカスタムテキストベースの世界を迅速に作成可能。
- Gym風 API: Python インターフェースを通じて、標準的な RL ワークフローとシームレスに統合可能。
- 可視化ツール: ゲーム状態のレンダリング、スクリーンショットの取得、世界のグラフ表示をサポートするツールを含む。
- 拡張可能なサンドボックス: エージェントの堅牢性をテストするための多様なシナリオの作成をサポート。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト