microsoft/TextWorld

​TextWorld is a sandbox learning environment for the training and evaluation of reinforcement learning (RL) agents on text-based games.

解決的問題

TextWorld 提供了一種自動產生文字遊戲的方式,以建立可擴展的沙箱環境,用於訓練和測試強化學習(RL)代理。它解決了需要多樣且結構化的環境,以評估人工智慧在文字世界中理解與互動能力的問題。

運作方式

此框架允許使用者使用腳本(tw-make)產生自訂遊戲,可指定世界大小、物件數量和任務長度等參數。這些遊戲會被匯出為 Z-machine 檔案。使用者可透過終端機或遵循 OpenAI Gym 標準的 Python API 與這些遊戲互動,讓強化學習代理能發送指令並接收觀測結果、分數與狀態更新。

適用對象

專為從事強化學習、自然語言理解,以及需要在模擬文字環境中透過互動學習的 AI 代理的研究人員與開發者所設計。

主要亮點

  • 自動遊戲生成:可快速建立複雜度可調的自訂文字世界。
  • 類似 Gym 的 API:透過 Python 接口,可與標準強化學習工作流程無縫整合。
  • 可視化工具:包含渲染遊戲狀態、截取螢幕截圖以及顯示世界圖表的工具。
  • 可擴展的沙箱:支援建立多樣化的場景,以測試代理的穩健性。

相關

  • 專案
  • 專案
  • 專案
  • 專案