microsoft/TextWorld

​TextWorld is a sandbox learning environment for the training and evaluation of reinforcement learning (RL) agents on text-based games.

해결하는 문제

TextWorld는 강화학습(RL) 에이전트의 훈련과 테스트를 위한 확장 가능한 사전 환경을 만들기 위해 텍스트 기반 게임을 자동으로 생성할 수 있는 방법을 제공합니다. AI가 텍스트 기반 세계를 이해하고 상호작용하는 능력을 평가하기 위해 다양한 구조적 환경이 필요하다는 문제를 해결합니다.

작동 방식

이 프레임워크는 사용자가 tw-make 스크립트를 사용하여 세계 크기, 객체 수, 미션 길이와 같은 파라미터를 지정해 사용자 정의 게임을 생성할 수 있게 합니다. 이러한 게임은 Z-machine 파일로 내보내집니다. 사용자는 터미널 또는 OpenAI Gym 표준을 따르는 Python API를 통해 게임과 상호작용할 수 있으며, RL 에이전트는 명령을 보내고 관측 결과, 점수, 상태 업데이트를 받을 수 있습니다.

대상 사용자

강화학습, 자연어 이해, 그리고 시뮬레이션된 텍스트 환경에서 상호작용을 통해 학습해야 하는 AI 에이전트를 개발하는 연구자 및 개발자에게 적합합니다.

주요 특징

  • 자동 게임 생성: 조정 가능한 복잡도로 사용자 정의 텍스트 기반 세계를 빠르게 생성 가능.
  • Gym 유사 API: Python 인터페이스를 통해 표준 RL 워크플로우와 원활하게 통합 가능.
  • 시각화 도구: 게임 상태 렌더링, 스크린샷 캡처, 세계의 그래프 표시를 지원하는 도구 포함.
  • 확장 가능한 사전 환경: 에이전트의 강건성을 테스트할 수 있는 다양한 시나리오 생성을 지원.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트