TextArena/TextArena
A Collection of Competitive Text-Based Games for Language Model Evaluation and Reinforcement Learning
해결하는 문제
TextArena는 텍스트 기반 게임을 사용하여 대규모 언어 모델(LLMs)을 벤치마킹하고 훈련하는 표준화된 방법을 제공합니다. 모델이 추론, 전략 수립, 다중 플레이어 상황에서의 상호작용 능력을 시험할 수 있는 환경을 제공하며, 전통적인 시각적 인터페이스에 의존하지 않습니다.
작동 방식
이 프레임워크는 OpenAI Gym 스타일의 인터페이스를 사용하여 다양한 강화학습(RL) 및 언어 모델 프레임워크와 통합할 수 있습니다. 단일, 이인, 다인 플레이어 게임을 포함한 100개 이상의 게임 세트를 제공하며, 에이전트는 문자열 관측을 입력으로 받아 문자열 행동을 반환하는 call 함수만 필요합니다. 에이전트는 경쟁하거나 퍼즐을 해결할 수 있습니다.
대상 사용자
LLM 훈련, 평가, 모델의 추론 능력에 초점을 맞춘 AI 연구자 및 개발자에게 적합합니다. 특히 다중 에이전트 강화학습과 마인드 이론에 관심이 있는 분들에게 적합합니다.
주요 특징
- 벤치마킹 및 훈련용 100개 이상의 텍스트 기반 게임.
- RL 프레임워크와의 간편한 통합을 위한 OpenAI Gym 스타일 인터페이스.
- 단일, 이인, 다인 플레이어 게임 환경 지원.
- 간단한 문자열 입력/출력 인터페이스를 통해 다양한 LLM 에이전트와 호환 가능.
관련
- Dispatch
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트