PufferAI/PufferLib
Puffing up reinforcement learning
What it solves
PufferLib 是为了让强化学习 (RL) 更加快速且更易于使用而设计的,它提供了一个可以训练小型、高性能模型并在几秒钟内达到超人性能的库。
How it works
该库实现了基于团队研究的自定义学习算法、超参数调整和模拟方法,以优化训练过程。
How it's for
它适用于需要为应用程序提供高性能强化学习框架的开发者和研究人员。
Highlights
- 快速的训练速度,能够能够在几秒钟内产生超人模型。
- 包含内置的超参数调整和模拟方法。
- 免费且开源。
相关
- 项目
- 项目
- 项目
- 项目
- Dispatch