raindrop-ai/workshop
Give your coding agent the power to write and run agent evals.
解决的问题
Raindrop Workshop 是一个 AI Agent 的本地调试器。它通过提供对每个 Token、工具调用和决策的可视化,消除调试 Agent 工作流时的猜测,让开发者能够实时准确地看到 Agent 思维过程中的具体情况。
工作原理
Workshop 通过将追踪信息镜像到本地守护进程和基于浏览器的 UI 来对 Agent 进行插桩。它能与 Claude Code 等编程 Agent 集成,实现一个自愈循环,使 Agent 能够读取自身的追踪信息,针对代码库编写评估 (evals),并持续修复 Bug 直到断言通过。它还提供本地回放功能,用于在本地 Agent 代码上模拟生产环境的追踪。
适用对象
使用多种语言(包括 TypeScript、Python、Go 和 Rust)并利用各种 SDK(如 LangChain、CrewAI 或 Pydantic AI)以及编程 Agent(如 Cursor、Devin 或 Claude Code)构建 AI Agent 的开发者。
亮点
- 实时追踪流: 无需轮询即可实时查看 Token 和工具调用。
- 自愈式评估循环: 与 Claude Code 集成,根据追踪失败自动编写并修复代码。
- 本地回放: 能够构建 HTTP 端点,以便在本地回放生产环境的追踪。
- 广泛的兼容性: 支持广泛的 AI SDK、供应商(AWS Bedrock、Azure OpenAI、Vertex AI)和编程 Agent。
相关
- 项目
- 项目
- 项目
- 项目
- 项目