nyldn/claude-octopus

Surface AI blindspots before you ship. Put up to 8 AI models on every research, design or coding task.

What it solves

Claude Octopus 解决单一 AI 模型的“盲点”,通过整合多个外部 LLM 供应商来交叉检查工作、提供对抗性审查,并在代码发布前达成共识。它将 AI 编码的即兴性转变为结构化的多供应商工作流,以确保更高的质量和可靠性。

How it works

Octopus 作为 Claude Code 的编排层,支持多达十个外部供应商(包括 Codex、Gemini、Copilot 和 Ollama)。它采用“双钻石”方法论(Discover → Define → Develop → Deliver),配合质量门和 75% 共识阈值,标记模型之间的分歧。

关键机制包括:

  • Multi-LLM Council:跨多个角色的结构化讨论过程,用于做决策或创建实现计划。
  • Dark Factory:一个自主管道,接受规范说明并处理从研究到交付的整个过程。
  • Smart Router:意图解析系统,将用户请求映射到特定的专用角色(共 32 种)和工作流模块(共 58 项技能)。
  • Memory Integration:与 claude-memagentmemory 连接,提供跨会话的持久上下文。

Who it’s for

使用 Claude Code 的开发者,希望获得更严格的验证、对抗性测试和多模型视角,以避免单一 LLM 的幻觉或偏见带来的风险。

Highlights

  • Broad Provider Support:整合 Codex、Gemini、Antigravity CLI、Copilot、Qwen、Ollama、Perplexity、OpenRouter 和 OpenCode。
  • Consensus Gates:通过要求不同 AI 供应商之间的高共识阈值,防止生产错误。
  • Specialized Personas:包括 32 种角色特定代理(例如 security-auditor、backend-architect),提供针对性专业知识。
  • Autonomous Pipelines/octo:factory 命令启用“规格输入,软件输出”工作流。
  • Cros-IDE Integration:作为 Claude Code 的插件,同时也是 Cursor IDE 的 MCP 服务器。