nyldn/claude-octopus

Surface AI blindspots before you ship. Put up to 8 AI models on every research, design or coding task.

What it solves

Claude Octopus 針對單一 AI 模型的「盲點」提供解決方案,透過整合多個外部 LLM 供應商來交叉檢查工作、提供對抗性審查,並在程式碼上線前達成共識。它將 AI 程式開發的即興性轉變為結構化的多供應商工作流程,以確保更高的品質與可靠性。

How it works

Octopus 作為 Claude Code 的協調層,支援多達十個外部供應商(包括 Codex、Gemini、Copilot 與 Ollama)。它採用「雙鑽石」方法論(Discover → Define → Develop → Deliver),搭配品質門檻與 75% 共識門檻,標記模型之間的意見不合。

主要機制包括:

  • Multi-LLM Council:跨多個角色的結構化討論流程,用以做決策或制定實作計畫。
  • Dark Factory:自動化管線,接受規格說明並處理從研究到交付的全流程。
  • Smart Router:意圖解析系統,將使用者請求映射到特定的專業角色(共 32 種)與工作流模組(共 58 項技能)。
  • Memory Integration:與 claude-memagentmemory 連結,提供跨會話的持續上下文。

Who it’s for

使用 Claude Code 的開發者,想要更嚴謹的驗證、對抗性測試與多模型觀點,以避免單一 LLM 的幻覺或偏見所帶來的風險。

Highlights

  • Broad Provider Support:整合 Codex、Gemini、Antigravity CLI、Copilot、Qwen、Ollama、Perplexity、OpenRouter 與 OpenCode。
  • Consensus Gates:透過要求不同 AI 供應商之間的高共識門檻,防止生產錯誤。
  • Specialized Personas:提供 32 種角色特定代理(例如 security-auditor、backend-architect),以提供針對性專業知識。
  • Autonomous Pipelines/octo:factory 指令啟用「規格輸入、軟體輸出」的工作流程。
  • Cros-IDE Integration:作為 Claude Code 的插件,同時也是 Cursor IDE 的 MCP 伺服器。