algorithmicsuperintelligence/optillm

Optimizing inference proxy for LLMs

What it solves

OptiLLM 解決了較小、較快的 LLM 與最前沿模型在複雜推理任務上的效能落差。它讓使用者在數學、程式碼與邏輯推理上,無需昂貴的模型訓練或微調,即可獲得 2‑10 倍的顯著準確度提升。

How it works

OptiLLM 作為一個兼容 OpenAI API 的推理代理。與其直接向 LLM 發送請求,不如將請求經由 OptiLLM 轉發,OptiLLM 會套用超過 20 種最先進的推理時最佳化技術。這些技術包括多代理推理、蒙特卡羅樹搜尋(MCTS)以及代理混合(MoA),在推理時使用額外計算資源來細化與驗證回應。

Who it’s for

此工具設計給開發者與研究人員使用,讓他們在不更換底層模型的前提下,提升現有 LLM 部署(無論是 OpenAI、Anthropic、Google、Cerebras 等提供者)的推理能力。

Highlights

  • Zero Training: 無需微調,即可立即提升準確度。
  • Drop-in Replacement: 作為透明代理,可直接取代任何兼容 OpenAI 的 API 端點。
  • Extensive Library: 實作超過 20 種技術,包含 MARS、CePO、PlanSearch 等。
  • Plugin Ecosystem: 提供記憶、隱私(PII 匿名化)、網路搜尋與程式碼執行等插件。
  • Multi-Provider Support: 透過 LiteLLM 整合,支援 100 多種模型。