Hugging Face OpenClaw 遷移指南
Hugging Face 已推出指南,協助使用者將 OpenClaw、Pi 或 Open Code 代理遷移至開源模型,因 Anthropic 決定限制 Pro/Max 訂閱者在開放代理平台上使用 Claude 模型的存取。
OpenClaw 代理的遷移選項
使用者可透過 Hugging Face 推理提供者的託管開源模型,或在自有硬體上本地執行模型,恢復代理功能。
Hugging Face 推理提供者
推理提供者提供最快速的方式來恢復代理功能,尤其是對於缺乏本地運行模型所需硬體的使用者。此平台將請求路由至開源模型的提供者。
設定流程:
- 在設定中建立 Hugging Face 令牌。
- 使用以下指令初始化連線:
openclaw onboard --auth-choice huggingface-api-key。 - 在提示時選擇模型。Hugging Face 推薦 GLM-5,因其在 Terminal Bench 上的高效能。
設定:
使用者可透過在 OpenClaw 設定檔中指定 repo_id 來更新模型:
{
"agents": {
"defaults": {
"model": {
"primary": "huggingface/zai-org/GLM-5:fastest"
}
}
}
}
HF PRO 訂閱者每月可獲得 2 美元的免費額度,用於推理提供者的使用。
使用 llama.cpp 的本地模型設定
在本地運行模型可提供完整的隱私、零 API 成本,且無速率限制。
安裝:
- macOS/Linux:
brew install llama.cpp - Windows:
winget install llama.cpp
執行:
使用者可使用以下指令啟動內建 Web UI 的本地伺服器:
llama-server -hf unsloth/Qwen3.5-35B-A3B-GGUF:UD-Q4_K_XL
對於此特定模型 (Qwen3.5-35B-A3B),建議使用 32 GB 記憶體。使用者可在 Hugging Face Hub 瀏覽數千個 GGUF 模型,以找到與其硬體相容的模型。
OpenClaw 整合: 若要將 OpenClaw 連接至本地的 llama.cpp 實例,請使用以下設定指令:
openclaw onboard --non-interactive \
--auth-choice custom-api-key \
--custom-base-url "http://127.0.0.1:8080/v1" \
--custom-model-id "unsloth-qwen3.5-35b-a3b-gguf" \
--custom-api-key "llama.cpp" \
--secret-input-mode plaintext \
--custom-compatibility openai
可透過 curl 進行驗證:curl http://127.0.0.1:8080/v1/models。
比較:託管 vs. 本地部署
| 功能 | Hugging Face 推理提供者 | 本地設定 (llama.cpp) |
|---|---|---|
| 設定速度 | 最快 | 較慢 |
| 成本 | 基於 API(含部分免費額度) | 零 API 成本 |
| 隱私 | 供應商託管 | 完全本地控制 |
| 硬體 | 不需要本地硬體 | 需要相容的硬體 |
| 速率限制 | 受供應商限制 | 無速率限制 |
Sources
- OriginalLiberate your OpenClaw