Hugging Face OpenClaw 迁移指南
Hugging Face 推出了指南,帮助用户将其 OpenClaw、Pi 或 Open Code 代理迁移到开源模型,此举是因 Anthropic 决定限制 Pro/Max 订阅者在开放代理平台上访问 Claude 模型。
OpenClaw 代理的迁移选项
用户可以通过选择 Hugging Face Inference Providers 提供的托管开源模型,或在自己的硬件上本地运行模型,来恢复代理功能。
Hugging Face 推理提供商
推理提供商提供了恢复代理能力的最快途径,尤其适用于缺乏运行模型所需硬件的用户。该平台将请求路由至开源模型的提供商。
设置流程:
- 在设置中创建 Hugging Face 令牌。
- 使用以下命令初始化连接:
openclaw onboard --auth-choice huggingface-api-key。 - 在提示时选择模型。Hugging Face 推荐 GLM-5,因为它在 Terminal Bench 上表现出色。
配置:
用户可以通过在 OpenClaw 配置文件中指定 repo_id 来更新模型:
{
"agents": {
"defaults": {
"model": {
"primary": "huggingface/zai-org/GLM-5:fastest"
}
}
}
}
HF PRO 订阅者每月可获得 2 美元的免费额度,用于推理提供商的使用。
使用 llama.cpp 的本地模型设置
本地运行模型可实现完整隐私、零 API 成本,并消除速率限制。
安装:
- macOS/Linux:
brew install llama.cpp - Windows:
winget install llama.cpp
执行: 用户可以使用如下命令启动带内置 Web UI 的本地服务器:
llama-server -hf unsloth/Qwen3.5-35B-A3B-GGUF:UD-Q4_K_XL
对于该特定模型(Qwen3.5-35B-A3B),建议配备 32GB RAM。用户可以在 Hugging Face Hub 浏览数千个 GGUF 模型,以找到与其硬件兼容的模型。
OpenClaw 集成: 要将 OpenClaw 连接到本地 llama.cpp 实例,请使用以下配置命令:
openclaw onboard --non-interactive \
--auth-choice custom-api-key \
--custom-base-url "http://127.0.0.1:8080/v1" \
--custom-model-id "unsloth-qwen3.5-35b-a3b-gguf" \
--custom-api-key "llama.cpp" \
--secret-input-mode plaintext \
--custom-compatibility openai
可通过 curl 进行验证:curl http://127.0.0.1:8080/v1/models。
对比:托管 vs 本地部署
| 特性 | Hugging Face 推理提供商 | 本地设置(llama.cpp) |
|---|---|---|
| 设置速度 | 最快 | 较慢 |
| 成本 | 基于 API(含部分免费额度) | 零 API 成本 |
| 隐私 | 提供商托管 | 完全本地控制 |
| 硬件 | 无需本地硬件 | 需要兼容硬件 |
| 速率限制 | 受提供商限制 | 无速率限制 |
SUMMARY: Hugging Face 提供两种方法——Inference Providers 和本地 llama.cpp 设置——将 OpenClaw 代理从受限的 Claude 模型迁移到开源替代方案。
TITLE: Hugging Face OpenClaw 迁移指南
Sources
- OriginalLiberate your OpenClaw