Hugging Face OpenClaw 迁移指南

Hugging Face 推出了指南,帮助用户将其 OpenClaw、Pi 或 Open Code 代理迁移到开源模型,此举是因 Anthropic 决定限制 Pro/Max 订阅者在开放代理平台上访问 Claude 模型。

OpenClaw 代理的迁移选项

用户可以通过选择 Hugging Face Inference Providers 提供的托管开源模型,或在自己的硬件上本地运行模型,来恢复代理功能。

Hugging Face 推理提供商

推理提供商提供了恢复代理能力的最快途径,尤其适用于缺乏运行模型所需硬件的用户。该平台将请求路由至开源模型的提供商。

设置流程:

  1. 在设置中创建 Hugging Face 令牌。
  2. 使用以下命令初始化连接:openclaw onboard --auth-choice huggingface-api-key
  3. 在提示时选择模型。Hugging Face 推荐 GLM-5,因为它在 Terminal Bench 上表现出色。

配置: 用户可以通过在 OpenClaw 配置文件中指定 repo_id 来更新模型:

{
  "agents": {
    "defaults": {
      "model": {
        "primary": "huggingface/zai-org/GLM-5:fastest"
      }
    }
  }
}

HF PRO 订阅者每月可获得 2 美元的免费额度,用于推理提供商的使用。

使用 llama.cpp 的本地模型设置

本地运行模型可实现完整隐私、零 API 成本,并消除速率限制。

安装:

  • macOS/Linux: brew install llama.cpp
  • Windows: winget install llama.cpp

执行: 用户可以使用如下命令启动带内置 Web UI 的本地服务器:

llama-server -hf unsloth/Qwen3.5-35B-A3B-GGUF:UD-Q4_K_XL

对于该特定模型(Qwen3.5-35B-A3B),建议配备 32GB RAM。用户可以在 Hugging Face Hub 浏览数千个 GGUF 模型,以找到与其硬件兼容的模型。

OpenClaw 集成: 要将 OpenClaw 连接到本地 llama.cpp 实例,请使用以下配置命令:

openclaw onboard --non-interactive \
   --auth-choice custom-api-key \
   --custom-base-url "http://127.0.0.1:8080/v1" \
   --custom-model-id "unsloth-qwen3.5-35b-a3b-gguf" \
   --custom-api-key "llama.cpp" \
   --secret-input-mode plaintext \
   --custom-compatibility openai

可通过 curl 进行验证:curl http://127.0.0.1:8080/v1/models

对比:托管 vs 本地部署

特性 Hugging Face 推理提供商 本地设置(llama.cpp)
设置速度 最快 较慢
成本 基于 API(含部分免费额度) 零 API 成本
隐私 提供商托管 完全本地控制
硬件 无需本地硬件 需要兼容硬件
速率限制 受提供商限制 无速率限制

SUMMARY: Hugging Face 提供两种方法——Inference Providers 和本地 llama.cpp 设置——将 OpenClaw 代理从受限的 Claude 模型迁移到开源替代方案。

TITLE: Hugging Face OpenClaw 迁移指南

Sources