OpenAI 推出 GPT‑4o 微调功能,提供免费令牌配额并宣布平台下线

TL;DR

OpenAI 已推出 GPT‑4o 的微调功能,让开发者仅使用数十个示例即可定制模型,并提供截至 9 月 23 日的免费训练令牌配额;该服务将在 2026 年 5 月 8 日后对新用户逐步停止。

公告概览

OpenAI 宣布其 GPT‑4o 模型现已支持微调。此功能响应了开发者的核心需求,能够创建针对特定应用提供更高性能和更低推理成本的自定义 GPT‑4o 版本。此次发布为每个组织提供每日 100 万训练令牌的免费配额,直至 2024 年 9 月 23 日。

入门指南

  • GPT‑4o 的微调对所有使用付费套餐的开发者开放。
  • 要创建微调模型,用户进入微调仪表板,点击 Create,并选择基础模型 gpt-4o-2024-08-06
  • 训练费用为每百万令牌 25 美元;推理费用为每百万输入令牌 3.75 美元和每百万输出令牌 15 美元。
  • 还有更小的变体 GPT‑4o mini 可供选择。用户选择 gpt-4o-mini-2024-07-18,并在 9 月 23 日前每日获得 200 万免费训练令牌。
  • 详细的使用说明请参阅 OpenAI 的微调文档。

早期合作伙伴展示的性能提升

Cosine 的 Genie AI Engineer

  • Cosine 对 GPT‑4o 进行微调,打造了 Genie,一款 AI 软件工程助理。
  • Genie 在 SWE‑bench Verified 基准上取得了 43.8 % 的最新技术(SOTA)得分,超过了之前的最佳 19.27 %。
  • 在完整的 SWE‑bench 基准上,Genie 达到 30.08 %,创下该测试有史以来最大的提升。
  • 该微调模型使用真实工程案例进行训练,能够输出已准备好提交的代码补丁。

Distyl 的 BIRD‑SQL 排行榜胜利

  • Distyl 为文本转 SQL 任务对 GPT‑4o 进行微调。
  • 该微调模型在 BIRD‑SQL 基准上获得 第一名,执行准确率为 71.83 %
  • Distyl 报告称模型在查询改写、意图分类、链式思考推理和自我纠正方面表现出色,尤其在 SQL 生成上表现突出。

数据隐私与安全保证

  • 微调模型完全归开发者所有;OpenAI 不会保留或在其他模型中重复使用训练数据。
  • OpenAI 对微调模型进行持续的自动安全评估,并监控使用情况以确保遵守政策。

即将到来的平台下线

  • 更新(2026 年 5 月 8 日): OpenAI 将逐步关闭微调平台。
  • 新用户将无法再访问平台,但现有用户仍可在数月内创建训练任务。
  • 所有微调模型将在其基础模型被弃用之前保持可供推理使用,具体时间请参见官方的弃用时间表。

对开发者的影响

  • GPT‑4o 的微调降低了构建特定领域 AI 应用的门槛,只需少量数据集。
  • 免费令牌配额加速了实验和早期采用。
  • 宣布的下线意味着组织应在平台不可访问之前规划迁移或导出策略。

感兴趣的开发者的后续步骤

  • 前往微调仪表板创建新任务。
  • 查看定价和免费令牌限制。
  • 查阅文档,了解数据集准备和安全测试的最佳实践。
  • 联系 OpenAI 的定制模型团队,获取更多定制选项。

作者:Andrew Peng, John Allard, Steven Heidel

Sources