OpenAI 新嵌入模型和 API 更新(2024 年 1 月)
OpenAI 已发布 text-embedding-3-small 和 text-embedding-3-large,两者相较于之前的 text-embedding-ada-002 模型均提供了性能提升。
新文本嵌入模型
text-embedding-3-small
text-embedding-3-small 旨在实现高效率,并在提升检索性能的同时降低成本。
- 性能提升: 在多语言检索的 MIRACL 基准上,平均分从 31.4%(
ada-002)提升至 44.0%。在英文任务的 MTEB 基准上,分数从 61.0% 提升至 62.3%。 - 成本降低: 与
text-embedding-ada-002相比,价格降低了 5 倍,从每千标记 $0.0001 降至 $0.00002。
text-embedding-3-large
text-embedding-3-large 是 OpenAI 提供的性能最高的嵌入模型,支持最高 3072 维度。
- 性能提升: 在 MIRACL 基准上,平均分从 31.4%(
ada-002)提升至 54.9%。在 MTEB 基准上,分数从 61.0% 提升至 64.6%。
原生嵌入缩短
这两款新嵌入模型均支持 dimensions API 参数,开发者可以通过删除序列末尾的数字来缩短嵌入向量,而不失去核心概念表示属性。这使得在性能与计算、内存、存储成本之间实现权衡成为可能。
例如,将 text-embedding-3-large 的嵌入向量缩短至 256 维,在 MTEB 基准上仍然优于未缩短的 1536 维 text-embedding-ada-002 嵌入向量。
GPT 模型更新与定价
OpenAI 已更新其主要的大语言模型(LLM)产品,以提升准确性并降低开发者的运营成本。
GPT-3.5 Turbo (gpt-3.5-turbo-0125)
该模型于 2024 年初推出,具备对请求格式更高的准确性,并修复了影响非英语语言函数调用的文本编码错误。
- 价格下调: 输入价格降低 50%,至每千标记 $0.0005,输出价格降低 25%,至每千标记 $0.0015。
- 部署: 使用未固定的
gpt-3.5-turbo别名的用户将在发布两周后自动从gpt-3.5-turbo-0613升级到gpt-3.5-turbo-0125。
GPT-4 Turbo 预览版 (gpt-4-0125-preview)
更新后的 GPT-4 Turbo 预览版旨在在代码生成等任务上更为彻底,并减少模型因“懒惰”而未完成任务的情况。它还包含了对非英语 UTF-8 生成错误的修复。
OpenAI 引入了 gpt-4-turbo-preview 别名,始终指向最新的 GPT-4 Turbo 预览模型。带视觉功能的 GPT-4 Turbo 的通用可用性预计将在未来几个月内推出。
安全性与平台改进
更新的内容审核模型
OpenAI 发布了 text-moderation-007,这是迄今为止最强大的内容审核模型。text-moderation-latest 和 text-moderation-stable 别名现指向该版本。
API 密钥与使用管理
两个新的平台功能为开发者提供了更细粒度的控制和可视化:
- API 密钥权限: 开发者现在可以为 API 密钥分配特定权限,例如只读访问或对特定端点的限制。
- 密钥级使用指标: 启用跟踪后,使用仪表板和导出功能将提供 API 密钥级别的指标,帮助开发者按功能、团队、产品或项目跟踪使用情况。