OpenAI 企业 API 功能更新 2024年4月
OpenAI 已发布一套面向其 API 客户的企业级功能,旨在提升安全性、管理监督以及组织在扩展 AI 部署时的成本效率。这些更新包括用于安全 Azure 通信的 Private Link、新的 Projects 管理系统、Assistants API 的大幅扩容以及针对承诺使用和异步工作负载的折扣定价。
加强的企业安全与合规
OpenAI 已扩展其安全体系,以最小化互联网暴露并提升企业用户的访问控制。
- Private Link: 一种新的连接选项,使 Azure 与 OpenAI 之间实现直接通信,降低对公开互联网的暴露。
- Multi-Factor Authentication (MFA): 现在提供原生 MFA,以满足更严格的组织访问控制要求。
- Existing Security Framework: 这些新增功能补充了现有的认证和协议,包括 SOC 2 Type II 认证、单点登录(SSO)、AES-256 静态加密以及 TLS 1.2 传输加密。
- Healthcare Compliance: OpenAI 继续提供业务关联协议(BAAs)以满足 HIPAA 合规要求,并对符合条件的 API 使用场景实施零数据保留政策。
通过项目实现细粒度管理控制
全新的 “Projects” 功能使组织能够在不同内部计划之间实现更精确的监督和资源分配。
- Scoped Access: 管理员现在可以将角色和 API 密钥限定在特定项目,并对这些项目的模型使用进行限制或授权。
- Resource Management: 可以为项目级别的使用量和基于速率的限制设定阈值,以防止意外的预算超支。
- Service Accounts: 项目所有者可以创建服务账户 API 密钥,实现不绑定具体个人用户账户的项目访问。
Assistants API 技术改进
Assistants API 的更新聚焦于提升数据检索规模、改善响应延迟,并提供对模型行为的更细粒度控制。
检索与数据管理
file_searchScaling: 检索工具现在支持每个助理最多 10,000 个文件,较之前的 20 上限提升了 500 倍。该工具具备多线程搜索以实现并行查询,并改进了重新排序和查询改写功能。vector_storeObjects: 新的向量存储对象可自动完成文件的解析、切块和嵌入。这些存储可以在多个助理和线程之间共享,以简化计费和文件管理。
执行与控制
- Streaming Support: API 现已支持流式传输,实现实时对话响应。
tool_choiceParameter: 开发者现在可以为特定运行显式选择特定工具(如code_interpreter、file_search或特定function)。- Fine-tuned Model Support: API 现已支持微调的 GPT-3.5 Turbo 模型,起始于
gpt-3.5-turbo-0125。
成本控制
- Token Limits: 用户现在可以为每次运行设置最大 token 数量,并限制每次运行中使用的先前和最近消息的数量,以便管理成本。
企业成本管理选项
OpenAI 引入了两种新的定价模式,以降低大批量和非紧急工作负载的成本。
- Provisioned Throughput: 对于在 GPT-4 或 GPT-4 Turbo 上持续使用每分钟 token(TPM)的客户,可申请预配吞吐量,根据承诺规模提供 10% 至 50% 的折扣。
- Batch API: 对于非紧急任务——如合成数据生成、离线分类、摘要和模型评估——Batch API 允许异步处理。Batch API 请求的定价比共享价格低 50%,提供更高的速率限制,并在 24 小时内返回结果。