OpenAI GPT-4o 发布及 ChatGPT 免费层增强
OpenAI 推出了 GPT-4o,这是一款新的旗舰模型,提供 GPT-4 级别的智能,并在速度以及跨文本、语音和视觉的多模态能力上有显著提升。此发布扩大了高级 AI 工具的可及性,使得 GPT-4 级别的智能对 ChatGPT 免费用户也可用,但有特定的使用限制。
GPT-4o 多模态能力
GPT-4o 旨在更擅长理解和讨论图像、文本和音频。关键能力包括:
- 视觉和图像理解: 模型可以翻译外语菜单,解释食物的历史,并根据共享的图像提供推荐。
- 实时交互: 未来的更新将实现自然的实时语音对话和实时视频交互,例如通过摄像头画面解释现场体育比赛的规则。
- 语言支持: GPT-4o 在语言能力上具备更高的质量和速度,ChatGPT 现在在注册、登录和用户设置等环节支持超过 50 种语言。
可用性和使用限制
GPT-4o 正在向 ChatGPT Plus、Team 和 Enterprise 用户以及 ChatGPT 免费用户推出。访问权限按用户层级划分:
- ChatGPT 免费: 用户可以在使用限制内访问 GPT-4o。达到限制后,系统会自动切换到 GPT-3.5。
- ChatGPT Plus: 用户的消息限制是免费用户的 5 倍。
- ChatGPT Team 和 Enterprise: 这些层级提供最高的消息限制。
新工具和平台更新
OpenAI 正在推出多项平台更新,以提升用户体验:
- 桌面语音对话: 现在可以通过桌面应用直接在电脑上进行语音对话,帮助用户进行头脑风暴或面试准备。
- macOS 应用: macOS 应用首先向 Plus 用户推出,随后在数周内更广泛发布。Windows 版计划在今年晚些时候推出。
- 用户界面: ChatGPT 正在获得全新的外观和体验,包括重新设计的主页和消息布局,使其更具对话性和友好性。
未来路线图
OpenAI 计划在接下来的几周内以 alpha 版推出全新的语音模式,并向 Plus 用户提供抢先体验。该模式将利用 GPT-4o 的高级音频和视频能力,实现更自然的实时交互。