Grok Imagine Video 1.5 发布说明

xAI 已推出 Grok Imagine Video 1.5,这是一款新的图像转视频模型,可提升运动效果、物理真实感和音频同步。该模型现已通过 xAI API 公开可用,并可通过 grok.com 以及 iOS 和 Android 应用访问。

集成音频与语音生成

  • 音频同步:Grok Imagine Video 1.5 可在单次处理中生成音效、环境音和对话,确保音频与动作精准对齐。
  • 语音质量:模型提供更清晰的语音,并改善了音频与视觉元素之间的同步。

运动与物理效果改进

  • 时间一致性:视频片段全程运动保持一致,减少视觉扭曲现象。
  • 物理真实感:模型生成的视频中物体的重量和动量更加可信。

生成速度与性能

  • Video 1.5 快速版:相比上一版本,该版本的生成速度几乎翻倍。
  • 性能指标:Grok Imagine Video 1.5 快速版可在约 25 秒内生成一段 6 秒、720p 的视频,相比上一版本的 40 多秒显著缩短。

创作工作流与生产力功能

xAI 正在 Grok Imagine 界面中引入多项新功能,以提升工作效率:

  • 项目:用户现在可将工作组织为位于左侧边栏的“项目”。
  • 多代理支持:系统支持并行处理,允许用户同时运行多个提示,而无需等待前一个生成完成即可开始下一个。
  • 搜索功能:新增了库搜索功能,帮助用户快速定位特定图像或视频,无需滚动浏览历史记录。

API 可用性与技术规格

Grok Imagine Video 1.5 现已在 xAI API 中正式上线,模型标识符为 grok-imagine-video-1.5。API 允许用户输入起始图像和运动描述,同时选择所需的分辨率和时长。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch