Imagine Video 1.5 帶參考資料版本的更新說明

xAI 已推出 Imagine Video 1.5 的更新,新增文字轉影片功能、原生 1080p 解析度,以及使用影像與語音參考來維持生成影片中的一致性。

文字轉影片與原生 1080p 支援

Imagine Video 1.5 現在支援文字轉影片與影像轉影片工作流程的原生 1080p 生成。文字轉影片功能讓使用者僅憑文字提示即可生成影片內容,不再需要起始影像。這項功能透過結合 xAI 的影像生成技術與影像轉影片技術實現。

這些功能目前已在 grok.com/imagine、iOS 與 Android 平台上正式推出。

語音與角色一致性

Imagine Video 1.5 支援使用影像與語音參考,以確保不同場景間的一致性。透過提供角色影像與語音參考,模型能在整個影片生成過程中維持相同的面部特徵與語音。

多參考控制

模型現在支援每批次生成最多七個參考資料。這讓使用者能鎖定特定元素——例如臉部、產品或地點——同時調整其他參數。使用者可以:

  • 保留角色,更換場景。
  • 保留場景,更換角色。
    • 同時固定角色與場景,僅變更動作。

API 可用性與整合

影像參考、文字轉影片與原生 1080p 功能目前已透過 grok-imagine-video-1.5 模型在 xAI API 中上線。語音參考支援則可透過 xAI 銷售團隊申請取得。

API 實作範例

開發者可使用以下 Python SDK 結構來實作影片生成:

import os
import xai_sdk

client = xai_sdk.Client(api_key=os.getenv("XAI_API_KEY"))

response = client.video.generate(
    prompt="Slow cinematic push-in as embers drift across the battlefield and the helmet's crest stirs in the wind",
    model="grok-imagine-video-1.5",
    reference_image_urls=["https://example.com/helmet.jpg"],
    duration=6,
    aspect_ratio="16:9",
    resolution="720p",
)

print(response.url)

可用性

影像與語音參考功能將於 2026 年 7 月 31 日起,在美國地區提供給 grok.com/imagine 與 iOS 上的 SuperGrok Heavy 與 SuperGrok Plus 使用者,其餘等級使用者將於接下來幾天陸續開放。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch