
Grok 可以生成影片嗎?Grok Imagine 2026 使用指南
Grok Imagine 可從文字或靜態圖片生成影片。本文整理模式、限制、提示詞結構、所需積分,以及文字與圖片工作流程的選擇方式。
可以。Grok 能透過 Grok Imagine 生成影片。 你可以從文字描述建立場景,也可以讓靜態圖片成為第一個影格並加入動態。
重要的區別在於 xAI 的完整視訊 API 支援的內容和特定工作區公開的內容。 xAI 記錄了更廣泛的系列,包括文字轉影片、影像到影片、參考引導生成、影片編輯和擴充。 Epochal 上的 Grok Imagine 工作區 重點關注前兩個,並具有一組較小的用於短剪輯的控制。
快速回答
- 只有文字想法時,從文字轉影片開始
- 已有理想的第一個影格時,從圖片轉影片開始
- Epochal 提供 6 秒或 10 秒、480p 或 720p
- Grok 影片採積分計費,註冊贈送的積分不足以完成一次生成
Grok 可以生成哪些類型的影片?
xAI 的文檔將 Grok Imagine 影片視為不只一種生成模式。 這並不意味著每個介面都會公開每種模式。
| 能力 | xAI 視訊 API(2026 年 8 月 3 日) | Epochal 工作區(2026 年 8 月 3 日) |
|---|---|---|
| 文字轉影片 | 是 | 是 |
| 圖片轉影片 | 是 | 是,使用一張來源圖片 |
| 參考圖轉影片 | 是 | 未提供 |
| 編輯現有影片 | 是 | 未提供 |
| 延長現有影片 | 是 | 未提供 |
| 長度 | 1-15 秒 | 6 秒或 10 秒 |
| 解析度 | Grok Imagine Video 1.5 的 Text-to-Video 與 Image-to-Video 支援 480p、720p,最高 1080p | 480p 或 720p |
在閱讀教學時,這種分離很重要。 為 xAI API 編寫的指南可能會顯示 Epochal 工作區中不存在的控件,而 Epochal 產生不需要 API 設定或輪詢程式碼。
文字轉影片或圖片轉影片:該怎麼選?
當場景仍需要發明時,請使用文字到視訊。 提示包含主題、設定、動作、相機行為和氛圍。 它是不依賴現有合成的概念剪輯和場景的更靈活的起點。
當您已經擁有正確的第一幀時,請使用圖像到視訊。 產品照片、肖像、插圖、海報或概念圖像可以錨定主題和構圖,而提示則著重於運動。
| 你的起點 | 更好的工作流程 | 為什麼 |
|---|---|---|
| 沒有經過批准的框架的書面想法 | 文字轉視頻 | 提示定義了外觀和動作 |
| 帶有經批准的框架的產品圖片 | 影像轉視頻 | 來源影像錨定開場構圖 |
| 肖像或人物設計 | 影像轉視頻 | 靜止影像為模型提供了具體的視覺參考 |
| 一個想法的多種長寬比 | 文字轉視頻 | Epochal 公開 16:9、1:1 和 9:16 控件 |
| 已依用途裁切的靜態圖片 | 圖片轉影片 | 準備好的裁切範圍會成為取景起點 |
如果來源影像已經完成了大部分視覺工作,請不要重複提示中的每個可見細節。 相反,請描述隨著時間的推移發生了什麼變化。
如何在 Epochal 生成 Grok 影片
1. 選擇起始模式
開啟Grok Imagine並選擇文字轉影片或影像轉影片。 對於圖像轉視頻,上傳一張已具有清晰主題和要保留的裁剪的源圖像。
2. 圍繞動作撰寫提示詞
對於文字轉視頻,請使用以下順序:
拍攝對象與背景+拍攝對象動作+相機行為+氣氛+穩定性指引
例子:
夜間,一名騎自行車的人在霓虹燈閃爍的火車站台下等待。 雨在燈光下移動,火車抵達。 攝影機緩慢推向騎車人,手持運動受到限制,潮濕路面上的真實反射。 保持自行車幾何形狀和騎手服裝一致。
對於圖像到視頻,請使用以下順序:
相機運動+主體運動+環境運動+必須保持穩定的東西
例子:
從左向右緩慢環繞。布料在微風中輕柔擺動,柔和高光掠過產品。保持標籤、比例、背景構圖和原始配色不變。
特定的運動動詞,如「推入」、「向左平移」、「緩慢旋轉」、「漂移」和「保持鎖定」比「使其成為電影」的廣泛要求更容易評估。
3. 選擇時長、解析度和取景
在 Epochal 上,兩個工作流程均支援 6 秒或 10 秒以及 480p 或 720p。 文字轉影片還提供 16:9、1:1 和 9:16。
影像到影片不顯示單獨的寬高比控制。 在上傳之前裁剪目標目的地的來源圖像,而不是期望生成步驟重新設計框架。
4. 一次檢查一個變數
檢查結果停止工作的第一時刻:
- 主題是否仍可識別?
- 所請求的運動方向是否正確?
- 標籤、手、臉部和直線邊緣是否保持穩定?
- 攝影機的移動是否適合可用的六秒或十秒?
- 添加運動後裁剪仍然有效嗎?
每次只更改提示詞、長度、解析度或來源圖片中的一項。若全部一起更改,就很難判斷是哪個調整改善了結果。
Grok Imagine 影片設定與積分成本
確切的信用金額在產生之前顯示。 截至 2026 年 8 月 3 日,組合如下:
| 工作流程 | 長度 | 解析度 | 積分 |
|---|---|---|---|
| 文字轉視頻 | 6秒 | 480p | 90 |
| 文字轉視頻 | 6秒 | 720p | 126 |
| 文字轉視頻 | 10秒 | 480p | 150 |
| 文字轉視頻 | 10秒 | 720p | 210 |
| 影像轉視頻 | 6秒 | 480p | 91 |
| 影像轉視頻 | 6秒 | 720p | 127 |
| 影像轉視頻 | 10秒 | 480p | 151 |
| 影像轉視頻 | 10秒 | 720p | 211 |
在相同長度和解析度下,圖片轉影片比文字轉影片多 1 積分。較長的影片和 720p 都會提高成本,因此可先用 6 秒、480p 測試提示詞方向。
Grok 影片生成免費嗎?
不在 Epochal 上。 新的經過驗證的帳戶將獲得 15 個註冊積分,而最便宜的 Grok Imagine 視訊配置則需要 90 個積分。 因此,註冊禮物本身並不包含 Grok 影片。
Grok 自有產品的存取規則也可能會根據計劃和時間而改變。 謹慎對待有關無限免費生成的聲明,並在依賴產品條款之前檢查產品條款。
Grok 會產生有音訊的影片嗎?
xAI 的視訊 API 文件稱生成的視訊預設包含音軌,官方 Grok Imagine Video 1.5 公告討論了生成的音效、氛圍、對話和語音同步。
此官方功能不應與每個第三方介面中的音訊控制混淆。 Epochal 不公開單獨的 Grok 音訊開關、語音選擇器或上傳音訊控制。 檢查返回的剪輯的音頻,而不是圍繞工作區中不存在的設置規劃受控音軌。
Epochal 是否使用 Grok Imagine Video 1.5?
Epochal 標記工作區 Grok Imagine 並公開上面列出的控制項。 它不會將工作流程呈現為特定於版本的 Grok Imagine Video 1.5 整合。
xAI 的 1.5 文件對於理解官方模型系列仍然有用,但其 1080p、更寬的持續時間範圍、參考工作流程、編輯和擴展功能不應被視為 Epochal 上可用的控件,除非它們出現在工作區中。
當 Grok Imagine 不是正確的工作流程時
當作業需要時選擇另一個工作流程:
- 在 Epochal Grok 頁面內編輯或擴充現有影片文件
- 不只一張參考影像
- Epochal 控制裝置保證 1080p 輸出
- 精確上傳音訊或語音控制
- 超越短生成鏡頭的長形式定序
Grok Imagine 作為短鏡頭產生器比作為完整的影片編輯器更有用。 產生受控剪輯,然後在編輯器中處理修剪、標題、聲音設計和多鏡頭組合。
常見問題
Grok AI 可以根據文字提示製作影片嗎?
是的。 選擇文字轉視頻,描述場景和動作,然後在 Epochal 上選擇 6 或 10 秒、480p 或 720p 以及 16:9、1:1 或 9:16 寬高比。
Grok 可以為照片製作動畫嗎?
是的。 影像到影片使用一個來源影像作為起始影格。 描述相機運動、主體運動和環境運動,同時說明哪些細節應保持穩定。
Grok 影片可以多長?
xAI 的 API 記錄了 1-15 秒的持續時間範圍。 Epochal 提供 6 或 10 秒,因此使用可見工作區控制項作為 Epochal 產生的限制。
Grok 可以編輯 Epochal 上的現有影片嗎?
不是透過 Epochal 上的 Grok 工作區。 xAI 在其更廣泛的 API 中記錄編輯和擴展,但 Epochal 僅公開文字到影片和圖像到影片。
Epochal 上最便宜的 Grok 影片設定是什麼?
截至 2026 年 8 月 3 日,產生 6 秒 480p 文字到影片需要花費 90 個積分。相應的圖像到視訊設定需要花費 91 個積分。 提交前請檢查顯示的費用,因為價格可能會有所變動。
從正確的第一個影格開始
如果場景只存在於文字中,請開啟 Grok 文字轉影片。如果構圖已經確定,請使用 Grok 圖片轉影片,讓提示詞專注於動作。
來源
- xAI 影片產生文件:docs.x.ai/developers/model-capability/video/ Generation
- xAI 影像到影片文件:docs.x.ai/developers/model-capability/video/image-to-video
- xAI Grok Imagine Video 1.5公告:x.ai/news/grok-imagine-video-1-5
更多文章
更多
Veo 3.1 vs Sora 2:哪個 AI 影片模型最適合你的工作流程?
從畫質、速度、音訊、成本與實際工作流程全面比較 Google Veo 3.1 與 OpenAI Sora 2,看看哪個模型最適合你的使用情境。

Veo 3.1 vs Seedance 2.0:誰更適合你的內容工作流?
如果你正在比較 Veo 3.1 和 Seedance 2.0,這篇文章會從畫面質量、可控性、產能效率和商業落地四個層面,告訴你誰更適合品牌片,誰更適合高頻內容生產。

如何在自己的電腦上運行本地 AI 影片生成器
本地運行 AI 影片生成的實用指南,涵蓋安裝工具、硬體需求、隱私優勢,以及何時該改用雲端工具來節省時間。




