Grok Imagine動画アップデートの解説
短尺生成、速度、ソーシャル向けの実験という観点で、クリエイターがGrok Imagineの動画アップデートをどう捉えているかを見るのに役立ちます。
テキスト プロンプトから短いビデオを作成したり、Grok Imagine を使用して静止画像をアニメーション化したりできます。 Epochal では 6 秒または 10 秒、および 480p または 720p 出力を選択します。
動画を作成する準備ができました
このワークスペースで生成すると、最新の結果が以下のサポート コンテンツとともにここに表示されます。
Grok Imagine Video は、テキスト プロンプトからクリップを生成したり、動きの指示で静止画をアニメーション化するための xAI のビデオ モデルです。 xAI の公式 Imagine API は、リファレンス主導の生成、ビデオ編集、ビデオ拡張もカバーしています。 この Epochal ページは現在、1 つのモデル ワークスペースで Text-to-Video と Image-to-Video を提供しています。
Grok Imagine preview 1
Grok Imagine
Grok Imagine Video は、いくつかの公式ビデオ モードをサポートしています。 Epochal では、実際的な選択は、書かれたシーンから短いクリップを生成するか、比較を制御するためのコンパクトな持続時間と解像度のコントロールを使用して 1 つの既存の画像をアニメーション化するかのどちらかです。
主題、アクション、カメラの動作、雰囲気を説明するプロンプトから始めます。 xAI は標準の Grok Imagine Video モードとしてテキストからビデオへの文書化を行い、現在の Epochal ワークフローには短いコンセプト クリップの出力コントロールが追加されています。
静止画を 1 枚アップロードし、それがどのように動くかを説明します。 画像が開始フレームとなるため、構図、被写体の外観、または製品のフレーミングを既存のビジュアルから開始する必要がある場合に、このワークフローが役立ちます。
現在の両方の Epochal ワークフローは、480p または 720p で 6 秒または 10 秒続くクリップをサポートしています。 Text-to-Video は 16:9、1:1、および 9:16 出力も公開します。 Image-to-Video では、ソース画像をビジュアルおよびフレーミングの開始点として使用します。
xAI は、Text-to-Video、Image-to-Video、Reference-to-Video、ビデオ編集、および拡張を個別の Grok Imagine Video ワークフローとして文書化します。 Epochal は現在、最初の 2 つを公開しているため、単語から開始するか静止画像から開始するかに関係なく、アクティブなタブが一致する必要があります。
これらのクリエイター walkthrough は、Grok Imagine Video が短尺生成やプロンプト主導の実験で実際にどう使われているかを理解するのに役立ちます。
短尺生成、速度、ソーシャル向けの実験という観点で、クリエイターがGrok Imagineの動画アップデートをどう捉えているかを見るのに役立ちます。
プロンプト主導の動画実験でGrok Imagineがどう使われているかを、より実践的なクリエイター視点で見たいときに役立ちます。
image-to-video、プロンプトのコツ、短尺クリエイター用途に焦点を当てた実用的な解説です。
これらの xAI 関連やクリエイター側の公開参照は、Grok Imagine が単なる画像生成製品ではなく、実際に動いている動画モデルかどうかを判断するのに役立ちます。
Grok Imagine Video は、いくつかの公式ビデオ モードをサポートしています。 Epochal では、実際的な選択は、書かれたシーンから短いクリップを生成するか、比較を制御するためのコンパクトな持続時間と解像度のコントロールを使用して 1 つの既存の画像をアニメーション化するかのどちらかです。
書かれたシーンを短い風景、正方形、または縦長のビデオに変換して、さらに制作する前に被写体、カメラの方向、ペースをテストします。
準備された製品画像を最初のフレームとして使用し、テキストから開始構成を再構築することなく、抑制されたカメラの動き、環境の動き、または短い露出をリクエストします。
元の画像を使用して外観と構成を固定しながら、焦点を当てたモーション プロンプトを使用してポートレート、イラスト、またはコンセプト フレームをアニメーション化します。
Text-to-Video を使用して、横向き、正方形、および垂直のフレームを比較したり、さまざまな出力先に Image-to-Video を実行する前に別のソース クロップを準備したりできます。
AI動画ワークフロー
Kuaishou
AI動画ワークフロー
ByteDance
ByteDance: Seedance 2.0 AI動画生成、マルチショット叙事とネイティブ音声向け
Wan
Alibaba Cloud: Wan 2.7 AI動画生成、初フレーム主導の動きとプロンプト改善向け
Kuaishou
Kling Motion Control AI動画生成 | 参照動画ベースのモーショントランスファー
はい。 Text-to-Video は書かれたシーンから始まりますが、Image-to-Video では 1 つのソース画像とモーション プロンプトが必要です。 どちらのワークフローも、同じ Grok Imagine モデル ページのタブとして利用できます。
Epochal の Grok Imagine は動画モデルです。Text-to-Video と Image-to-Video で短いクリップを作成しますが、静止画は作成しません。画像を生成または編集するには、Text to Image ワークスペースを使用してください。
シーン全体を言葉で定義でき、16:9、1:1、または 9:16 出力を選択する場合は、Text-to-Video を使用します。 既存の画像で冒頭の主題と構成を定義する必要がある場合は、Image-to-Video を使用します。
どちらのワークフローも、480p または 720p で 6 秒または 10 秒続くクリップをサポートしています。 Text-to-Video は、16:9、1:1、および 9:16 のアスペクト比もサポートします。 Image-to-Video には 1 つのソース画像が必要ですが、このページでは別個のアスペクト比コントロールは公開されません。
Epochal では、Grok Imagine のクリップは 6 秒または 10 秒で、480p または 720p です。これより長い再生時間はこのページでは提供していません。
xAI はビデオ編集と拡張を Grok Imagine Video ワークフローとして文書化していますが、この Epochal ページでは現在 Text-to-Video と Image-to-Video のみを公開しています。 静止画像のアップロードがサポートされています。 既存のビデオをアップロードして編集することは、これら 2 つのタブには含まれません。
いいえ。Epochal はプラットフォームおよびプロバイダの安全ポリシーを適用するため、スパイシー、検閲なし、NSFW の各モードはありません。結果に「モデレートされました」と表示された場合、そのリクエストは安全ポリシーによりブロックされ、生成されていません。
xAI は開発者ドキュメントで公式の Imagine API を提供しています。Epochal ではコードを書かずに Grok Imagine の動画を生成でき、生成前にクレジット コストが表示されます。
現在の Text-to-Video 構成の範囲は 90 ~ 210 クレジットです。 Image-to-Video の範囲は 91 ~ 211 クレジットです。 正確な量は生成前に表示され、期間と解像度によって異なります。