Gemini Omni 1.1 Flashとは?4つの進化

217 AI最新情報

※本記事にはアフィリエイトリンクが含まれます。機能、料金、提供地域は変更される場合があります。利用前にGoogle公式ページで最新情報をご確認ください。

Gemini Omni 1.1 Flashは、短い動画を作るだけでなく、続きを延長し、始点と終点を指定し、低解像度で試作してから4Kへ仕上げられる動画生成・編集モデルだ。2026年8月27日に一般提供が始まった。

Gemini Omni 1.1 Flashとは、Googleが提供する、テキスト・画像・動画を入力して音声付き動画を生成・編集できる高速モデルのことです。

この記事でわかること

  • Gemini Omni 1.1 Flashで増えた4つの制作機能
  • 360pで試作して当たりだけ4K化する手順と料金目安
  • シーン延長、参照動画、音声編集に関する制限

キーワード:Gemini Omni 1.1 Flash / AI動画生成 / シーン延長 / 4Kアップスケール / Google Flow

👑 総統の結論

総統

総統

3秒の宣伝映像を40秒の世界征服映画へ延長せよ! 失敗作は360pの闇へ葬るのだ!🔥

Omni 1.1 Flashの価値は、単純な画質向上よりも制作工程を制御しやすくなった点にある。直前10秒を踏まえた延長、最初と最後のフレーム指定、短い参照動画、安い360p試作を組み合わせると、短編動画の試行錯誤を速く回せる。

総統、3秒の映像を大作映画にしようとする

総統

総統

戦闘員! 黒焦団の威光を伝える大作映画を本日中に完成させよ。上映時間は最低40秒だ!
戦闘員

戦闘員

ハッ! 予算はどれほど用意されているでありますか?
総統

総統

無料に決まっておる。予算という言葉は敵の作った概念だ!
レイモンド分析官

レイモンド分析官

Gemini APIの動画出力は有料です。閣下の制作計画は、開始3秒で資金面の問題を迎えました
タコゾウ

タコゾウ

でも360pで下書きを作って、よかった案だけ高解像度にすれば無駄を減らせるっす。参照動画も使えるから、戦闘員の動きを別キャラへ移す実験もできそうっすよ
アカネ先生

アカネ先生

総統の映画はさておき、試作と本番を分けられるんは仕事では助かるやろね。最初から4Kを何本も作る豪快な予算管理、うちにはようせんわぁ

Googleは2026年8月27日、安定版のモデルID `gemini-omni-1.1-flash` を公開した。Google AI StudioとGemini APIから利用でき、Google FlowやGeminiアプリにも一部機能が展開されている。プレビュー版 `gemini-omni-flash-preview` は2026年9月30日に廃止予定だ。

日本語訳(要旨)

Gemini Omni 1.1 Flashは、シーン延長、最初と最後のフレーム指定、4K出力など、動画生成の操作性を強化する最新モデルだと案内しています。

Xで投稿を開く

Omni 1.1 Flashで変わった4つの機能

機能 できること 実務での使いどころ
シーン延長 既存動画の末尾へ3〜10秒の続きを生成 短いカットの延長、物語の分岐
First / Last Frame 開始画像と終了画像の間を動画化 カメラ移動、変身、ループ
参照動画 最大3本、各3秒までを参照 人物、動き、質感の一貫性維持
解像度制御 360p、720p、1080p、4Kを選択 下書きと本番出力の分離

シーン延長は直前10秒を見て続きを作る

シーン延長では、入力動画の末尾へ3〜10秒の続きを生成する。Googleによると、従来は最後の1秒を主に参照していたが、Omni 1.1 Flashは直前の最大10秒を文脈として扱う。人物、動き、光、音の流れを保ったまま続きを作りやすくなった。

延長は10秒単位で重ね、累計40秒までつなげられる。新しい映像を前へ足したり、途中へ挿入したりする機能ではなく、末尾への追加に限定される点には注意したい。

日本語訳(要旨)

夏の野原にいる二人の女性を描く短編風シーンで、最初から最後まで人物、金色の光、雰囲気を保てたという作例です。

Xで投稿を開く

戦闘員

戦闘員

人物と夕方の光がつながっているであります! これなら総統の演説も40秒まで延長できます!
レイモンド分析官

レイモンド分析官

演説の内容まで改善する機能ではありません。映像が自然につながることと、話が有益になることは別問題です

最初と最後のフレームから間を作る

First / Last Frame Interpolationは、開始画像と終了画像を渡し、その間の動きやカメラワークを生成する機能だ。被写体へ寄るズーム、場面を横切るウィップパン、昼から夜への変化などを、到達点を示したうえで作れる。

同じ画像を始点と終点に設定すれば、最後から最初へ戻りやすいループ動画も狙える。Google Flowは、同一画像を最初と最後へ置く作例を公開している。

日本語訳(要旨)

デスクトップ版Omni 1.1 Flashで最初と最後のフレームが使えるようになりました。両方に同じ画像を置くと、滑らかなループ動画を作れると案内しています。

Xで投稿を開く

タコゾウ

タコゾウ

同じ画像で始めて同じ画像へ戻せば、SNSで延々と再生されるループを作れるっすね
アカネ先生

アカネ先生

総統の同じ自慢話もようループしてるけど、あれは誰も指定してへんのよ

3秒の参照動画を最大3本まで使える

参照動画は1本あたり最大3秒、最大3本まで入力できる。特定の人物や物体、動作の見え方を動画で示し、生成結果へ反映させる用途だ。Googleの例では、3本のダンス動画をそれぞれ別のキャラクターへ割り当て、同じ空間で踊らせている。

参照動画の音声は無視される。複数の長い動画を理解して編集方針を導く機能でもないため、参照させたい特徴を短く明確に切り出す方が扱いやすい。

360pで試し、必要な案だけ4Kへ上げる

出力解像度は360p、720p、1080p、4K。標準は720pで、1080pと4Kはアップスケールによる出力だ。360pは720pよりシステムスループット基準で最大約60%速いとGoogleが案内している。

想定される流れは、360pで3〜4案を作り、構図や動きがよい案だけを720p以上へ仕上げる方法だ。生成のたびに人物の演技やカメラの動きが変わるため、最初から高解像度へ固定するより試行回数を確保しやすい。

日本語訳(要旨)

ComfyUIのPartner Nodesで利用開始。テキスト、画像、参照動画からの生成、編集、延長を1ノードで扱い、最大4Kと音声付き生成に対応すると案内しています。

Xで投稿を開く

API料金は解像度で大きく変わる

Gemini APIの有料枠では、入力が100万トークンあたり1.50ドル、テキスト出力が9ドル、動画出力が17.50ドル。動画は解像度ごとに1秒あたりのトークン数が異なる。

解像度 1秒の動画出力トークン 概算/秒 10秒の概算
360p 1,931 約0.034ドル 約0.34ドル
720p 5,792 約0.101ドル 約1.01ドル
1080p 8,688 約0.152ドル 約1.52ドル
4K 17,376 約0.304ドル 約3.04ドル

概算は動画出力単価だけを計算したもので、入力やテキスト出力、為替、利用する外部サービスの料金は含まない。Google FlowのサブスクリプションとGemini APIは課金方法が異なるため、同じ表で比較しない方がよい。

戦闘員

戦闘員

360pを4本作っても、720pを4本作るより出力料金を抑えやすいであります!
総統

総統

ならば360pで100本作り、全部4Kへ昇格させよ!
アカネ先生

アカネ先生

節約の説明から、きれいに浪費へ着地しはりましたなぁ

どこから利用できる?

まず画面で試す

開発環境を作らず試すなら、Google AI Studioが入口になる。Google Flowでは360pの下書き、First / Last Frame、1080p・4Kへの仕上げが用意され、Google AI Plus、Pro、Ultraの対象ユーザーへ展開されている。Geminiアプリではシーン延長が提供されている。

APIで制作工程へ組み込む

開発者はGemini APIのInteractions APIを利用する。以前に生成した動画を会話形式で延長する場合は `previous_interaction_id` を参照し、アップロード動画ならFiles APIで渡して末尾を延長できる。

編集指示は、変更点を短く限定した方が意図しない改変を抑えやすい。カットを入れたくない作例では、`single continuous unbroken shot, no scene cuts` のようにショット構造まで指定している。

日本語訳(要旨)

10秒・16:9・カットなしの連続ショットを指定するプロンプト例です。霧の高山滝と水流から始め、水滴を追う構成を示しています。

Xで投稿を開く

既存ツールから使う

Googleの発表では、Adobe Firefly、Figma Weave、Runwayなどの制作サービスでOmni Flashが利用されている。ComfyUIはPartner Nodesから、テキスト生成、画像からの生成、参照、編集、延長を1ノードで扱えると案内している。提供範囲や料金は各サービス側で異なる。

世界の作例を見る

日本では、企画にChatGPTを使い、動画、音楽、編集をOmni 1.1 Flashでまとめた自治体PR風の作例が公開された。完成映像だけでなく、企画から仕上げまでを同じモデル中心で進めた点が分かりやすい。

そのほかの公式・パートナー・ユーザー作例も、用途別に見比べると特徴をつかみやすい。

使う前に知っておきたい制限

  • アップロードして延長する入力動画は10秒以下
  • 延長できるのは動画の末尾で、先頭や途中への追加はできない
  • 会話中のアップロード動画へ、新しい台詞を足す延長には制限がある
  • 音声参照と音声だけの編集には対応していない
  • 参照動画の音声は無視される
  • YouTube URLを動画入力として直接指定できない
  • 複数動画を横断する複雑な推論は想定されていない
  • EEA、スイス、英国ではアップロード動画の延長に地域制限がある

生成結果にはSynthIDとC2PAの来歴情報が付く。公開時はそれだけに頼らず、人物の権利、商標、音楽、誤認を招く表現も確認したい。

レイモンド分析官

レイモンド分析官

短い動画を参照できることと、長い素材を理解して編集監督を代行できることは違います。制限を読まずに素材を積み上げても、入力が豪華になるだけです
タコゾウ

タコゾウ

長い参考映像を丸ごと入れるより、残したい動きだけ3秒に切った方がよさそうっすね

黒焦団 実戦検証レポート

戦闘員

戦闘員

まず黒焦団の登場シーンを360pで4案作ったであります。カメラの高さだけ変えて比較しました!
タコゾウ

タコゾウ

2案目が見やすいっす。次は戦闘員の敬礼動画を3秒の参照素材にして、別キャラへ動きを移してみるっす
レイモンド分析官

レイモンド分析官

変更する条件は一度に一つです。構図、照明、動き、台詞を同時に変えれば、何が効いたのか分からなくなります
総統

総統

余の登場時だけ、爆発、雷、火山噴火、宇宙艦隊を同時に追加せよ!
戦闘員

戦闘員

一度に一つという指示を、一度に四つ破ったであります!
タコゾウ

タコゾウ

爆発はあとにして、まずFirst FrameとLast Frameで総統が玉座へ座る動きを作るっす
レイモンド分析官

レイモンド分析官

動きが決まったら720pで音と表情を確認し、納品候補だけ1080pか4Kへ上げます。全案を高解像度化する必要はありません
アカネ先生

アカネ先生

実働部隊が順番を守ってくれたら、総統の思いつきも制作物にはなりますよ。監督できるモデルより、監督される総統の方が先に必要やったみたいやね

AI動画の試作や編集に使うPCを選ぶ時

クラウド型の動画AIでも、素材の整理、ブラウザでの比較、動画編集、バックアップにはPCの余裕が役立つ。ローカルで大きな動画モデルを動かせるかは別の話なので、GPUやメモリの要件は使うツールごとに確認したい。

Apple Mac mini MU9E3J/A M4モデルの商品画像

Apple Mac mini MU9E3J/A

M4/10コアCPU/10コアGPU/16GB/512GB。2024年発売の旧モデルで、最新のM6搭載機ではありません。

価格、在庫、保証内容は販売ページでご確認ください。

Apple Mac mini Z1JV000KD M4 Pro CTOモデルの商品画像

Apple Mac mini Z1JV000KD CTOモデル

M4 Pro/14コアCPU/20コアGPU/64GB/1TB。2024年世代の旧モデルであり、最新のM5 Pro搭載機ではありません。

価格、在庫、保証内容は販売ページでご確認ください。

アカネ先生のQ&A

Gemini Omni 1.1 Flashは無料で使える?

アカネ先生

アカネ先生

Gemini APIの動画生成は有料枠で考えた方がええね。FlowやGeminiアプリは契約プランとクレジットで条件が変わるし、画面に出る残量と公式料金を先に見てな

360pのまま公開してもいい?

アカネ先生

アカネ先生

動きの確認や社内の絵コンテ代わりなら使えるけど、公開用には粗さが目立つこともあるよ。360pは案を選ぶ場所、仕上げは選ばれた案だけ、くらいに分けると無駄が少ないわ

既存動画の途中を編集できる?

アカネ先生

アカネ先生

シーン延長は末尾へ続きを足す機能やし、途中へ新しい場面を差し込む機能ちゃうで。会話編集で変更できる内容もあるけど、元素材を残したい場所は短く具体的に指定した方がええね

日本語の台詞も安定する?

アカネ先生

アカネ先生

音声付き動画は作れるけど、英語以外の評価や台詞の安定性は自分の用途で確かめなあかんね。固有名詞、数字、口の動きまで必要なら、短いテストを何本か作ってから本番へ進みよし

まとめ

  • Omni 1.1 Flashは2026年8月27日にGAとなった動画生成・編集モデル
  • 直前10秒を踏まえ、末尾へ延長して累計40秒までつなげられる
  • 最初と最後のフレーム、最大3本の短い参照動画を指定できる
  • 360pで案を比較し、採用案だけ1080pや4Kへ仕上げると費用を抑えやすい
  • 音声参照、途中への挿入、複数動画を横断した推論には制限がある
総統

総統

完成した40秒映画を全世界の映画館で同時上映せよ! 4Kを超えて8Kにするのだ!
戦闘員

戦闘員

閣下、Omni 1.1 Flashの出力上限は4Kであります!
タコゾウ

タコゾウ

まず360pの試写を最後まで見てもらうっす。話はそこからっすね
アカネ先生

アカネ先生

尺を延ばす前に、見てもらえる中身を作らなあかんよ。画質だけ立派な40秒、えらい贅沢な沈黙になりそうやわ

参考リンク

関連記事

AIを学んだら、次は働き方や資格も見直してみる
AIの使い方を覚えてきたら、転職や資格学習で自分の市場価値を確認してみるのも現実的です。新機能を追うだけでなく、仕事で使える土台も整えておくと安心です。

AIスキルを仕事に活かすなら、転職・キャリア相談も選択肢に。


AIスキルを活かした転職を考える

AI時代を生き抜くなら、資格で基礎を固めるのもあり。


AI時代に役立つ資格学習を考える

— Join the Legion —

🥷 秘密結社「黒焦団」の暗躍を追え

最新のAI活用術や、ブログに書けない工作員限定の裏話はSNSで潜伏中。
乗り遅れるな、工作員諸君。世界征服の準備は整っている。

コメント

タイトルとURLをコピーしました