Veo 3.1 徹底レビュー
基本スペック
| 開発元 | Google DeepMind |
| 国・地域 | アメリカ |
| リリース | 2025-10 |
| 生成タイプ | テキスト動画生成+画像動画生成 |
| 1クリップの尺 | 8秒(Flowのシーン機能で60秒以上に拡張可能) |
| 解像度 | 1080p(4Kアップスケール) |
| ネイティブ音声 | ネイティブなセリフ+強化された効果音 |
| リップシンク | 多言語リップシンク |
| アスペクト比 | 16:9 / 9:16 |
| 価格(参考) | Google AIサブスクに含まれる;APIはVeo 3と同水準でやや上乗せ |
| API | ✅ あり✅ |
| 無料枠 | Geminiアプリで少量の無料体験 |
編集部評価
👍 強み
- 画像動画生成と参照画像コントロールが大幅強化(開始・終了フレーム/複数参照画像)
- ストーリーの一貫性とキャラクターの一貫性がVeo 3より優れる
- Flow内でシーンの延長やカットの続き生成に対応
👎 弱み
- 料金体系は変わらず、依然として割高
- 基本の長さは依然8秒
- 一部のスタイル表現(アニメ・水墨画調)は中国製モデルに及ばない
参照画像制御こそが3.1の本当のアップグレードの目玉
Veo 3の発表から半年後に3.1が登場したとき、多くの人の第一印象は「またバージョン番号が1増えただけの定例アップデート」でした。ですが実際に使ってみると、まったくそんな話ではありません。この世代で本当に力を入れているのは参照画像制御で、開始・終了フレーム指定と複数参照画像入力の両方が大幅に強化されています。以前はキャラクターがシリーズ全体を通して同じ顔・同じ衣装を保つには、基本的に運と何度もリロールする根気に頼るしかありませんでした。3.1では1枚か数枚の参照画像を渡すだけで、モデルによるキャラクター特徴のロックが明らかに強くなり、ブレにくくなっています。
このアップグレードの方向性は実はかなり賢い選択です。というのもVeo 3が当初一番叩かれていたのは画質ではなく、ナラティブの一貫性のほうだったからです。単発の8秒セグメントはそれぞれ見ればクオリティは悪くないのですが、キャラクターが連続するシリーズものにつなげようとすると前後のつながりがよく崩れていました。3.1はこの弱点を直接埋めていて、キャラクター一貫性のスコアは8から9へと一気に上がっています。これはマーケティング文句ではなく、実際の技術投資の方向性そのものです。
Flowのシーン延長とショット継続機能もあわせて強化されていて、理論上は基本の8秒からゆうに60秒以上まで続けて伸ばせます。シリーズ短編やブランドの連続コンテンツを作る人にとっては、これはようやく各セグメントを孤立した素材として無理やりつなぎ合わせなくてよくなり、同じ「ナラティブの骨格」の中でそのまま続きを書き足していけるということを意味します。
コミュニティでは「これこそ本来のVeo 3の姿」と言われている
実際に使ってみると、3.1は「作り直した」というより「3.0のアイデアをちゃんと完成させた」という印象に近いです。画質と指示追従性のどちらのスコアも9に到達していて、複雑なプロンプトの実行精度は3.0よりずっと安心できるものになっています。だからこそコミュニティで「これこそ本来のVeo 3の姿だ」という言い方が広まっているわけで、これは誇張ではなく、3.0が残していた心残りを3.1が一つひとつ埋めていったということなんです。
参照画像駆動のこの機能は、映画的な作風を作るクリエイターによく使われています。ブランドフィルムや、固定キャラクターを起用し続ける必要があるコンテンツでは、事前にキャラクター設定画とシーン参照画像を用意しておくことで、その後一連の素材のトーンの統一感が純粋なテキストプロンプトだけの場合よりワンランク以上高くなります。これがbest_forの項目に「キャラクター一貫性の要求が高いシリーズコンテンツ」や「参照画像駆動のブランドフィルム」とはっきり書かれている理由でもあります。
代償もまた率直です。価格体系はまったく変わっておらず、依然としてGoogle AIサブスクリプションに乗っていて、APIコストは3.0よりわずかに上がっており、コスパのスコアは6のままです。基本尺の8秒制限も本質的には解決されておらず、Flowのシーン延長メカニズムで緩和されているだけで、モデル自体が一度でより長いコンテンツを吐き出せるようになったわけではありません。もう一つ実際に存在する弱点はスタイル表現で、アニメや水墨画のような東洋美学のスタイルは、3.1は同時期の中国製モデルほど自由には表現できません。もっとも、このジャンルはそもそも3.1の主戦場ではありませんが。
参照画像とプロンプトをどう組み合わせれば無駄にならないか
3.1をうまく使うコツは、参照画像とテキストプロンプトを互いに矛盾する2つの別物として書かないことです。実用的な書き方の一つが開始・終了フレーム指定法です。開始フレームと目標となる終了フレームの2枚をアップロードし、テキスト部分には中間の過程だけを書きます。例えば:
"参考起始图中人物静坐姿势,参考结束图中人物已起身走到门口,中间过程:缓慢起身,整理衣领,转身走向门口,步伐平稳,光线随移动从暖黄渐变为冷白"
こうすればモデルは冒頭と結末がどういう見た目かをすでに把握しているので、中間の動きの過程だけを補完すればよく、動作全体を純粋にテキストだけで描写するよりずっと安定します。
シリーズコンテンツを作る際にはもう一つコツがあります。キャラクター設定画を「アンカー」として繰り返し使い回す方法です。新しいシーンを生成するたびに同じキャラクター参照画像を添付し、テキスト部分では新しいシーンと新しい動作だけを描写して、キャラクターの外見を重複して描写しないようにします。こうすれば、複数の独立して生成された素材をまたいでも、キャラクターの顔・衣装・体つきに連続性を保てます。これこそまさに、複数の素材をつなげてシリーズコンテンツにする際に3.1が3.0に対して持つ最大の実用的な価値です。
Veo 3ユーザーには迷わずアップグレードの価値あり、ただしスタイル表現の弱さは変わらない
すでにVeo 3のユーザーであれば、3.1は基本的に迷わずアップグレードしていい選択肢です。サブスクリプション体系も操作ロジックも同じままで、得られるのはより強い一貫性とより精密な指示実行で、追加の学習コストはありません。逆にゼロから機種選定する場合は、まずコンテンツの方向性をはっきりさせる必要があります。キャラクターが一貫して登場するシリーズストーリーやブランドの連続コンテンツが必要なら、3.1の参照画像制御は現時点で数少ない成熟したソリューションです。単発の独立した短編を作るだけなら、3.0と3.1の体験差はそこまで重要ではありません。
2026年全体の勢力図に置いてみると、Veoシリーズのこのラインが守っているのは「音と映像の一体感+キャラクター一貫性」という組み合わせの強みです。Sora 2の物理シミュレーションや、国産モデルのスタイル表現・コスパと比べると、それぞれの強みの領域ははっきりしていて、どちらかが完全に相手を凌駕しているわけではありません。あえて心残りを挙げるなら、やはり価格です。サブスクリプション費用もAPIコストもここ2年で下がっておらず、予算が限られているクリエイターや量をこなす必要があるクリエイターにとっては依然としてハードルのままです。このコストは、一貫性というこの能力に継続的にお金を払う価値があるかどうか、それぞれが自分で計算して決めるしかありません。
おすすめの使い手
- キャラクターの一貫性が重視されるシリーズコンテンツ
- 参照画像主導のブランドムービー
- Veo 3ユーザーが迷わず選べるアップグレード
ユーザーの評判
コミュニティでは「Veo 3の完成形」と評され、参照画像機能は映画的な作風のクリエイターに多用されている。不満は相変わらず購読料金に向けられている。
Veo 3.1 の実際の生成事例
当サイト収録の Veo 3.1 による実生成動画(完全なプロンプト付き、コピーで再現可能):




