| ヴェオ | |
|---|---|
Veo 3で生成されたフクロウとアナグマの動画 | |
| 開発者 | Google DeepMind |
| リリース | 2024年5月 (2024-05) |
| 安定放出 | Veo 3.1 / 2025 年 10 月15 日 ( 2025-10-15 ) |
| タイプ | テキストからビデオへの変換モデル |
| Webサイト | deepmind |
Veo(Google Veoとも呼ばれる)は、 Google DeepMindが開発し、2024年5月に発表されたテキストから動画を生成するモデルです。生成型AIモデルとして、ユーザーの入力に基づいて動画を作成します。2025年5月にリリースされたVeo 3では、音声も生成できるようになりました。
2024 年 5 月、Google I/O 2024で Veo と呼ばれるマルチモーダル動画生成モデルが発表されました。[ 1 ] Google は、1 分を超える1080p動画を生成できると主張しました。 [ 1 ] 2024 年 12 月、Google はVideoFX で利用可能な Veo 2 をリリースしました。これは4K 解像度の動画生成をサポートし、物理法則の理解が向上しています。[ 2 ] 2025 年 4 月、Google は Gemini アプリで上級ユーザー向けに Veo 2 が利用可能になったと発表しました。[ 3 ]
2025 年 5 月、Google は Veo 3 をリリースしました。これは動画を生成するだけでなく、映像に合わせて会話、効果音、環境音などの同期音声も生成します。[ 4 ] Google はまた、Veo とImagenを搭載した動画作成ツールである Flowも発表しました。[ 5 ] [ 6 ] Google DeepMind の CEO であるDemis Hassabis氏は、このリリースを AI による動画生成がサイレント映画の時代を脱した瞬間だと表現しました。[ 6 ]これは、2026 年の Google I/O の基調講演でGoogle Flow Musicの発表とともにGoogle Flowに名称変更されました。[ 7 ]
Google Veoは、複数のサブスクリプションティアとGoogleの「AIクレジット」で購入できます。ソフトウェア自体は、Google GeminiとGoogle Flowという2つの異なるコンソールで実行できます。Geminiは、Gemini AIチャットモデルを使用して、より短く、より速く、より迅速なプロジェクトに特化しており、Google Flowは基本的にムービーエディターであり、ユーザーは同じキャラクターや俳優を使用して、連続性のあるより長いプロジェクトを作成できます。ユーザーは、1つのクリップにつき最大8秒を作成できます。[ 8 ]
Gizmodoによると、 Veo 3のユーザーは、街頭インタビューや製品の開封動画など、低品質なコンテンツを生成するようにモデルに指示していた。[ 9 ] 404 Mediaは、このツールが異なるプロンプトに対して同じジョークを繰り返す傾向があると報告した。[ 10 ]
評論家たちは、Google が YouTube の動画[ 6 ]やReddit の投稿[ 10 ]でサービスをトレーニングしたのではないかと推測した。Google自身はトレーニング コンテンツの出所を明らかにしていない[ 6 ] 。
2025年7月、Media Matters for Americaは、Veo 3を使用して生成された人種差別的で反ユダヤ主義的な動画がTikTokにアップロードされていると報告した。[ 11 ] [ 12 ] Ars TechnicaのRyan Whitwamは、「理想的な世界では、Veo 3はこれらの動画の作成を拒否するだろうが、プロンプトの曖昧さと、AIが人種差別的な比喩の微妙な点(つまり、一部の動画で人間の代わりに猿を使用すること)を理解できないため、ルールを回避するのは容易である」とコメントした。[ 12 ]