⏱ 読了目安: 約8分
- Googleが全アカウントへVidsでの1080p動画生成を無料開放。個人は月6本、有料プランは500秒以上を提供。
- Gemini Omni 1.1 Flashを搭載し、シーン延長やアップスケールに対応。動画フレームにはSynthID透かしを埋め込み。
- OpenAIのSora API完全停止と対照的に、Googleが配信力で勝負。自社ワークフローのロックイン対策が急務となる。
ブラウザで動くフルHD生成の衝撃
社内勉強会やプロダクトのデモ動画を作成するために、深夜にローカルのGPUサーバーを立ち上げ、ComfyUIの複雑怪奇なワークフローと格闘しながらVRAM不足のエラーに頭を抱える――そんな苦行を経験したエンジニアは少なくないはずだ。プロンプトを微修正するたびに数分間待たされ、ようやく書き出された動画はキャラクターの指が溶け、照明がフレームごとに激しく明滅する。こうした生成AI特有のイライラと計算資源の制約に対して、Googleが突きつけた回答は強烈だった。2026年9月23日、Googleは自社のコラボレーション基盤である「Google Vids」において、すべてのGoogleアカウント保持者に向けて1080pのAI動画生成機能を完全無料開放した。
この生成エンジンの心臓部には、テキストや画像、音声、既存の映像ソースを単一のパイプラインで処理するマルチモーダル基盤モデル「Gemini Omni 1.1 Flash」が採用されている。ブラウザでvids.newを開くだけで、外部のGPUリソースや複雑な環境構築を一切意識することなく、主要な動画配信プラットフォームの標準解像度であるフルHD(1080p)のクリップを数クリックで書き出せるようになったのだ。しかも、単なるテキストからの新規生成にとどまらない。先行クリップの照明やキャラクター、背景のコンテクストを保持したまま時間を延ばす「シーン延長」、ナレーションやシナリオの尺に合わせて秒単位で動画の長さを制御する機能、さらには過去に生成した低解像度クリップを再生成なしで1080pに引き上げる「アップスケーリング」まで、これまでサードパーティの有償ツールを複数組み合わせて実現していた編集工程がブラウザタブ1枚の中に統合されている。
実務で利用するにあたり、エンジニアが把握しておくべきアカウント別のクォータ制限は以下の通りに明確化されている。
| アカウント種別 | 月間生成上限 | 主な特徴と制約 |
|---|---|---|
| 個人Googleアカウント | 6本/月 | プロモーション枠。太平洋時間毎月1日午前0時にリセット |
| Google AI Pro | 500秒/月 | 長尺生成向け。上位のAI Ultraへのアップグレードパスあり |
| Workspace Business / Enterprise | 500秒/月 + アバター25本 | 組織向けの利用枠一元管理、管理者コントロールが有効 |
| Workspace for Education | 2,000秒/月(毎日リセット) | 教育機関向けの大容量枠。日次でカウントが更新 |
動画生成にはスマートフォンアプリではなくデスクトップブラウザが必須であり、1本の最大尺は30分に制限される。また、生成される全フレームにはGoogle DeepMindの不可視電子透かし「SynthID」が直接焼き込まれ、機械的な検証ツール「SynthID Detector」による追跡が可能となっている。この仕様は、商用利用やプロダクトへの組み込みを検討する現場にとって、フェイクメディア混入のリスクを最小化する極めて堅牢なガードレールとして機能すると私は評価している。
Sora撤退とVeoの価格破壊戦
Google Vidsの無料開放がアナウンスされたわずか24時間後、動画生成AIの歴史において極めて象徴的な出来事が起きた。OpenAIが提供してきた「Videos API」および「Sora 2」「Sora-2-pro」モデルが、2026年9月24日をもって恒久的にサービスを完全終了したのだ。Soraはかつて、物理法則をシミュレートする驚異的な映像表現力で世界中を震撼させ、生成AIの次なる地平を切り拓いた主役だった。しかし、4月のWeb/アプリ版の停止に続き、API提供まで完全に幕を下ろす結果となった。残存するスナップショットの代替モデルは用意されず、開発者に与えられた猶予期間の満了に伴い、関連データは完全に破棄される。OpenAIは経営資源をエンタープライズ向けのLLMエージェント基盤や自律型コーディング環境であるCodexへと集中させ、巨額の推論コストを垂れ流す消費者向け動画生成事業から完全に撤退する選択を下した。
この対照的な幕引きの背後にあるのは、推論インフラの圧倒的なコスト差と、プラットフォームとしての配信力である。動画生成はテキスト生成と比較して数万倍規模の計算リソースを消費する。推論パイプラインを自前のデータセンターとカスタムシリコン(TPU)で支えられるメガクラウド事業者でなければ、無料枠のばらまきはおろか、採算の取れるAPI料金を設定することすらできない。Googleはすでに「Veo 3.1 Lite」モデルのAPI利用料を、720pで秒あたり0.05ドル(約7.9円)、1080pで秒あたり0.08ドル(約13円)にまで引き下げており、Gemini Omni 1.1 Flashの商用APIレート(720pで秒あたり約0.1ドル)を含めて、スタートアップ勢が到底追従できない価格ダンピングを仕掛けている。
さらに中国市場からはKlingやTencentのHunyuan Videoといった低価格・オープンウェイトモデルが激しい追い上げを見せており、動画生成AIの単体APIビジネスは急速にレッドオーシャン化している。かつて「モデルのパラメータ数と映像美」を競い合っていたフェーズは終わりを告げ、莫大なインフラコストを自社エコシステムの顧客獲得コスト(CAC)として吸収できる巨大資本だけが生き残る消耗戦へと突入したと私は考える。Soraの退場は、単なる一企業のプロダクト整理ではなく、AIモデル単体で収益を上げるスタンドアローン型ビジネスモデルの限界を告げるデッドロックの象徴に他ならない。
エコシステム統合がもたらす功罪
Googleの真の狙いは、単に「すごいAI動画ツールを無料で作った」ことではない。同社が2026年を通じて執拗に推し進めてきたのは、Veo 3.1の無料アクセス付与、97言語に対応した法人向けAIアバターの提供、そしてGmail、Drive、Docs、Slides、YouTubeといった日常の業務インフラの中にAI生成機能を不可視のレイヤーとして溶け込ませる戦略だ。開発者やエンドユーザーに対して「新しいツールへのログイン」を要求するのではなく、普段使っているドキュメント作成の延長線上に動画編集環境を配置することで、他社ツールへのコンテキストスイッチを完全に遮断しようとしている。
実際、Google Vidsには間もなく「Gemini 3.8 Flash-Lite」を基盤とするテキスト読み上げ(TTS)機能が統合される予定だ。これにより、ドキュメントに書かれたスクリプトが100以上の言語で即座に自然なナレーション音声へ変換され、24言語対応のAIアバターと自動同期される。かつて動画制作の内製化といえば、PremiereやFinal Cutで映像を切り貼りし、別サービスでナレーション音声を合成し、有償のストック素材サイトからBGMを購入してタイムラインに並べるという、果てしないスパゲッティコードのようなマルチツール運用が常態化していた。Vidsの無料開放は、そうした煩雑なパイプラインを1つのブラウザタブ内で完結させる圧倒的な効率化を意味する。
だが、この甘美な利便性の裏には、我々エンジニアが直視すべき構造的リスクが潜んでいる。プラットフォームへの依存度が高まれば高まるほど、データと制作フローのロックインは強固になる。Googleが提示する「個人向け月6本」という無料枠はあくまでプロモーション位置づけであり、将来的に予告なく制限が強化される可能性があると利用規約に明記されている。さらに、SynthIDの埋め込みが強制されることで、Googleのガバナンス外へのコンテンツ転用や、モデルを自社インフラに閉じたエアギャップ環境での運用は難しくなる。エコシステムに深く身を委ねることは、開発の俊敏性を手に入れると同時に、将来的な価格改定や仕様変更というプラットフォーム側の気まぐれに自社の業務基盤を人質に取られることと同義ではないだろうか。
道具の民主化に試される開発者の針路
1080pの動画生成がコモディティ化し、誰もがノーコードで高品質な映像資産を量産できる時代に、我々エンジニアが追求すべき価値とは何なのか。SoraがAPIを閉鎖し、GoogleがWorkspaceの付帯機能として動画生成を無償配給し始めた現実は、単に「生成AIのAPIを叩いて面白い映像を作る」だけのラッパー開発者が存在意義を失ったことを冷酷に示している。モデルの美しさに一喜一憂するフェーズは完全に過去のものとなった。
明日からの実務において、我々が取るべき実践的なアプローチは明確だ。第1に、社内のプロトタイピング、カスタマーサポート向けのFAQ動画、あるいは社内ドキュメントの動画化といった定型業務には、Google Vidsの無料枠およびWorkspace連携を徹底的に使い倒し、制作コストと外部SaaS費用を極限まで削ぎ落とすことだ。月額数千円を支払っていたサードパーティの動画生成ツールがあるならば、即座にROIを再検証すべきである。第2に、自社のコアプロダクトに動画生成パイプラインを組み込むアーキテクチャを設計する場合、特定のプロプライエタリなモデルに依存するのではなく、Veo 3.1 Liteのような低価格APIと、自社ホスティング可能なオープンウェイトモデル(Hunyuan Video等)を柔軟に切り替えられる抽象化レイヤーを今のうちに構築しておくことだ。
動画がテキストや画像と同じ「ただのデータ型」へと成り下がった世界で、真の差別化要因となるのは、生成される映像そのものではなく、その映像がどの業務コンテキストに接続され、いかにビジネスのボトルネックを解消しているかというシステム全体の設計思想である。巨人が繰り広げるインフラのばらまき戦を冷徹に利用しながら、自らの技術的主権をどこに保持し続けるのか――その覚悟が、いま全ての開発者に問われている。


コメント