何が起きたか
Gemini アプリで、写真を指定して動きと音声を文章で指示すると、Veo 3 が音声付き8秒の動画にする機能が加わった。Google AI Pro と Ultra の加入者が対象で、動画には可視の透かしと SynthID が付く。
Gemini アプリで、写真を指定して動きと音声を文章で指示すると、Veo 3 が音声付き8秒の動画にする機能が加わった。Google AI Pro と Ultra の加入者が対象で、動画には可視の透かしと SynthID が付く。
数百件規模の調査を、複数のエージェントが並列で処理する機能。専用の仮想マシン上で動かし、当初は Pro ユーザー向けに提供した。
資料の画像、図、数値を使って AI が解説する、ナレーション付きスライド形式の動画を作れる。当初は英語のみ。Studio は同じ種類の出力を1つのノートブックに複数保存できるように改めた。
既存の動画に対し、物体の追加や削除、別アングルの生成、スタイルや照明の変更ができる動画モデル。すべての有料ユーザーが使える。
Devin が Model Context Protocol に対応した。設定画面の MCP Marketplace から Datadog、Sentry、Figma などのサーバーをつなげる。
調べる、操作する、成果物を作るを一つにまとめた ChatGPT agent を公開した。Operator と deep research の流れを統合し、Pro、Plus、Team 向けから展開した。
テキストや声で効果音を作る Generate Sound Effects がベータ公開された。動画生成では、構図の参照やスタイルプリセットなどの操作が加わった。Runway の Gen-4 Video と Google の Veo 3 も選べるようになった。