何が起きたか
Veo 3 が Gemini API と Vertex AI で有料プレビューになった。映像と音声の出力は1秒あたり0.75ドル。当初はテキストから動画のみで、画像から動画は後日の予定とされた。
Veo 3 が Gemini API と Vertex AI で有料プレビューになった。映像と音声の出力は1秒あたり0.75ドル。当初はテキストから動画のみで、画像から動画は後日の予定とされた。
数百件規模の調査を、複数のエージェントが並列で処理する機能。専用の仮想マシン上で動かし、当初は Pro ユーザー向けに提供した。
資料の画像、図、数値を使って AI が解説する、ナレーション付きスライド形式の動画を作れる。当初は英語のみ。Studio は同じ種類の出力を1つのノートブックに複数保存できるように改めた。
既存の動画に対し、物体の追加や削除、別アングルの生成、スタイルや照明の変更ができる動画モデル。すべての有料ユーザーが使える。
Devin が Model Context Protocol に対応した。設定画面の MCP Marketplace から Datadog、Sentry、Figma などのサーバーをつなげる。
調べる、操作する、成果物を作るを一つにまとめた ChatGPT agent を公開した。Operator と deep research の流れを統合し、Pro、Plus、Team 向けから展開した。
テキストや声で効果音を作る Generate Sound Effects がベータ公開された。動画生成では、構図の参照やスタイルプリセットなどの操作が加わった。Runway の Gen-4 Video と Google の Veo 3 も選べるようになった。