何が起きたか
あらゆる入力から生成する新モデル Gemini Omni が、まず動画から始まった。画像・音声・動画・文章を入力し、会話で動画を編集できる。Google AI Plus・Pro・Ultra の利用者が Gemini アプリと Flow で使える。
あらゆる入力から生成する新モデル Gemini Omni が、まず動画から始まった。画像・音声・動画・文章を入力し、会話で動画を編集できる。Google AI Plus・Pro・Ultra の利用者が Gemini アプリと Flow で使える。
判断力と信頼性を高めた Opus。自分が書いたコードの欠陥を見逃す確率が前モデルの約4分の1とされる。Claude Code では数百のサブエージェントを並列で動かす dynamic workflows が加わった。
Claude が作業計画を立て、1つのセッションで数百のサブエージェントを並行して動かす機能がリサーチプレビューで始まった。Enterprise、Team、Max プランで使え、数十万行規模のコード移行を想定した例が示されている。
Claude Opus 4.8 が公開された。Claude Code では Max プランの既定で Opus 4.8 の fast mode が使われるようになった。
Computer Use が Windows でも使えるようになり、モバイルからの遠隔操作にも対応した。
元の話者の演技を直接読み取り、感情や間を保ったまま吹き替える新モデル。90以上の言語に対応する。公開時点で API は準備中だった。
人物画像に服を着せて見せる仮想試着モデル。4秒未満で生成し、最大4着まで重ねられる。7月17日に v2 が出ている。