Copilot Cowork を Frontier で提供
Copilot Cowork が Frontier プログラムで使えるようになった。Researcher には複数モデルで評価する Critique と、モデルの回答を並べる Model Council が加わった。
この月に主要AIサービスで起きた52件の出来事です。対話AI 13件、開発 11件、統合エージェント 2件、リサーチ 8件、画像生成 5件、動画生成 10件、音声・会議 1件、業務効率化 2件。
Copilot Cowork が Frontier プログラムで使えるようになった。Researcher には複数モデルで評価する Critique と、モデルの回答を並べる Model Council が加わった。
声とカメラで AI モードに質問できる検索 Live が、日本を含む AI モード提供地域に広がった。音声モデルは Gemini 3.1 Flash Live。
他社のAIアシスタントから、記憶・設定・チャット履歴を Gemini に取り込む移行ツールが設定に加わった。
画面を見て操作する Computer use が、Cowork と Claude Code でリサーチプレビューとして使えるようになった。
導入支援を行う企業向けに、研修、認定資格、技術支援、共同マーケティングを用意するプログラム。2026年に1億ドルを投じる。
目的を伝えると、メールや会議、ファイルをもとに計画を立てて作業を進める機能。実行前に利用者が承認する段階を挟む。発表時は一部の顧客によるリサーチプレビューだった。
Microsoft 365 E5、Microsoft 365 Copilot、Agent 365 をまとめた E7 を、1ユーザー99ドルで5月1日に提供するとした。Wave 3 として、Claude と次世代の OpenAI モデルが Copilot で使えるようになった。
gemini-3-pro-preview が停止し、同名の指定は gemini-3.1-pro-preview に向けられた。
ChatGPT に GPT-5.4 Thinking、ChatGPT と API に GPT-5.4 Pro を公開した。推論、コーディング、エージェント作業を一つのモデルにまとめたとしている。
Excel のアドインとして ChatGPT をブックに組み込み、モデル作成やシナリオ分析を支援する機能をベータで公開した。FactSet などの金融データ連携も加えた。
ChatGPT でよく使われるモデルを GPT-5.3 Instant に更新した。回答の正確さと、Web 検索を使った答えの質を高めたと説明している。
チャット履歴からの記憶が、無料プランでも使えるようになった。
Grok 4.20 と、複数のエージェントが並列で調査する Multi-agent 版を公開した。コンテキスト長は100万トークン。日付は開発者向けリリースノートの月単位の記載による。
Claude Sonnet 4 を、2026年5月6日に全 Copilot 機能で終了すると案内した。移行先の候補は Claude Sonnet 4.6。
スキル、アプリ連携、MCP サーバー設定をまとめて配布できるプラグインに対応した。用意されたディレクトリから入れるほか、自作してユーザー単位やリポジトリ単位で使える。
権限の確認を分類モデルに任せ、安全な操作は止めずに実行し、危険な操作は止める新しい権限モード。Team プランでリサーチプレビューとして始まり、Enterprise と API 利用者へ順次広がるとされた。
Composer の第2世代。標準版は入力100万トークンあたり0.50ドル、出力2.50ドルで、既定の高速版は入力1.50ドル、出力7.50ドル。
親のセッションが作業を分け、それぞれ独立した仮想マシンで動く子の Devin に割り当てられる。進捗の監視、停止、結果の統合も親が担う。
軽い作業やサブエージェント向けの小型モデル。従来より2倍以上速く、GPT-5.4 の利用枠の30%しか消費しない。
プルリクエストごとに複数のエージェントが並行で解析し、バグを重大度順に並べる Code Review が、Team と Enterprise 向けのリサーチプレビューとして始まった。1件あたり15〜25ドルで、管理者は月の上限やリポジトリごとの有効化を設定できる。
推論、コーディング、エージェント作業を強化したモデル GPT-5.4 が Codex で使えるようになった。Codex アプリ、CLI、IDE 拡張、Web で利用でき、多くのタスクで推奨される。
スケジュールや、Slack、Linear、GitHub、PagerDuty、Webhook のイベントで起動する常駐型エージェントを作れるようになった。実行のたびにクラウドの作業環境が立ち上がり、前回の内容を記憶するツールもある。
Agent Client Protocol 経由で、IntelliJ IDEA、PyCharm、WebStorm などから Cursor を使えるようになった。プラグインは ACP Registry から入れ、既存の Cursor アカウントでログインする。
公式ドキュメントによると、2026年3月に Windsurf の課金がクレジット制から、日ごと・週ごとに更新される利用枠の方式に変わった。枠を使い切った後は API 料金で追加利用を買える。従来の Pro は月15ドル、Teams は1席あたり月30ドルで据え置かれる。
macOS と Windows のデスクトップアプリから、手元のファイルやコマンドラインを Manus が操作できる機能。コマンドの実行にはユーザーの承認が要る。
公式ブログで、最初の AI 社員を掲げる AI Workspace 3.0 が発表された。
Comet が iOS、Android、Mac、Windows の主要な環境でそろった。同じ回に Computer の範囲指定編集や、健康データ向けの Perplexity Health の順次提供も案内された。
AI Scientist の研究がNature誌に掲載された。論文の質は基盤モデルが進むほど上がるという関係を示した。
Llama-3.1-Namazu-405B など3種のアルファ版 Namazu を作り、これを使うチャットサービス Sakana Chat を公開した。ウェブ検索も組み込んだ。
生成したスライドを指示で修正でき、PPTX 形式でも書き出せるようになった。EPUB をソースに使え、チャットは自動保存されて後から再開できる。Workspace では、Cinematic Video Overviews が Business Standard/Plus 以上と AI Pro/Ultra でも使える。
防衛イノベーション科学技術研究所から、指揮統制システムの高度化に向けた委託研究を受けた。ドローンなどの端末で動く小型の視覚言語モデルも扱う。
Computer を Pro 加入者、Enterprise、Slack へ広げた。常時稼働で Mac mini 上で動く Personal Computer と、MDM で配布できる Comet Enterprise も案内された。
3つの最先端モデルに同時に聞いて答えを選べる Model Council と、Computer に手順を覚えさせるカスタムスキルを追加した。Computer では音声での対話も使える。
Gemini 3、Nano Banana Pro、Veo 3 などを組み合わせ、アニメーションと詳細な映像をもつ解説動画を生成する。開始時の対象は、18歳以上の Google AI Ultra 利用者で、英語のウェブとモバイル。
Standard、Pro、Mega の利用者は V8 Alpha で Relax モードを使えるようになった。サーバーの混雑で待ち時間が延びる可能性がある。
自分の画像でモデルを学習させる Firefly Custom Models が公開ベータになった。キャラクター、イラスト、写真のスタイルを保つ用途が想定されている。Firefly で使える他社モデルは30以上になり、Kling が加わった。
細かい指示への追従と文字の描画を改善した新モデルで、生成は従来の約5倍の速さとされる。ネイティブ2K出力の --hd を備え、alpha.midjourney.com で試験公開した。
Adobe と NVIDIA が、次世代の Firefly 基盤モデルを共同で進める提携を発表した。NVIDIA の計算基盤とライブラリを使う。Firefly Foundry にも NVIDIA の技術を組み込む。
FLUX.2 [pro] の生成速度が2倍になった。あわせて flux-2-pro-preview エンドポイントが加わった。
CapCut が Dreamina の Seedance 2.0 提供地域に日本を加えた。動画は最大15秒、6種類の縦横比で作れる。実在の顔を含む画像からの動画生成など、一部機能には制限が付く。
Veo 3.1 Fast の半額未満で使える低価格モデル。テキストと画像からの動画生成、16:9 と 9:16、720p と 1080p に対応し、4K と延長は使えない。Gemini API の有料プレビューと Google AI Studio で提供された。記事は Veo 3.1 Fast の値下げを4月7日と予告している。
Videos API と Sora 2 の各モデルを利用する開発者に、2026年9月24日に API から削除すると通知した。対象は sora-2、sora-2-pro とそのスナップショットで、代替は示されていない。
安全対策の文書を更新し、写っている人の同意と権利を申告したうえで、人物を含む画像から動画を作れると説明した。本人の姿と声を使う機能は「キャラクター」(旧称カメオ)と表記している。
素材をチームで共有する Shared Assets、役割ごとの権限管理、個人からチームへのクレジット移動を加えた。同時に Kling AI のデスクトップアプリも提供を始めた。
Sora API に、再利用できるキャラクター参照、最長20秒の生成、sora-2-pro の1080p出力、動画の延長、Batch API 対応を追加した。sora-2-pro の1080p生成は1秒あたり0.70ドル。
既存の動画を編集する POST /v1/videos/edits を追加した。従来の remix エンドポイントは6か月後に廃止するとした。
ChatGPT Plus と Pro の対象利用者が、Codex と Sora で使うクレジットの自動チャージを設定できるようになった。残高が指定額を下回ると、登録済みの支払い方法で補充される。
GWM-1 を基にした、会話できるアバターを作るリアルタイム動画エージェントの API。1枚の画像からキャラクターを作れ、声や人格、知識も設定できる。開発者向けは dev.runwayml.com から使える。
複数の画像や動画を登録して顔を固定できるようにした Motion Control。横顔や遮られた顔、複雑な表情でも人物の顔を保つとしている。
Voices、Custom Models、My Taste を備えたモデル。Voices は自分の歌声を使う機能、Custom Models は自作曲で調整したモデルを作る機能、My Taste は好みを学習する機能。
チャートと指標を1画面にまとめるダッシュボードビューを追加し、Agent に頼んで作成・更新できる(Business と Enterprise)。Agent への依頼から図や画像を生成する機能と、検索のノイズを減らすアーカイブ機能も入った。
OpenAI の GPT-5.4 をモデルピッカーで選べるようにした。Notion は、複雑な業務での速度とトークン効率の向上を挙げている。