2025年6月

この月に主要AIサービスで起きた24件の出来事です。対話AI 3件、開発 5件、統合エージェント 4件、リサーチ 1件、画像生成 4件、動画生成 3件、音声・会議 4件。

対話AI3

  • Gemini機能

    定期実行(Scheduled actions)

    Gemini に繰り返しの作業や日時指定の作業を任せられる機能が加わった。Google AI Pro・Ultra と一部の Workspace 利用者が対象。

  • Geminiモデル

    Gemini 2.5 Pro / Flash が GA

    API で Gemini 2.5 Pro と 2.5 Flash が正式版になった。Flash-Lite のプレビューも同日出た。

  • Microsoft Copilot機能

    Researcher と Analyst を一般提供

    Microsoft 365 Copilot のライセンス保有者に、Researcher と Analyst が一般提供された。2つを合わせて月25回まで追加料金なしで使える。Researcher は37言語、Analyst は8言語に対応する。

開発5

  • GitHub Copilot料金

    プレミアムリクエストの月間枠を適用

    Pro、Pro+、Business、Enterprise で、プレミアムリクエストの月間枠が実際に適用された。枠は毎月1日にリセットされ、超過分は支出上限を設定した場合のみ従量課金になる(初期値は0ドル)。有料プランでは GPT-4.1、GPT-4o、コード補完は無制限のままだった。

  • Cursor料金

    Ultra プランを新設し Pro を計算量制に

    月額200ドルで Pro の20倍使える Ultra が加わった。Pro は500リクエスト制から、API 価格で月20ドル分以上のモデル利用を含む計算量ベースに変わった。Auto モデルは無制限になった。

  • Cursor機能

    Slack から Background Agent を起動

    v1.1 で、Slack で @Cursor と書くと Background Agent が動き、スレッドの文脈を読んで GitHub に PR を作れるようになった。管理者がダッシュボードで連携を設定する必要がある。

  • Cursor企業

    Series C で9億ドルを調達

    評価額99億ドルで9億ドルを調達した。年間経常収益は5億ドル超で、Fortune 500 の半数以上が使っていると発表している。

  • Cursor機能

    Cursor 1.0 で Bugbot を提供

    1.0 で、プルリクエストを自動レビューする Bugbot と、全ユーザー向けの Background Agent が使えるようになった。MCP のワンクリック導入と Jupyter 対応も入った。

統合エージェント4

  • Manus機能

    Chat Mode と Playbooks を導入

    公開から3か月の振り返りの中で、Chat Mode と Playbooks を導入したと説明した。処理速度が2倍、コストが5分の1になったとも述べている。

  • Genspark機能

    AI Browser を発表

    公式ブログで、広告ブロックやオートパイロット、MCP ストアを備えた AI Browser が発表された。Super Agent も組み込まれている。

  • Genspark機能

    Google Suite 管理に対応

    公式ブログで、Google のサービスなどを管理する AI 秘書としての使い方が紹介された。

リサーチ1

  • NotebookLM機能

    ノートブックの公開リンク共有を追加

    共有設定を「リンクを知っている全員」にして、ノートブックを公開できるようになった。閲覧者は質問や生成物の閲覧ができるが、ソースの編集はできない。2025年8月1日の追記では、Workspace と教育アカウントは同一ドメイン内の共有に限られる。

画像生成4

  • FLUXモデル

    FLUX.1 Kontext [dev] を公開

    画像編集モデル Kontext の重み公開版を出した。12Bパラメータで、ライセンスは FLUX.1 Non-Commercial License。Hugging Face で配布している。

  • Midjourneyモデル

    動画モデル V1 を公開

    生成した画像を Animate ボタンで動かす画像から動画への機能。1回で5秒の動画4本ができ、約4秒ずつ延長できる。費用は画像ジョブの約8倍と説明された。

  • Adobe Firefly機能

    Firefly のモバイルアプリを公開

    iOS と Android 向けの Firefly アプリが公開された。テキストから画像、画像から動画、生成削除、生成拡張を使え、作った内容は Creative Cloud と同期される。Boards は動画生成にも対応した。

  • Midjourneyモデル

    V7 を標準モデルに変更

    未設定の利用者は自動的に V7 へ切り替わった。V6.1 には設定か --v 6.1 で戻せる。Omni-reference と Draft Mode もこの時点で使える。

動画生成3

  • Kling機能

    全動画モデルで効果音付き生成に対応

    すべての KLING 動画モデルが、動画の長さと内容に合う効果音つきの出力に対応した。動画から音を作る Video to Audio も加わり、1.6 には Motion Control がベータで入った。

  • Seedanceモデル

    Seedance 1.0 を公開

    ByteDance の Seed チームが動画生成の基盤モデル Seedance 1.0 を発表し、技術レポートを公開した。テキストと画像から1080pの動画を作れ、複数カットをつなぐ表現に対応する。5秒の1080p動画を NVIDIA L20 で約41秒で生成できるとされた。

  • Kling企業

    年換算売上が1億ドルを超える

    Kuaishou は、Kling AI の年換算売上高が2025年3月に1億ドルを超えたと発表した。API は国内外の1万社超の企業や開発者に提供しているとしている。

音声・会議4

  • Suno企業

    WavTool を買収

    ブラウザで動く音楽制作ソフト(DAW)の WavTool を買収した。チームは Suno の製品と開発の要職に就いた。

  • ElevenLabs機能

    音声アシスタント 11.ai を公開

    音声で操作するAIアシスタントのアルファ版。MCP を使い、Perplexity、Linear、Slack、Notion などの外部ツールに指示を出せる。無料の試験提供として始まった。

  • ElevenLabsモデル

    Eleven v3(アルファ版)を公開

    70以上の言語に対応する音声合成モデルの研究プレビュー。[excited] や [whispers] などのタグで感情を指定でき、複数の話者による会話も生成できる。

  • Suno機能

    Song Editor とステム抽出を強化

    波形から曲を区間ごとに編集できる Song Editor を刷新した。12種類へのステム分離、8分までの音声アップロード、3つの調整スライダーも加わった。