2025年5月

この月に主要AIサービスで起きた39件の出来事です。対話AI 10件、開発 9件、統合エージェント 3件、リサーチ 4件、画像生成 3件、動画生成 6件、音声・会議 2件、業務効率化 2件。

対話AI10

  • DeepSeekモデル

    DeepSeek-R1-0528 に更新

    R1 の更新版で、推論の性能とフロントエンド能力が上がり、ハルシネーションが減った。JSON 出力と関数呼び出しにも対応した。API の使い方は変わらない。

  • Claudeモデル

    Claude Opus 4 と Sonnet 4 を公開

    Claude 4 世代の最初のモデル。Opus 4 は「世界最高のコーディングモデル」と位置づけ、拡張思考と並列のツール利用、記憶の扱いを強化した。

  • Claude機能

    Claude Code が一般提供に

    研究プレビューを終えて一般提供になった。GitHub Actions でのバックグラウンド実行と、VS Code・JetBrains との連携に対応した。

  • Gemini料金

    Google AI Ultra を新設

    最上位の有料プラン Google AI Ultra が米国で月額249.99ドルで始まった。最大の利用枠と、Veo 3 の先行利用、Flow、30TB のストレージなどが含まれる。既存の Google AI Pro には Flow などが追加された。

  • Gemini機能

    Gemini Live のカメラ共有を無料化

    Gemini Live のカメラと画面共有が Android と iOS で無料で使えるようになった。目の前の物を映して会話しながら質問できる。

  • Geminiモデル

    Gemini に Veo 3 を導入

    効果音や会話の音声も一緒に生成できる動画モデル Veo 3 が Gemini アプリに入った。I/O 2025 で発表され、上位プランの利用者から使える。

  • Microsoft Copilot機能

    Build 2025 で Copilot Tuning

    自社データでモデルを調整する Copilot Tuning を6月の早期アクセスとして発表した。複数エージェントが連携するマルチエージェント機能はパブリックプレビューになった。Microsoft 365 Agents SDK は一般提供となった。

  • ChatGPT機能

    ChatGPT に Codex を追加

    コーディングタスクを任せられるクラウド上のエージェント Codex を ChatGPT のサイドバーに追加した。最初は Pro、Enterprise、Business 向けに展開した。

開発9

  • Windsurf機能

    Anthropic の自前キー利用に対応

    JetBrains プラグインで、Anthropic の API キーを持ち込んで使う方式(BYOK)が使えるようになった。Claude 4 の Sonnet と Opus を利用できる。

  • Claude Code機能

    Claude Code が一般提供に

    Claude 4 の発表に合わせて Claude Code が一般提供になった。VS Code と JetBrains の拡張機能(ベータ)、拡張可能な Claude Code SDK、GitHub 上で Claude を呼び出せる機能(ベータ)が加わった。

  • GitHub Copilotモデル

    Claude Sonnet 4 と Opus 4 を公開

    Anthropic の2モデルがパブリックプレビューで加わった。Sonnet 4 は全有料プラン、Opus 4 は Enterprise と Pro+ が対象になる。

  • Windsurfモデル

    SWE-1 ファミリーをプラグインに追加

    JetBrains プラグインの更新履歴に、SWE-1 ファミリーの追加が記載されている。SWE-1 はフロンティアモデル級の性能をうたう自社モデルで、SWE-1-Lite が従来の Cascade Base に置き換わった。

  • GitHub Copilot機能

    Copilot coding agent をプレビュー公開

    課題を Copilot に割り当てると、GitHub Actions 上の環境でコードを書き、テストと linter で確認したうえでドラフトのプルリクエストを出す。当初は Copilot Pro+ と Enterprise が対象で、リポジトリごとの有効化が必要だった。

  • Cursor料金

    料金体系を簡素化(0.50)

    v0.50 でモデル利用をリクエスト課金に統一し、Max Mode はトークン課金に変えた。プランごとの枠は据え置きで、プレミアムツール呼び出しと長文脈モードは廃止された。

  • Devinモデル

    Devin 2.1 を公開

    作業の見込みを緑・黄・赤で示す信頼度表示を加えた。Linear と Jira では、セッションを始めずに複数の課題の信頼度を出せる。

  • Devin機能

    DeepWiki を公開

    公開リポジトリを解説する無料ツール DeepWiki を始めた。github.com を deepwiki.com に置き換えると使える。公開時点で5万を超える主要リポジトリが索引済みだった。

  • Codexモデル

    クラウド型 Codex エージェントを公開

    OpenAI がソフトウェア開発を任せるエージェント Codex を公開した。codex-1 という o3 派生のモデルで、クラウド上の隔離環境で GitHub のリポジトリを扱い、機能の実装やバグ修正を行う。当初は ChatGPT の Pro、Team、Enterprise 向けの研究プレビューだった。

統合エージェント3

  • Genspark機能

    Download Agent と AI Drive を公開

    公式ブログで、ファイルのダウンロードを担うエージェントと、保存場所の AI Drive が発表された。

  • Genspark機能

    AI Sheets を公開

    公式ブログで、データの検索と分析をエージェントが進める AI Sheets が発表された。

リサーチ4

  • Sakana AIモデル

    ダーウィン・ゲーデルマシンを提案

    自分のコードを書き換えて性能を高める AI エージェントの手法を発表した。SWE-bench の成績が20.0%から50.0%に上がった。ブリティッシュコロンビア大学の Jeff Clune 教授の研究室と共同で開発した。

  • Perplexity機能

    Perplexity Labs を公開

    マーケティング施策の立案や財務分析など、複数手順にまたがる作業をまとめて進める機能。Pro 加入者が使える。同じ回で、検索履歴を踏まえる Personal Search and Memory の順次提供も始まった。

  • NotebookLM機能

    iOS と Android の公式アプリを公開

    NotebookLM のモバイルアプリを iOS 17 以降と Android 10 以降向けに公開した。音声概要のオフライン再生、再生中のホストへの質問、共有メニューからのソース追加ができる。

  • Sakana AI企業

    三菱UFJ銀行と包括提携

    3年超の複数年契約で、2025年7月から半年間のパイロットを行う。まず書類作成業務の自動化に取り組む。伊藤錬が同行の AI アドバイザーに就く。

画像生成3

  • FLUXモデル

    FLUX.1 Kontext と Playground

    テキストと画像を入力して編集できる FLUX.1 Kontext の [pro] と [max] を公開した。ブラウザで試せる BFL Playground も同時に始めた。

  • Midjourney機能

    V7 の Fast モードを高速化

    V7 の標準を Fast モードにし、以前より費用を半分に抑えた。処理時間の目安は Fast で約40秒、Turbo で約18秒。

  • Midjourney機能

    Omni-Reference を試験公開

    人物に限らず、物体や乗り物なども参照画像として取り込める機能。--oref で指定し、--ow で再現の強さを0〜1000で調整する。

動画生成6

  • Veo機能

    Veo 3 を73か国に拡大

    Google AI Ultra の提供が73か国に広がり、英国でも Veo 3 が使えるようになった。Pro 加入者にも Gemini モバイルアプリ経由で Veo 3 の利用枠が付いた。記事に日本の記載はない。

  • Klingモデル

    KLING 2.1 シリーズを公開

    720p の Standard と 1080p の Professional を持つ KLING 2.1 と、1080p に対応した KLING 2.1 Master を出した。5秒の生成は Standard が20クレジット、Professional が35クレジット。2.1 は当初、画像から動画のみに対応した。

  • Veoモデル

    Veo 3 を発表

    動画と同時に音声も生成できる Veo の第3世代モデル。効果音、環境音、登場人物のセリフを生成できる。発表時は米国の Google AI Ultra 加入者が Gemini アプリと Flow で使え、企業向けには Vertex AI で提供された。

  • Veo機能

    AI 映像制作ツール Flow を開始

    Veo、Imagen、Gemini を組み合わせた映像制作ツール Flow が始まった。カメラ操作、シーンの編集と延長、素材管理の機能がある。発表時の提供対象は米国の Google AI Pro と Ultra の加入者だった。

  • Veo料金

    Google AI Ultra を開始

    Veo 3 の先行利用や Flow の高い利用上限を含む最上位プラン。米国で月額249.99ドルで、新規加入は最初の3か月が50%引きだった。Google AI Pro の加入者は Flow で Veo 2 を使える。

  • Runway機能

    Gen-4 Image API を提供開始

    画像生成モデルを API で使えるようにした。料金は画像1枚あたり0.08ドル。商品の試着表示やゲーム素材、内装の可視化などの用途が挙げられた。

音声・会議2

  • ElevenLabs機能

    Conversational AI 2.0 を公開

    音声エージェントの基盤を更新した。会話の間合いを判断するモデル、RAG、言語の自動判別、テキストと音声の併用、電話の発信・着信やバッチ発信に対応した。HIPAA対応とEUデータ保管も選べる。

  • Sunoモデル

    v4.5 を公開

    ジャンルの幅と歌の表現を広げたモデル。最長8分の曲を作れ、生成も速くなった。プロンプトを整える補助機能が付き、Covers と Personas を組み合わせて使える。

業務効率化2

  • Notion AI機能

    AI Meeting Notes など3機能を公開

    AI Meeting Notes、Enterprise Search、Research Mode を発表した。会議の文字起こしと要約、連携アプリを横断した検索、複数の情報源から文書を下書きする調査機能からなる。OpenAI と Anthropic の主要モデルを別契約なしで使えるとも説明された。

  • Notion AI料金

    Business と Enterprise に AI を同梱

    Business と Enterprise で、Notion AI の機能が追加料金なしで使えるようになった。公式は、これまで別売だった AI を含む一本化した価格で、1ユーザー月額20ドルからと説明している。