DeepSeek-R1-0528 に更新
R1 の更新版で、推論の性能とフロントエンド能力が上がり、ハルシネーションが減った。JSON 出力と関数呼び出しにも対応した。API の使い方は変わらない。
この月に主要AIサービスで起きた39件の出来事です。対話AI 10件、開発 9件、統合エージェント 3件、リサーチ 4件、画像生成 3件、動画生成 6件、音声・会議 2件、業務効率化 2件。
R1 の更新版で、推論の性能とフロントエンド能力が上がり、ハルシネーションが減った。JSON 出力と関数呼び出しにも対応した。API の使い方は変わらない。
Claude 4 世代の最初のモデル。Opus 4 は「世界最高のコーディングモデル」と位置づけ、拡張思考と並列のツール利用、記憶の扱いを強化した。
研究プレビューを終えて一般提供になった。GitHub Actions でのバックグラウンド実行と、VS Code・JetBrains との連携に対応した。
最上位の有料プラン Google AI Ultra が米国で月額249.99ドルで始まった。最大の利用枠と、Veo 3 の先行利用、Flow、30TB のストレージなどが含まれる。既存の Google AI Pro には Flow などが追加された。
Gemini Live のカメラと画面共有が Android と iOS で無料で使えるようになった。目の前の物を映して会話しながら質問できる。
効果音や会話の音声も一緒に生成できる動画モデル Veo 3 が Gemini アプリに入った。I/O 2025 で発表され、上位プランの利用者から使える。
Google AI Pro を1年間無料にする学生向け提供の対象に、日本、ブラジル、インドネシア、英国が加わった。
自社データでモデルを調整する Copilot Tuning を6月の早期アクセスとして発表した。複数エージェントが連携するマルチエージェント機能はパブリックプレビューになった。Microsoft 365 Agents SDK は一般提供となった。
コーディングタスクを任せられるクラウド上のエージェント Codex を ChatGPT のサイドバーに追加した。最初は Pro、Enterprise、Business 向けに展開した。
日本、インド、シンガポール、韓国で、ChatGPT Enterprise、ChatGPT Edu、API のデータ保管地域を国内に指定できるようにした。
JetBrains プラグインで、Anthropic の API キーを持ち込んで使う方式(BYOK)が使えるようになった。Claude 4 の Sonnet と Opus を利用できる。
Claude 4 の発表に合わせて Claude Code が一般提供になった。VS Code と JetBrains の拡張機能(ベータ)、拡張可能な Claude Code SDK、GitHub 上で Claude を呼び出せる機能(ベータ)が加わった。
Anthropic の2モデルがパブリックプレビューで加わった。Sonnet 4 は全有料プラン、Opus 4 は Enterprise と Pro+ が対象になる。
JetBrains プラグインの更新履歴に、SWE-1 ファミリーの追加が記載されている。SWE-1 はフロンティアモデル級の性能をうたう自社モデルで、SWE-1-Lite が従来の Cascade Base に置き換わった。
課題を Copilot に割り当てると、GitHub Actions 上の環境でコードを書き、テストと linter で確認したうえでドラフトのプルリクエストを出す。当初は Copilot Pro+ と Enterprise が対象で、リポジトリごとの有効化が必要だった。
v0.50 でモデル利用をリクエスト課金に統一し、Max Mode はトークン課金に変えた。プランごとの枠は据え置きで、プレミアムツール呼び出しと長文脈モードは廃止された。
作業の見込みを緑・黄・赤で示す信頼度表示を加えた。Linear と Jira では、セッションを始めずに複数の課題の信頼度を出せる。
公開リポジトリを解説する無料ツール DeepWiki を始めた。github.com を deepwiki.com に置き換えると使える。公開時点で5万を超える主要リポジトリが索引済みだった。
OpenAI がソフトウェア開発を任せるエージェント Codex を公開した。codex-1 という o3 派生のモデルで、クラウド上の隔離環境で GitHub のリポジトリを扱い、機能の実装やバグ修正を行う。当初は ChatGPT の Pro、Team、Enterprise 向けの研究プレビューだった。
公式ブログで、AI が電話をかける機能を個人の電話番号にも広げたと告知された。
公式ブログで、ファイルのダウンロードを担うエージェントと、保存場所の AI Drive が発表された。
公式ブログで、データの検索と分析をエージェントが進める AI Sheets が発表された。
自分のコードを書き換えて性能を高める AI エージェントの手法を発表した。SWE-bench の成績が20.0%から50.0%に上がった。ブリティッシュコロンビア大学の Jeff Clune 教授の研究室と共同で開発した。
マーケティング施策の立案や財務分析など、複数手順にまたがる作業をまとめて進める機能。Pro 加入者が使える。同じ回で、検索履歴を踏まえる Personal Search and Memory の順次提供も始まった。
NotebookLM のモバイルアプリを iOS 17 以降と Android 10 以降向けに公開した。音声概要のオフライン再生、再生中のホストへの質問、共有メニューからのソース追加ができる。
3年超の複数年契約で、2025年7月から半年間のパイロットを行う。まず書類作成業務の自動化に取り組む。伊藤錬が同行の AI アドバイザーに就く。
テキストと画像を入力して編集できる FLUX.1 Kontext の [pro] と [max] を公開した。ブラウザで試せる BFL Playground も同時に始めた。
V7 の標準を Fast モードにし、以前より費用を半分に抑えた。処理時間の目安は Fast で約40秒、Turbo で約18秒。
人物に限らず、物体や乗り物なども参照画像として取り込める機能。--oref で指定し、--ow で再現の強さを0〜1000で調整する。
Google AI Ultra の提供が73か国に広がり、英国でも Veo 3 が使えるようになった。Pro 加入者にも Gemini モバイルアプリ経由で Veo 3 の利用枠が付いた。記事に日本の記載はない。
720p の Standard と 1080p の Professional を持つ KLING 2.1 と、1080p に対応した KLING 2.1 Master を出した。5秒の生成は Standard が20クレジット、Professional が35クレジット。2.1 は当初、画像から動画のみに対応した。
動画と同時に音声も生成できる Veo の第3世代モデル。効果音、環境音、登場人物のセリフを生成できる。発表時は米国の Google AI Ultra 加入者が Gemini アプリと Flow で使え、企業向けには Vertex AI で提供された。
Veo、Imagen、Gemini を組み合わせた映像制作ツール Flow が始まった。カメラ操作、シーンの編集と延長、素材管理の機能がある。発表時の提供対象は米国の Google AI Pro と Ultra の加入者だった。
Veo 3 の先行利用や Flow の高い利用上限を含む最上位プラン。米国で月額249.99ドルで、新規加入は最初の3か月が50%引きだった。Google AI Pro の加入者は Flow で Veo 2 を使える。
画像生成モデルを API で使えるようにした。料金は画像1枚あたり0.08ドル。商品の試着表示やゲーム素材、内装の可視化などの用途が挙げられた。
音声エージェントの基盤を更新した。会話の間合いを判断するモデル、RAG、言語の自動判別、テキストと音声の併用、電話の発信・着信やバッチ発信に対応した。HIPAA対応とEUデータ保管も選べる。
ジャンルの幅と歌の表現を広げたモデル。最長8分の曲を作れ、生成も速くなった。プロンプトを整える補助機能が付き、Covers と Personas を組み合わせて使える。
AI Meeting Notes、Enterprise Search、Research Mode を発表した。会議の文字起こしと要約、連携アプリを横断した検索、複数の情報源から文書を下書きする調査機能からなる。OpenAI と Anthropic の主要モデルを別契約なしで使えるとも説明された。
Business と Enterprise で、Notion AI の機能が追加料金なしで使えるようになった。公式は、これまで別売だった AI を含む一本化した価格で、1ユーザー月額20ドルからと説明している。