2025年12月

この月に主要AIサービスで起きた45件の出来事です。対話AI 9件、開発 8件、統合エージェント 9件、リサーチ 3件、画像生成 4件、動画生成 12件。

対話AI9

  • Geminiモデル

    Gemini 3 Flash を公開

    高速な Gemini 3 Flash が公開され、Gemini アプリの標準モデルになった。アプリでは「高速」「思考」「Pro」の3つから選べる。Google 検索の AI モードにも入った。

  • Grok機能

    Grok Voice Agent API を公開

    音声エージェントを作るための API。複数言語で話し、ツールを呼び出し、リアルタイム検索ができる。料金は音声1分あたり0.05ドル。

  • ChatGPT機能

    ChatGPT アプリの申請受付を開始

    開発者が ChatGPT 向けアプリを審査に提出して公開できるようにした。ユーザーはアプリディレクトリから探せる。

  • ChatGPT機能

    新しい ChatGPT Images を公開

    新しい画像生成モデルと、画像専用の Images 画面を公開した。編集で指定外の部分を保ちやすくなり、生成は最大4倍速いとしている。API では GPT Image 1.5 として提供する。

  • ChatGPTモデル

    GPT-5.2 を公開

    GPT-5.2 の Instant、Thinking、Pro を公開した。長い文脈の理解、ツール呼び出し、視覚の処理を強化した。ChatGPT では有料プランから展開した。

  • Gemini機能

    Gemini 3 Deep Think を提供

    高度な推論モード Gemini 3 Deep Think が、Google AI Ultra 向けに始まった。数学・科学・論理の問題が得意とされる。

  • Microsoft Copilot料金

    Copilot Business を提供

    300人未満の組織向けに、1ユーザー月額21ドルの Microsoft 365 Copilot Business が提供された。Microsoft 365 Business プランに追加して使い、Work IQ とエージェントの作成に対応する。

  • DeepSeekモデル

    V3.2 と V3.2-Speciale を公開

    V3.2 はアプリ、ウェブ、API で使え、思考をツール利用に組み込む設計。V3.2-Speciale は推論に特化した API 限定の版で、期限付きのエンドポイント(2025年12月15日まで)で提供された。どちらもオープンソース。

開発8

  • Cursor企業

    コードレビューの Graphite を買収へ

    コードレビュー基盤の Graphite を買収する正式合意を発表した。Graphite は当面、既存のチームと製品のまま独立して運営する。

  • GitHub Copilotモデル

    Claude Opus 4.5 を一般提供

    Enterprise、Business、Pro、Pro+ で Claude Opus 4.5 が使えるようになった。Business と Enterprise は設定でオプトインする必要がある。

  • GitHub Copilotモデル

    GPT-5.2 を一般提供

    Enterprise、Business、Pro、Pro+ で GPT-5.2 が使えるようになった。github.com、Visual Studio Code、JetBrains などのモデル選択から選べる。Business と Enterprise は管理者の有効化が必要。

  • Cursor機能

    2.2 で Debug Mode を追加

    アプリに実行時ログを仕込んで原因を探る Debug Mode が加わった。並列に走らせた複数のエージェントの結果を自動で比べ、最良の案を勧める機能も入った。

  • Claude Code機能

    Slack から Claude Code に依頼できる

    Slack で @Claude にメンションすると、コーディングの依頼として Claude Code のウェブ版セッションが自動で作られる。チャンネルやスレッドの文脈を読み、対象リポジトリを選び、進捗を同じスレッドに返してプルリクエストの作成まで進める。ベータとして提供された。

  • Claude Code企業

    JavaScript 実行環境 Bun を買収

    Anthropic が JavaScript 実行環境の Bun を買収した。同時に、Claude Code が正式公開から6か月で年換算売上10億ドルに達したと発表した。Bun は MIT ライセンスのオープンソースとして続けるとしている。

  • Windsurfモデル

    Opus 4.5 や Gemini 3 Pro を追加

    JetBrains プラグインで Claude Opus 4.5 が Sonnet と同じ2倍のクレジットで使えるようになった。GPT-5.1 と Gemini 3 Pro も選べ、コンテキストの使用量メーターも加わった。

統合エージェント9

  • Manus企業

    Meta による買収を発表

    Manus が Meta に加わると発表した。サブスクリプション事業はシンガポールから継続し、意思決定の方法は変えないと CEO の Xiao Hong 氏が述べた。

  • Manus機能

    Design View を公開

    画像の生成と編集を一つの画面で行う機能。範囲を指定して修正できる Mark Tool、文字編集、モバイル対応を備える。

  • Manus企業

    年間経常収益が1億ドルに到達

    公開から8か月で ARR が1億ドルに達したと発表した。従量課金を含む収益ベースでは1億2500万ドルを超えるという。

  • Manusモデル

    Manus 1.6 を公開

    上位の Manus 1.6 Max、モバイルアプリ開発、画像を作り直せる Design View を加えたバージョン。Max はタスク成功率の向上が示され、表計算と Web 開発で特に伸びたとされる。

  • Manus機能

    Web アプリに SEO 機能を内蔵

    動的な Web サイトに対し、検索ボット向けに事前生成した HTML を返す仕組みを追加した。SEO のスコアを見られるダッシュボードと改善提案も付く。

  • Manus機能

    Custom Domains を追加

    ビルダー内で独自ドメインの接続や購入ができる機能。SSL/TLS 証明書は自動で発行される。

  • Manus機能

    Google Drive コネクタを公開

    Google Drive のファイルを、自然言語の指示で読み書き・整理できるコネクタ。ファイルの手動転送が不要になる。

  • Manus機能

    Slides に Nano Banana Pro を採用

    Google の画像生成モデル Nano Banana Pro をスライド機能に組み込んだ。文字の描画が正確な画像を使い、プロンプトから資料一式を作れる。

  • Manus機能

    Projects を追加

    繰り返す作業向けの専用ワークスペース。共通の指示とナレッジを保存でき、毎回ファイルを上げ直さずに済む。全プランで使える。

リサーチ3

  • Sakana AI企業

    ALE-Agent がAtCoder大会で優勝

    ALE-Agent が2025年12月14日の AtCoder Heuristic Contest 058 で、参加者804人を抑えて1位になった。リアルタイムの最適化コンテストでAI が優勝したのは初めてと公表している。

  • NotebookLM機能

    Data Tables を追加

    ソースの内容を構造化した表にまとめ、Google スプレッドシートへ書き出せる。Pro と Ultra の利用者には当日から提供し、ほかの利用者へは数週間かけて広げるとした。

  • Perplexity提供終了

    API の sonar-reasoning を廃止

    旧い推論モデル sonar-reasoning を API から外し、sonar-reasoning-pro への移行を求めた。

画像生成4

  • Nano Banana機能

    検索の AI モードで Nano Banana Pro

    検索の AI モードで、Thinking with 3 Pro を選ぶと Create Images Pro から Nano Banana Pro を使えるようになった。対象は米国のみで、Google AI Pro・Ultra は利用上限が高い。

  • Adobe Firefly機能

    動画エディターを公開ベータで提供

    ブラウザで動く Firefly の動画エディターが公開ベータになった。Runway の Aleph による Prompt to Edit や、Firefly Boards での Topaz Astra による高画質化も加わった。FLUX.2 も使えるようになった。

  • FLUXモデル

    FLUX.2 [max] を公開

    FLUX.2 の最上位モデル。検索による情報の裏付け(グラウンディング)と、複数画像を参照した編集に対応する。

  • FLUX企業

    シリーズB 3億ドルを調達

    Salesforce Ventures と Anjney Midha(AMP)の主導で3億ドルを調達した。評価額は32.5億ドル。

動画生成12

  • Kling機能

    VIDEO 2.6 の Motion Control を公開

    参照動画の体の動き、表情、口の動き、手の動作を画像の人物に写し取る機能。最長30秒のワンショットに対応する。

  • Kling機能

    VIDEO 2.6 に Voice Control を追加

    アップロードした音声から声質を取り出して登録し、動画内のセリフで使い回せる機能。画像から音声つき動画を作る Kling VIDEO 2.6 で使える。

  • Seedanceモデル

    Seedance 1.5 pro を公開

    映像と音声を同時に生成するモデル。口の動きや抑揚を映像に合わせ、効果音も付けられる。対応言語に日本語が含まれ、モデルカードも公開された。

  • Runwayモデル

    世界モデル GWM-1 を発表

    現実を即時にシミュレートする汎用の世界モデル。ロボット向けの GWM Robotics、探索できる環境の GWM Worlds、会話するアバターの Runway Characters の3種がある。

  • Sora企業

    ディズニーとキャラクター利用で合意

    ウォルト・ディズニー・カンパニーと3年間のライセンス契約で合意し、ディズニー、マーベル、ピクサー、スター・ウォーズの200以上のキャラクターを Sora で使えるようにすると発表した。ディズニーは OpenAI に10億ドルを出資するとした。

  • Kling機能

    O1 に Element Library を追加

    人物・物・場面を複数角度の画像で登録して使い回せる素材庫を追加した。動画生成では最大7体、画像生成では最大10点の参照ができる。

  • Kling機能

    Kling AI Avatar 2.0 を公開

    アバター機能を更新した。身振りや表情、カメラアングルを使った説明ができ、手の動きも改善した。最長5分の動画に対応する。

  • Klingモデル

    Kling VIDEO 2.6 を公開

    音声を同時に生成する Native Audio に対応した最初の Kling 動画モデル。声、動作の効果音、環境音を含む動画を1回の生成で出力する。

  • Klingモデル

    Kling IMAGE O1 を公開

    画像生成モデル Kling IMAGE O1 を出した。最大10枚の参照画像から特徴を取り出し、複数枚をまたいでも一貫性を保てる。

  • Klingモデル

    Kling VIDEO O1 を公開

    参照画像からの生成、文章からの生成、始点・終点フレーム、動画の編集や加工を1つのモデルにまとめた統合型の動画モデル。Kuaishou はこれを、統合型マルチモーダル動画モデルとして世界初と説明している。

  • Runwayモデル

    Gen-4.5 を公開

    Artificial Analysis のテキストから動画の評価で1位(1,247 Elo)とされるモデル。動きの質、指示への忠実さ、見た目の一貫性を高めた。全有料プランで使える。