Nano Banana 2 を API で公開
gemini-3.1-flash-image-preview が公開された。Nano Banana 2 として、高効率な画像生成を担う。
この月に主要AIサービスで起きた39件の出来事です。対話AI 9件、開発 8件、統合エージェント 2件、リサーチ 6件、画像生成 4件、動画生成 4件、音声・会議 4件、業務効率化 2件。
gemini-3.1-flash-image-preview が公開された。Nano Banana 2 として、高効率な画像生成を担う。
推論性能を高めた Gemini 3.1 Pro がプレビューとして公開された。ARC-AGI-2 で 77.1% を記録し、Gemini 3 Pro の2倍超とされる。Gemini アプリでは AI Pro と Ultra の利用者が使える。
API で Claude 3.7 Sonnet と Claude 3.5 Haiku が使えなくなった。
コーディングと Computer use を改善した Sonnet。Free と Pro の標準モデルになった。価格は Sonnet 4.5 と同じ。
Enterprise プランを営業を介さず、オンラインで直接購入できるようになった。
評価額3,800億ドル(調達後)で300億ドルを調達した。
米国で Free と Go のログイン済み成人利用者を対象に、広告のテストを始めた。Plus、Pro、Business、Enterprise、Education には広告を出さない。
100万トークンのコンテキスト(ベータ)に対応した Opus。コーディングと推論を強化した。
SpaceX が xAI の買収を発表した。以降は SpaceXAI LLC として Grok などの製品を提供している。
Anthropic の Claude と OpenAI の Codex を、Copilot Business と Pro でもコーディングエージェントとして使えるようになった(パブリックプレビュー)。追加契約は不要で、1セッションにつきプレミアムリクエストを1回消費する。Business は管理者の承認が必要。
2025年9月のパブリックプレビューを経て、全契約者向けに一般提供になった。計画モードや autopilot モード、MCP サーバー、スキル、カスタムエージェントに対応する。Business と Enterprise は管理者がポリシーで有効にする。
米国政府機関向けの提供形態を始めた。Devin は AWS GovCloud で使え、Windsurf は FedRAMP High を取得している。
クラウドエージェントが専用の仮想マシン上で、実際にソフトを動かして変更を確かめられるようになった。動画やスクリーンショットを添えた PR を出す。
Linux デスクトップ上でデスクトップアプリを動かして検証する機能と、PR 前に自分で直す Devin Review Autofix を加えた。起動は3倍速くなり、画面も刷新された。
コードベースの脆弱性を調べ、修正パッチを提案する機能が、Enterprise と Team 向けの限定リサーチプレビューとして始まった。複数段階の検証で誤検知を減らし、重大度を付けて提示する。人が確認して承認する前提で、オープンソースの管理者には先行して提供された。
JetBrains プラグインで Claude Opus 4.6 が使えるようになり、高速モードがリサーチプレビューとして加わった。
Codex を操作するデスクトップアプリが macOS で登場した。Skills で拡張でき、Automations で作業を予定どおりに自動実行できる。公開時のモデルは GPT-5.2-Codex。
QR コードで接続すると、Telegram 上で Manus を使える。複数手順のタスク、音声メッセージ、ファイル、モデル選択に対応し、他のメッセージアプリへの拡大も予告した。
プロジェクトごとに使う Skill を選んで束ねる機能。関係のない Skill が作業に混ざるのを防ぎ、新メンバーの立ち上げにも使える。
調査、設計、コード作成、公開までを一つの会話から進める AI。19のモデルを並行して使い分ける。最初は Max 加入者向けで、同じ回に Samsung Galaxy S26 への標準搭載も案内された。
産業向けの効率的で適応的なモデルについて、共同研究とオープンソース貢献、共同の販売活動に取り組む。
Citi が出資した。日本企業への戦略投資は Citi にとって初となる。シリーズB後の出資で、海外展開を後押しする。
Salesforce Ventures が出資を発表した。Sakana AI の企業向け技術を Salesforce の製品群に組み込む可能性を探る。
本社を港区麻布台の Azabudai Hills Mori JP Tower 22階へ移した。移転日はお知らせに明記されていない。
文書の意味を数値化する Embeddings API と、複数のモデルとツールを呼べる Agent API を一般提供にした。Agent API は OpenAI 互換の呼び出しにも対応する。
Gemini 3.1 Flash Image にあたる新モデル。Nano Banana Pro に近い品質を高速で出す。512px から4Kまでの出力、最大5人と14個のオブジェクトの一貫性、検索を使った描画に対応する。Gemini アプリでは Nano Banana Pro に代わって標準になった。
Web 版の Rooms を終了した。実験としては得るものがあったが、目的ごとに作り直すと説明している。代替の窓口は Discord とヘルプページ。
Gemini 3.1 Flash Image を Gemini API と Vertex AI でプレビュー公開した。縦横比に 4:1、1:4、8:1、1:8 が加わり、思考レベルも調整できる。Google AI Studio では有料の API キーが必要。
画像を見て選ぶだけで好みのプロフィールを作れる新画面を midjourney.com/personalize に追加した。パーソナライズとムードボードは niji 7 でも使えるようになった。
画像生成ツールの Whisk と ImageFX が Flow に移り、画像の生成、編集、動画化を一つの画面でできるようになった。素材を整理するアセットグリッドと、投げ縄ツールによる範囲指定の編集も加わった。
Codex と Sora で、利用上限とクレジット残高をリクエストごとに組み合わせて判定する仕組みを技術記事で解説した。上限を超えた利用者はクレジットを消費して使い続けられる。
テキスト、画像、音声、動画の4種類を入力に使えるモデル。画像9枚、動画3本、音声3本まで同時に参照でき、編集や延長にも対応する。15秒のマルチカット動画を出力できる。
General Atlantic が主導し、シリーズEで3億1500万ドルを調達した。NVIDIA、Adobe Ventures、AMD Ventures なども参加。次世代の世界モデルの事前学習に使う。
公共機関向けに音声エージェントを提供する取り組みを始めた。ウクライナ、チェコ、米国ミッドランド市での導入が紹介されている。
Sequoia Capital 主導で5億ドルを調達し、評価額は110億ドルとなった。調達額は累計7億8100万ドルになる。資金は ElevenAgents や感情を扱う会話モデルの研究に充てるとしている。
アルファ版だった Eleven v3 を、全プラットフォームで正式に提供し始めた。数字や記号の読み上げ誤りが、検証では15.3%から4.9%に減ったという。
Remove FX、Warp Markers、Alternates、4/4以外の拍子への対応を追加した。Premier 会員向け。
トリガーやスケジュールを設定すると、人が指示しなくても動き続ける AI エージェント。Slack、メール、カレンダーのほか、MCP 経由で Linear や Figma などとも連携する。Business と Enterprise 向けで、2026年5月3日までは無料で試せた。
Anthropic の Claude Opus 4.6 を Notion で使えるようにした。Notion は、複雑な依頼を手順に分けて実行する用途に向くと紹介している。