2024年9月

この月に主要AIサービスで起きた13件の出来事です。対話AI 3件、開発 1件、統合エージェント 1件、リサーチ 3件、画像生成 1件、動画生成 2件、音声・会議 1件、業務効率化 1件。

対話AI3

  • ChatGPTモデル

    OpenAI o1-preview を公開

    回答の前により長く考える推論モデルの第1弾として o1-preview と o1-mini を公開した。ChatGPT Plus と Team で利用できた。

  • Claude料金

    Claude Enterprise プランを開始

    500K トークンのコンテキスト、GitHub 連携(ベータ)、SSO、監査ログ、SCIM によるユーザー管理を備えた大企業向けプラン。会話内容を Claude の学習に使わない方針も明記された。

  • DeepSeekモデル

    DeepSeek-V2.5 を公開

    DeepSeek-V2-0628 と DeepSeek-Coder-V2-0724 の能力を1つに統合したモデル。API では deepseek-chat と deepseek-coder のどちらの名前でも使える。オープンソースとして Hugging Face でも公開された。

開発1

統合エージェント1

  • Genspark機能

    非同期の Autopilot Agent を公開

    公式ブログで、非同期で動く AI エージェント Autopilot Agent が発表された。公式は世界初の非同期 AI エージェントと表現している。

リサーチ3

  • NotebookLM機能

    YouTube と音声ファイルをソースに追加

    公開されている YouTube の URL と音声ファイルを資料として取り込めるようになった。動画は文字起こしへの引用が付き、音声は文字起こしして検索できる。音声概要の公開リンク共有も加わったが、Workspace では使えなかった。

  • NotebookLM機能

    音声概要 Audio Overview を追加

    資料をもとに、AI の2人のホストが対話形式で内容を解説する機能。ダウンロードして聞ける。当初は英語のみで、途中で割り込むことはできなかった。

  • Sakana AI企業

    シリーズAで約2億ドルを調達

    New Enterprise Associates、Khosla Ventures、Lux Capital が主導した。MUFG、SMBC、みずほ、富士通、NEC、KDDI、NVIDIA なども参加した。

画像生成1

  • Adobe Fireflyモデル

    Firefly Video Model を予告

    Adobe が動画向けの Firefly Video Model を予告した。テキストや画像から動画を作る機能と、Premiere Pro の Generative Extend が示された。提供は2024年内で、ベータ版の待機リストが開かれた。

動画生成2

  • Runway企業

    Lionsgate と専用モデルで提携

    Lionsgate の作品群で学習した専用の動画生成モデルを作る提携を発表した。映画の企画段階と仕上げ段階の作業に使う想定で、個人向けのひな形としての提供も検討するとした。

  • Runway機能

    Runway API を提供開始

    Gen-3 Alpha Turbo を開発者が自社のアプリや製品に組み込める API を発表した。当初は Omnicom などの一部の企業に限り、数週間かけて対象を広げるとした。

音声・会議1

  • Suno機能

    Covers を追加

    アップロードした音源を、メロディを保ったまま別のスタイルに作り替える機能。Pro と Premier 向けの早期ベータで、200回は無料、以降は1回10クレジット。

業務効率化1

  • Notion AI機能

    新しい Notion AI を公開

    AI コネクタ(ベータ)で、Google ドキュメント、スプレッドシート、スライド、Slack、GitHub を横断して検索できるようになった。PDF や画像の読み取り、スタイルガイドを参照した文章生成、GPT-4 や Claude とのチャットも加わった。