2024年3月

この月に主要AIサービスで起きた14件の出来事です。対話AI 4件、開発 2件、リサーチ 1件、画像生成 5件、動画生成 1件、音声・会議 1件。

対話AI4

  • Grokモデル

    Grok-1.5 を発表

    推論力を高め、コンテキスト長を128,000トークンに広げたモデル。MATH 50.6%、GSM8K 90%、HumanEval 74.1% の成績が示された。

  • Microsoft Copilot企業

    Suleyman が Microsoft AI を率いる

    DeepMind と Inflection の共同創業者 Mustafa Suleyman が、新設の Microsoft AI のトップに就いた。Copilot、Bing、Edge のチームは同部門の下に入った。OpenAI との提携は続くとした。

  • Grokモデル

    Grok-1 の重みを公開

    314Bパラメータの Mixture-of-Experts モデル Grok-1 の重みとアーキテクチャを Apache 2.0 ライセンスで公開した。2023年10月に完了した事前学習のベースモデルで、対話向けの微調整は行われていない。

  • Claudeモデル

    Claude 3 ファミリーを公開

    Haiku、Sonnet、Opus の3モデルを同時に出した世代。全モデルが画像入力に対応し、200Kトークンのコンテキストを持つ。

開発2

  • Devinモデル

    Devin を発表、AIソフトウェアエンジニア

    Cognition が自律型のAIソフトウェアエンジニア Devin を発表した。SWE-bench で課題の13.86%をエンドツーエンドで解決したとしている。当時は早期アクセスで、待機リストを受け付けていた。

  • Cursorモデル

    Claude 3 Opus を利用可能に

    Pro と Business のユーザーが、設定でカスタムモデルとして claude-3-opus を追加できるようになった。高速リクエストは1日10回まで無料で、それを超える分は遅くなる。

リサーチ1

  • Sakana AIモデル

    進化的モデルマージの3モデルを公開

    複数のオープンモデルを進化的アルゴリズムで組み合わせる手法を発表した。日本語LLMの EvoLLM-JP、視覚言語モデルの EvoVLM-JP、画像生成の EvoSDXL-JP を公開した。

画像生成5

  • Adobe Firefly企業

    Firefly Services とカスタムモデル

    Adobe Summit で、企業向けの Firefly Services と Custom Models が発表された。Firefly Services は20以上の生成系 API やツールを提供する。Custom Models は10〜20枚ほどの自社素材でモデルを調整できる。

  • Midjourney機能

    スタイルリファレンス v2 を公開

    参照画像の雰囲気を新しい画像に反映する --sref の第2版。画風だけを抽出し、余計な要素が混ざりにくくなった。

  • Midjourney提供終了

    画像評価の無料GPU報酬を停止

    画像ランキングへの参加で無料の GPU 時間を配る仕組みをやめた。評価活動の約半数が自動化や不正利用だったことが理由とされる。

  • Midjourney機能

    キャラクターリファレンスを追加

    参照画像を指定して、同じ人物やキャラクターの外見を保った画像を作る機能。--cref と --cw で再現の強さを調整できる。

  • Midjourney機能

    V6 Turbo モードを追加

    生成を高速化する Turbo モードを追加した。約35秒かかる処理を約10秒に短縮できる代わりに、利用コストは2倍になる。

動画生成1

  • Sora企業

    制作者による初期作品を紹介

    Sora の発表後に協力してきた映像作家やデザイナーらの作品と所感を公開した。短編「Air Head」を制作した shy kids などが紹介された。

音声・会議1

  • Sunoモデル

    v3 を公開

    1回の生成で2分の曲を作れるモデル。音質、ジャンルの幅、指示への追従性を改善した。全ユーザーが利用でき、生成物の識別用に透かし技術も導入した。