Grok-1.5 を発表
推論力を高め、コンテキスト長を128,000トークンに広げたモデル。MATH 50.6%、GSM8K 90%、HumanEval 74.1% の成績が示された。
この月に主要AIサービスで起きた14件の出来事です。対話AI 4件、開発 2件、リサーチ 1件、画像生成 5件、動画生成 1件、音声・会議 1件。
推論力を高め、コンテキスト長を128,000トークンに広げたモデル。MATH 50.6%、GSM8K 90%、HumanEval 74.1% の成績が示された。
DeepMind と Inflection の共同創業者 Mustafa Suleyman が、新設の Microsoft AI のトップに就いた。Copilot、Bing、Edge のチームは同部門の下に入った。OpenAI との提携は続くとした。
314Bパラメータの Mixture-of-Experts モデル Grok-1 の重みとアーキテクチャを Apache 2.0 ライセンスで公開した。2023年10月に完了した事前学習のベースモデルで、対話向けの微調整は行われていない。
Haiku、Sonnet、Opus の3モデルを同時に出した世代。全モデルが画像入力に対応し、200Kトークンのコンテキストを持つ。
Cognition が自律型のAIソフトウェアエンジニア Devin を発表した。SWE-bench で課題の13.86%をエンドツーエンドで解決したとしている。当時は早期アクセスで、待機リストを受け付けていた。
Pro と Business のユーザーが、設定でカスタムモデルとして claude-3-opus を追加できるようになった。高速リクエストは1日10回まで無料で、それを超える分は遅くなる。
複数のオープンモデルを進化的アルゴリズムで組み合わせる手法を発表した。日本語LLMの EvoLLM-JP、視覚言語モデルの EvoVLM-JP、画像生成の EvoSDXL-JP を公開した。
Adobe Summit で、企業向けの Firefly Services と Custom Models が発表された。Firefly Services は20以上の生成系 API やツールを提供する。Custom Models は10〜20枚ほどの自社素材でモデルを調整できる。
参照画像の雰囲気を新しい画像に反映する --sref の第2版。画風だけを抽出し、余計な要素が混ざりにくくなった。
画像ランキングへの参加で無料の GPU 時間を配る仕組みをやめた。評価活動の約半数が自動化や不正利用だったことが理由とされる。
参照画像を指定して、同じ人物やキャラクターの外見を保った画像を作る機能。--cref と --cw で再現の強さを調整できる。
生成を高速化する Turbo モードを追加した。約35秒かかる処理を約10秒に短縮できる代わりに、利用コストは2倍になる。
Sora の発表後に協力してきた映像作家やデザイナーらの作品と所感を公開した。短編「Air Head」を制作した shy kids などが紹介された。
1回の生成で2分の曲を作れるモデル。音質、ジャンルの幅、指示への追従性を改善した。全ユーザーが利用でき、生成物の識別用に透かし技術も導入した。