何が起きたか
文章による指示で画像を編集でき、最大4枚の参照画像も扱える。インペイントとアウトペイントに対応し、プロンプトバーやライトボックスから使える。
文章による指示で画像を編集でき、最大4枚の参照画像も扱える。インペイントとアウトペイントに対応し、プロンプトバーやライトボックスから使える。
Midjourney は2026年10月8日、生成済みの画像を見直して作り直す Thinking Mode の試験を Alpha サイトで始めた。対象は V8.2 のジョブで、料金と使えるプランは示されていない。
MidjourneyGemini API で gemini-omni-1.1-flash が一般提供(GA)になった。動画の生成と会話型の編集を行うモデルで、Veo 3.1 は高品質な映像向け、Omni Flash は会話での編集向けと公式は使い分けを示している。
Chrome 拡張が全有料プランで一般提供になった。安全な操作は分類器が自動承認し、毎回の確認が不要になる。
Grok Bot を SuperGrok、Cursor Pro、Cursor Teams の全プランで使えるようにした。Bot に任せた作業は、既存の利用量には数えられない。
スケジュールタスクを、Gmail の送信者や件名、Slack のチャンネル、プルリクエストの動きをきっかけに動かせる。Web とモバイルで、対象プランが使える。
画像とテキストを同時に入力できる実験的なマルチモーダルモデル。画像は1枚あたり最大384トークンとして V4-Flash の料金で課金される。画像を一度アップロードして ID で再利用できる Files API も無料で始まった。
Generate Music、Generate Speech、Generate Sound Effects の3機能が Firefly で使えるようになった。Firefly AI Assistant には1日あたりの上限付きで無料枠が加わった。Google の Gemini Omni Flash も選べる。