MAI-Image-2.5の部分編集と対話編集、2026年の選び方
すでに使える商品画像があります。顧客が求めるのは、棚を薄いグレーのスタジオに差し替え、ポスター上の「夏季セール」を「会員デー」に直し、右下に顔を遮らない小さなアイコンを足すことだけです。モデルに「もう一枚生成し直して」と頼むと、人物がずれ、文字組が再配置され、前回やっと揃えた光も消えます。本当に買いたいのは「もっと描ける」ことではなく、指名した一塊だけ直し、残りは凍結することです。
2026年6月2日、マイクロソフトはこの課題を MAI-Image-2.5 の公開の売りとして書きました:シーン理解の部分編集。同日に自ら貼り出した Arena のスナップショットでは、画像編集ランキング2位、テキスト画像3位。2位は敗北ではなく、戦場を「誰がゼロからポスターを描けるか」から「誰がすでに持っている一枚をよりうまく直せるか」へ移した、という合図です。
本稿は昨日の製品説明ページを書き直しません。説明書が答えるのは「モデルが何を出したか」。ここが答えるのは三問だけです。部分編集は実際にどの三タスクで受け入れるか。対話式画像編集と選択範囲ツールの差はインタラクションにあり、モデル名にはない。ポスター、一箇所修正、連続の数ラウンド——どう選ぶか。
目次
- 6月2日に何が出たか:シーン理解であり、新しい画風ではない
- 三つのタスクの受け入れ:背景差し替え、文字差し替え、物体追加
- 対話式画像編集:選択範囲を学ばない道
- タスク別:部分編集、領域ツール、対話反復
- Arena スナップショットの使い方と誤用
- 反証可能な予測
- よくある質問
6月2日に何が出たか:シーン理解であり、新しい画風ではない
公式稿の日付は 2026年6月2日 です。入口は MAI Playground、Microsoft Foundry、および PowerPoint の画像生成、OneDrive で順次ロールアウトされる編集です。同系列にはより速くより安い Flash 変体もあります。API ドキュメントは能力をこう書いています:テキスト画像+既存画像への制御可能な編集。
マイクロソフトが名指しする三件に、「新しい画風」は一条もありません:
| 公式の言い方 | 実際に買っているもの |
|---|---|
| Complex visual reasoning | 物体追加時に透視・比率・影が場面に追いつき、ステッカーを貼るだけではない |
| Fine-grained edit control | 物体差し替え、文字修正、モーションブラー除去で、残りの画面は動かさない |
| Face and identity consistency | ポーズ・表情・カメラ位置を変えても、人物は同一人物のまま |
マイクロソフト稿はタスク動詞を直球で書いています:物体を差し替え、文字を更新し、モーションブラーを除き、同時に「残りの画面は動かさない」。物体追加時は正しい透視と影を伴うこと。これは「もう一枚、より美しい図を振り直す」ことの反意語です。
下の対照図は、MAI-Image-2.5 を同じテーブルに置くためのものです——また一つのテキスト画像の名ではなく、編集の動詞です。
カバーは既存のモデル比較図を使い、部分編集を同じテーブルに置くためのものです。出典:ChatIMG。
イベントページは MAI-Image-2.5 とは を参照してください。あちらは公開事実と「同じ仕事をダイアログでどうやるか」を語り、本稿は部分編集をテキスト画像、領域のマジックワンド、対話反復の三路から切り分けるだけです。公式の 21 秒デモを見たい場合は、マイクロソフト自身の紹介が下にあります。
デモ:マイクロソフト公式 21 秒紹介。出典:YouTube · Microsoft、対照は 6月2日公告。
実用ルール: 新モデル稿を読むときは、まず「編集系能力」の条数を数えてください。条数がテキスト画像の売り以上なら、この比較は対比を書く価値があります。また発表会の要約を書く必要はありません。
三つのタスクの受け入れ:背景差し替え、文字差し替え、物体追加
InstructPix2Pix は指令式画像編集を、人が話す一文で既存画像を直し、先に mask を描かなくてよい、と定義しました。MAI-Image-2.5 はそれを「シーン理解」に仕上げます——モデルは構造・光・尺度・空間関係を理解する必要があり、一塊を切り抜くだけでは足りません。
受け入れは Arena 点を見ません。見るのはあなた自身の次の三枚だけです:
- 背景差し替え:棚を薄いグレーのスタジオに替える。主体の縁に毛羽立ちはないか、床の投影はついてきたか、顔のハイライトは漂っていないか。
- 文字差し替え:ポスター上一行の販促を別の一行に直し、フォントサイズと字間はできるだけ原版に寄せる。隣のアイコン、バーコード、免責の小さい文字が再配置されていないか。
- 物体追加:右下に顔を遮らない小さなアイコンを足す。透視と影は「もともとそこにあった」ように見えるか、それとも PNG を貼っただけに見えるか。
Foundry ドキュメントは同類の編集をこう書いています:物体差し替え、版面の微調整、文字更新、モーションブラーなどのアーティファクト除去、同時に構図を保つ。再現可能な「中国語小文字の正確率」は出していません。したがって本稿は「誰の中国語がより正確か」をでっち上げません。書けるのは次だけです。タスク動詞が噛み合って、はじめて合格です。
「一箇所直し、残りは凍結」が領域ツールでどう見えるボタンになったかを対照するなら、Grok Imagine Image 2.0 vs GPT Image 2 を見てください——あちらが売るのはマジックワンド、セグメンテーション、背景除去であり、シーン推論ではありません。二路線とも合法で、奉仕する指の動作が違います。
下のワークフロー図は「一度に一つの変数だけ直す」を描いています:まず残りを凍結し、そのあと指名された一塊を動かします。
図:項目ごとに直し、残りは凍結。出典:ChatIMG 既存のワークフロー模式図。
実用ルール: 部分編集の確認は一件だけ見ます——指していない場所が漂っていないか。漂ったら、どれだけ高い Arena 点でも合格ではありません。
対話式画像編集:選択範囲を学ばない道
領域ツールは「どこを直すか」を指し示させます:マジックワンド、セグメンテーション、ブラシ、矩形枠。シーン理解の部分編集は「場面を理解する」ことをモデルに渡しますが、どこを直すかはなおはっきり言う必要があります。対話式画像編集はより軽い:続く数文の人話で反復し、モデル自身が位置を推測します。後者は InstructPix2Pix の原定義に近く、選択範囲を学びたくない人に向きます。
Adobe は精密制御(Precision Flow / Markup)を行き、分解は Firefly Precision Flow vs 対話式画像編集 を参照してください。対話式ルートは画素級ブラシでは勝負しません。勝負するのは「一文で言い切れるタスクが、数ラウンド内にちょうどよく着地するか」です。
下の図は「粗いところから細かいところへ」の対話反復を描いています——第一文で背景を替え、第二文で縁を直し、第三文でようやく文字を動かします。
図:1ラウンドに1文、三つの変数を一度に詰め込まない。出典:ChatIMG。
ChatIMG はこの列に立ちます。一枚をアップロードし、「背景差し替え/透かし除去/局所修正」を一文で言い、先に選択範囲ツール一式を学ばせません。モデル選択器に MAI-Image-2.5 は入っていません——イベントページにもそう書いてあります。選べるのは、ダイアログに実際に並んでいる編集モデルだけです。モデル名は機能そのものではなく、タスク動詞こそが機能です。
対話式画像編集を無料で試す は、「この一文が直すべきところだけ直せるか」を検証するのに向きます。マイクロソフトモデルの代役でも、Grok マジックワンドの殻でもありません。
実用ルール: 選択範囲を点せないなら、ランキングのために囲み選択一式を学ばないこと。まず一文で自分の一枚を試し、漂ったら選択範囲つきのツールに替え、先にモデル名を替えないこと。
タスク別:部分編集、領域ツール、対話反復
骨格は X vs Y vs Z です。第三極はまた一つのクローズド大モデルではなく、どう指揮するか:シーン理解の部分編集、見える選択範囲ツール、対話反復。2026 のモデル発表潮では、単モデル解釈は公式ブログに潰されます。残るのは「タスク別にどう選ぶか」です。より長い選定コンテキストは 2026 AI 画像生成器横評 を参照してください。
| タスク | まず試す | 理由 | やってはいけないこと |
|---|---|---|---|
| 既存図で、背景差し替え/一行の文字差し替え/物体一つ追加、残りは凍結 | シーン理解の部分編集(MAI-Image-2.5 のこの製品叙事) | 公式の売りが未接触領域を動かさないこと | テキスト画像をもう一周回して構図が残ると賭ける |
| 選択範囲を見たい、境界はきれいでなければならない | 領域ツール(マジックワンド/セグメンテーション/Markup) | 指が当たったところだけ直す | 「シーン理解」を囲み選択の代替にして無理に寄せる |
| 選択範囲を点せない、話すだけ、3–5 ラウンド連続で直す準備がある | 対話式画像編集 | 指令式編集の原義:一箇所直し、他は動かさない | モデル名そのものを機能だと思い込む |
| ゼロから文字密集のポスターを一枚作る | テキスト画像の対照物(横評のポスター既定候補) | 部分編集は存在しない初稿を救えない | 文字差し替えツールで存在しないポスターを無理に寄せる |
決定木の出口は一つだけ残します。ツールを選んだら、自分の一枚で試し、また「〇〇も見てよい」の別稿を開かないこと。
判断フィルター: まず自分に一文だけ問うこと——直したいのは「指名された一塊」か、「囲める一塊」か、それとも「一文で言い切れ、数ラウンド連続で直す準備があるタスク」か?場面なら部分編集、囲み選択なら領域ツール、話すなら対話。
Arena スナップショットの使い方と誤用
マイクロソフトは 6月2日稿でこう書いています:MAI-Image-2.5 は Arena 画像編集ランキングで2位(稿面では Nano Banana 2 を超えたと記述)、テキスト画像で3位(稿面では GPT-Image-1.5 と Nano Banana Pro 2K を超えたと記述)。同日 Arena 公式アカウント は Single-Image-Edit スコア 1401 を公表し、Nano Banana 2、Grok Imagine Image Quality、ChatGPT-Image-Latest-High Fidelity より約 10 点高いと書きました。これらの数字の日付アンカーは 2026-06-02 です。
この数字の使い方は二つだけです:
- 時点アンカー:6月2日この日、編集能力はすでに第一線に入っており、「一応画像編集もできる」付属機能ではありません。
- 対照であり、王冠ではない:2位は、発表叙事が意図的に編集ランキングに立っていることを示し、ランキングが生きていること、数週間後にまた一枚切り取れば順位が入れ替わっているかもしれないことも示します。
使ってはいけないやり方:「2位」を「いまもなお2位」や「全面で GPT Image 2 を上回った」に翻訳すること。Arena は選好投票であり、印刷物の受け入れ検査ではありません。印刷物の検査が見るのは、指定領域が漂っていないか、小さい文字が刷れるか、足した物体の影が「もともとそこにあった」ように見えるか、です。
ランキング入口:Arena Image Edit。引用するときはスナップショット日を書いてください。日付のない順位は、本稿では言っていないものとみなします。
図:「ランキング順位」と「直したい一塊」を分けて見る。出典:ChatIMG 既存の比較図。
反証可能な予測
- Arena 編集ランキングが二週間以内に MAI-Image-2.5 を上位三から外したら:本稿の「編集は一等の能力」という判断は降格し、部分編集はなお使える可能性がありますが、「第一線」という言い方は無効です。
- マイクロソフトが再現可能な多言語文字テストを公表し、かつポスター既定候補を大きく上回ったら:文字差し替えタスクの既定ツールは言い換えが必要で、「一行の文字を直す」と「ゼロから版面を組む」を同じことに一緒くたに書けなくなります。
- コンシューマ側(PowerPoint / OneDrive / Playground)と API の能力セットが分岐したら:実際にクリックできるツールを基準にし、プレスリリースの能力一覧を基準にしません。
- シーン理解は囲み選択の代替ではありません。Markup/マジックワンド系の「画素級選択範囲」と突き合わせると、誤った結論になります。
これらの予測を本文に書くのは、14 日後に見返したとき反証できるものを残すためであり、自分に逃げ道を残すためではありません。
よくある質問
MAI-Image-2.5 とは?
マイクロソフト AI が 2026年6月2日に公開した画像生成・編集モデル。公式の売りはシーン理解の部分編集:背景差し替え、文字差し替え、物体追加のとき、指名していない領域はできるだけ動かさない。入口は マイクロソフト公告。
いまもなお Arena 編集ランキング2位ですか?
わかりませんし、仮定すべきでもありません。6月2日稿と Arena 公式投稿が言うのは当日のスナップショットです。ランキングは生きており、引用には日付が必須です。
ChatIMG で直接 MAI-Image-2.5 を選べますか?
選べません。モデル選択器にはありません。イベントページ MAI-Image-2.5 とは は、同じ仕事をダイアログに繋ぎます:写真をアップロードし、何を直すかを一文で言う。
部分編集と対話式画像編集の違いは?
部分編集は「シーンを理解する+未接触領域を凍結」を強調し、対話式画像編集は「選択範囲を点せない、数文で反復する」を強調します。前者はモデル能力であり得、後者はインタラクションのパラダイムです。選定は指を見て、プレスリリースの見出しを見ません。
Grok Imagine のマジックワンドと比べると?
マジックワンドは領域を指し示す必要があります。MAI-Image-2.5 の公開叙事はシーン推論です。境界を見たいなら領域ツール、一文で直したいなら対話。対照は Image 2.0 領域編集評測。
安定して納品できる人は、新しいモデル名を追う人ではなく、毎回の修正を帰属可能・ロールバック可能にする人です。まずタスク動詞を書き、そのあとでツールを開くこと。
対話式という最も軽い路線をいま試したいなら、chatimg.ai を開き、一枚をアップロードし、一文で直し始めましょう——今日から、「直すべきところだけ直す」を既定にし、運に任せないこと。
ChatIMG.ai チーム