指示ベースの画像編集とは?
指示ベースの画像編集は、「シャツを青くして」のような文章指示で既存の絵を変えます。元画像は残り、指定した部分だけが変わります。InstructPix2Pix(Brooks、Holynski、Efros、2022)はマスク不要——モデルが言葉から領域を推測すること——を示しました。
2026年8月22日時点の整理です。Microsoft AI は 2026年6月2日に MAI-Image-2.5 を公開しました。Arena Image Edit で 2位、テキストから画像で 3位。指定した領域だけ変え、それ以外は残すシーン対応の部分編集が売りです。
写真をアップロードし、変更を言葉で指定——背景の差し替え、文字の置き換え、オブジェクトの追加。このページでライブの ChatImg ジェネレーターが開きます。無料で始められます。
MAI-Image-2.5 の公開主張は、指定した一つの領域だけ変え、身元・周辺ピクセル・レイアウトは残せる、という点です。それは ChatImg がすでに売っている仕事——アップロード写真へのチャット指示——と同じです。
Microsoft は MAI-Image-2.5 を、これまでの最強画像モデルだと位置づけました。公開での主張は、リーダーボードの上昇に加え、固有の編集挙動です——絵の指定した部分だけ変え、身元・レイアウト・周辺ピクセルは崩さない、という点です。
Microsoft の 2026年6月2日の投稿では、MAI-Image-2.5 は Arena の Image Edit リーダーボードで 2位。Nano Banana 2 より上、同じボード上で GPT-Image-1.5 より上です。
同投稿では Arena のテキストから画像でも 3位。Microsoft のスナップショットでは GPT-Image-1.5 と Nano Banana Pro 2K より上です。
Product Hunt の掲載内容:背景の差し替え、文字の置き換え、オブジェクトの追加をしながら、身元・周辺ピクセル・レイアウトはそのまま。仕事はそこであり、絵全体のやり直しではありません。
ChatImg のモデル一覧に MAI-Image-2.5 はありません。代わりに Qwen Image Edit や GPT-Image-2 を選び、写真をアップロードして変更を言葉で指定できます——背景、文字、追加オブジェクト——画面全体を作り直さずに済みます。
商品ショット、ポスター、ポートレートから始めます。編集内容を一文で指定。残したいのは、それ以外の部分です。
ChatImg のモデル一覧を開き、指示ベースの部分編集なら Qwen Image Edit、切り抜きやスタイル刷新なら GPT-Image-2 を選びます。Discord も、始めるための新しいサブスクも不要です。
毎日の無料枠からジェネレーターを試せます。同じチャットが ChatImg の 15 ロケールに対応しているので、普段書いている言語で指示できます。
API キーも Discord も、始めるための新しいサブスクも不要です。
本ページのエディターを使うか、Qwen Image Edit があらかじめ選ばれたディープリンクを開きます。
「背景をスタジオのグレーに差し替えて。」「看板の文字を OPEN に置き換えて。」「テーブルにコーヒーカップを追加して。」
顔、商品、レイアウトが元の写真と一致するか確認します。一致していれば完了です。
人が実際に検索するタスク動詞です——モデル名ではありません。
EC の SKU やクリエイターのサムネイル。被写体は残し、スタジオ、街並み、ブランドの単色を入れます。
ポスター、メニュー、パッケージのモック。周囲のレイアウトを描き直さずに文言だけ変えます。
テーブル上の商品、ポートレートの小道具。新しいオブジェクトは同じ光の中に座り、貼り付け感が出ないようにします。
生成と編集の道筋に留まりましょう——いずれもライブのページで、行き止まりではありません。
指示ベースの画像編集は、「シャツを青くして」のような文章指示で既存の絵を変えます。元画像は残り、指定した部分だけが変わります。InstructPix2Pix(Brooks、Holynski、Efros、2022)はマスク不要——モデルが言葉から領域を推測すること——を示しました。
シーン対応とは、モデルが絵の残りを「まだ意味が通るシーン」として扱うことです。身元、照明、周辺ピクセルは、指定した変更のあとも一貫します。ハローが残る背景差し替えや、遠近を無視した新しい文字は、この主張が避けようとする失敗モードです。
Microsoft AI、2026年6月2日:MAI-Image-2.5 はこれまでの最強画像モデルであり、Arena Image Edit で 2位(Nano Banana 2 より上)、テキストから画像で 3位。
Microsoft AI — Introducing MAI-Image-2.5 ↗Product Hunt は MAI-Image-2.5 を、局所編集・身元保持・テキスト描画向けのテキストから画像および画像編集モデルとして掲載し、開発者アクセスは Foundry と OpenRouter 経由としています。
Product Hunt — MAI-Image-2.5 ↗InstructPix2Pix(Brooks、Holynski、Efros、2022)は指示に従う画像編集を確立:一文の指示、ユーザー提供マスクなし、単一のフォワードパスで編集。
InstructPix2Pix — arXiv:2211.09800 ↗よくある質問
ご質問はありますか?お気軽にどうぞ!
写真をアップロード。変更を指定。残りはそのまま。Qwen Image Edit と GPT-Image-2 はモデル一覧にあります。