ChatIMG.AI
MAI-Image-2.5 부분 편집 vs 대화형 수정, 2026 선택법
Comparisons

MAI-Image-2.5 부분 편집 vs 대화형 수정, 2026 선택법

게시일 · 작성자: ChatIMG.ai 팀
ChatIMG.AI을 Google 선호 소스로 추가 주요 뉴스와 AI 답변에서 ChatIMG.AI를 더 자주 만나보세요.

이미 쓸 만한 상품 컷이 하나 있습니다. 고객이 원하는 건 선반을 연회색 스튜디오로 바꾸고, 포스터 위 「여름 특가」를 「멤버십 데이」로 고치며, 오른쪽 아래 얼굴을 가리지 않는 작은 아이콘을 하나 더하는 것뿐입니다. 모델에게 「한 장 다시 생성」을 시키면 인물은 떠돌고, 레이아웃은 다시 흐트러지며, 겨우 맞춰 둔 조명도 사라집니다. 진짜로 사야 할 것은 「더 잘 그리는 능력」이 아니라, 지목한 그 블록만 고치고 나머지는 고정하는 능력입니다.

2026년 6월 2일, 마이크로소프트는 이를 MAI-Image-2.5의 공개 셀링 포인트로 썼습니다. 장면 인식 부분 편집. 같은 날 스스로 올린 Arena 스냅샷에서 이미지 편집 보드 2위, 문생 3위였습니다. 2위는 실패가 아닙니다. 전장을 「누가 포스터를 처음부터 더 잘 그리느냐」에서 「누가 이미 가진 그 장을 더 잘 고치느냐」로 옮긴 것입니다.

이 글은 어제 그 제품 설명 페이지를 다시 쓰지 않습니다. 설명서는 「모델이 무엇을 냈는지」에 답하고, 여기는 세 가지만 답합니다. 부분 편집이 검수하는 세 가지 작업이 무엇인지, 대화형 수정과 선택 영역 도구의 차이는 상호작용이지 모델 이름이 아니라는 점, 포스터·한 곳만 고치기·여러 라운드 연속 수정에서 어떻게 고를지.

목차

6월 2일에 무엇이 나왔나: 장면 인식, 새 화풍이 아님

공식 글 날짜는 2026년 6월 2일입니다. 입구는 MAI Playground, Microsoft Foundry, 그리고 PowerPoint의 이미지 생성, OneDrive에 순차 공개되는 편집입니다. 같은 계열에 더 빠르고 저렴한 Flash 변형도 있습니다. API 문서는 능력을 이렇게 씁니다. 문생 + 이미 있는 그림에 대한 제어 가능한 편집.

마이크로소프트가 이름 붙인 세 가지는 「새 화풍」이 하나도 없습니다.

공식 표현실제로 사는 것
Complex visual reasoning물체를 더할 때 원근·비율·그림자가 장면에 맞고, 스티커를 붙인 느낌이 아님
Fine-grained edit control물체 교체·글자 수정·모션 블러 제거, 나머지 화면은 그대로
Face and identity consistency포즈·표정·카메라 각을 바꿔도 사람은 같은 사람

마이크로소프트 글은 작업 동사를 직설적으로 씁니다. 물체 교체, 텍스트 업데이트, 모션 블러 제거, 동시에 「나머지 화면은 그대로」. 물체를 더할 때는 올바른 원근과 그림자를 동반해야 합니다. 이는 「더 예쁜 그림을 한 장 다시 흔든다」의 반의어입니다.

아래 대조 컷은 MAI-Image-2.5를 같은 테이블에 올리기 쉽게 합니다. 또 하나의 문생 이름이 아니라, 편집 동사입니다.

2026년 플래그십 문생·편집 모델 가로 비교 커버는 기존 모델 비교 컷으로, 부분 편집을 같은 테이블에 올립니다. 출처: ChatIMG.

이벤트 랜딩은 MAI-Image-2.5란 무엇인가를 보세요. 그 페이지는 공개 사실과 「같은 작업을 대화창에서 어떻게 하는지」를 다루고, 이 글은 부분 편집을 문생·영역 마법봉·대화 반복 세 갈래에서만 가릅니다. 공식 21초 능력 클립은 아래 마이크로소프트 소개를 보세요.

데모: 마이크로소프트 공식 21초 소개. 출처: YouTube · Microsoft, 6월 2일 공지와 대조.

실무 규칙: 새 모델 글을 읽을 때 먼저 「편집류 능력」 개수를 세요. 개수가 문생 셀링 포인트 이상이면, 이 글은 또 하나의 출시 요약이 아니라 비교를 쓸 가치가 있습니다.

세 가지 작업 검수법: 배경 교체, 글자 교체, 물체 추가

InstructPix2Pix는 지시형 이미지 편집을 이렇게 정의합니다. 사람 말로 이미 있는 그림을 고치고, 먼저 mask를 그릴 필요는 없다. MAI-Image-2.5는 이를 「장면 인식」으로 만들었습니다. 모델이 구조·빛·척도·공간 관계를 알아야 하며, 한 블록만 따내는 수준이 아닙니다.

검수는 Arena 점수를 보지 마세요. 아래 자기 그림 세 장만 보세요.

  1. 배경 교체: 선반을 연회색 스튜디오로. 주체 가장자리에 잔털이 있는지, 바닥 그림자가 따라 바뀌는지, 얼굴 하이라이트가 떠도는지.
  2. 글자 교체: 포스터 위 한 줄 프로모션을 다른 줄로. 글자 크기와 자간은 원판에 가깝게. 옆 아이콘·바코드·면책 작은 글씨가 다시 배치되지 않았는지.
  3. 물체 추가: 오른쪽 아래에 얼굴을 가리지 않는 작은 아이콘. 원근과 그림자가 원래 거기 있던 것처럼 보이는지, PNG를 붙인 것처럼 보이는지.

Foundry 문서는 같은 계열 편집을 이렇게 씁니다. 물체 교체, 레이아웃 미세 조정, 텍스트 업데이트, 모션 블러 같은 아티팩트 제거, 동시에 구도 유지. 재검증 가능한 「한국어 작은 글씨 정확도」는 주지 않습니다. 그래서 이 글은 「누가 한국어가 더 정확하다」를 지어내지 않습니다. 쓸 수 있는 것만 씁니다. 작업 동사가 맞아야 통과입니다.

「한 곳만 고치고 나머지는 고정」이 영역 도구에서 눈에 보이는 버튼으로 어떻게 만들어졌는지 보려면 Grok Imagine Image 2.0 vs GPT Image 2를 대조하세요. 그쪽이 파는 것은 마법봉·분할·누끼이지, 장면 추론이 아닙니다. 두 라인 모두 합법적이고, 서비스하는 손가락 동작이 다릅니다.

아래 워크플로 도식은 「한 번에 변수 하나만」을 그립니다. 나머지를 먼저 고정하고, 지목된 그 블록만 움직입니다.

변수 하나만 바꾸는 부분 편집 워크플로 삽화: 항목별로 고치고 나머지는 고정. 출처: ChatIMG 기존 워크플로 도식.

실무 규칙: 부분 편집 검수는 딱 하나만 보세요. 클릭하지 않은 곳이 떠돌았는지. 떠돌았다면 Arena 점수가 아무리 높아도 통과가 아닙니다.

대화형 수정: 선택 영역을 배우지 않는 길

영역 도구는 「어디를 고칠지」를 가리키게 합니다. 마법봉, 분할, 브러시, 사각형. 장면 인식 부분 편집은 「장면 이해」를 모델에 넘기지만, 어느 블록을 고칠지는 여전히 말해야 합니다. 대화형 수정은 더 가볍습니다. 연속된 몇 문장으로 반복하고, 모델이 위치를 스스로 추론합니다. 후자가 InstructPix2Pix의 원래 정의에 더 가깝고, 선택 영역을 배우기 싫은 사람에게 맞습니다.

Adobe는 정밀 제어(Precision Flow / Markup)로 가고, 분해는 Firefly Precision Flow vs 대화형 수정을 보세요. 대화형 루트는 픽셀 단위 브러시와 겨루지 않습니다. 겨루는 것은 「한 문장으로 말할 수 있는 작업이, 몇 라운드 안에 딱 맞게 가는가」입니다.

아래 도식은 「거친 것에서 정밀한 것으로」 가는 대화 반복을 그립니다. 첫 문장에 배경, 둘째에 가장자리, 셋째에야 글자.

대화형 수정의 거친 것에서 정밀한 것으로의 반복 과정 삽화: 한 라운드에 한 문장, 변수를 한꺼번에 세 개 넣지 마세요. 출처: ChatIMG.

ChatIMG는 이 열에 섭니다. 그림 한 장을 올리고 「배경 바꾸기 / 워터마크 지우기 / 국소 고치기」를 한 문장으로 끝내며, 선택 도구부터 배우게 하지 않습니다. MAI-Image-2.5를 모델 선택기에 넣지 않았습니다—이벤트 페이지에도 그렇게 적혀 있습니다. 고를 수 있는 것은 대화창에 실제로 나열된 편집 모델뿐입니다. 모델 이름은 기능 자체가 아닙니다. 작업 동사가 기능입니다.

대화형 수정 무료 체험은 「이 문장이 고쳐야 할 곳만 고치는가」를 검증하기에 맞습니다. 마이크로소프트 모델 대타도, Grok 마법봉 껍데기도 아닙니다.

실무 규칙: 선택 영역을 못 찍으면, 랭킹 때문에 원 그리기부터 배우지 마세요. 먼저 자기 그림 한 장에 한 문장으로 시험하세요. 떠돌면 그다음에 선택 영역이 있는 도구로 바꾸고, 모델 이름부터 바꾸지 마세요.

작업별 선택: 부분 편집, 영역 도구, 대화 반복

뼈대는 X vs Y vs Z입니다. 셋째 극은 또 하나의 클로즈드 대형 모델이 아니라 어떻게 지휘하느냐입니다. 장면 인식 부분 편집, 눈에 보이는 선택 영역 도구, 대화 반복. 2026년 모델 출시 물결에서 단일 모델 해설은 공식 블로그에 짓밟힙니다. 남는 것은 「작업별로 어떻게 고르느냐」입니다. 더 긴 선택 맥락은 2026 AI 이미지 생성기 가로 비교를 보세요.

작업먼저 시도이유하지 말 것
이미 있는 그림, 배경 교체 / 한 줄 글자 교체 / 물체 하나 추가, 나머지 고정장면 인식 부분 편집(MAI-Image-2.5 이 제품 서사)공식 셀링 포인트가 건드리지 않은 영역 고정문생을 한 번 더 돌려 구도가 남길 도박하기
선택 영역을 보고, 경계가 깨끗해야 함영역 도구(마법봉 / 분할 / Markup)손가락이 가리킨 곳만 고침「장면 인식」을 원 그리기 대용으로 억지로 맞추기
선택 영역을 못 찍고 말만 함, 3–5라운드 연속 수정 준비대화형 수정지시형 편집의 원뜻: 한 곳만 고치고 나머지는 그대로모델 이름을 기능 자체로 취급
처음부터 텍스트 밀집 포스터 한 장문생 대조물(가로 비교의 포스터 기본 후보)부분 편집은 존재하지 않는 초안을 구하지 못함글자 교체 도구로 없는 포스터를 억지로 맞추기

결정 나무는 출구를 하나만 남깁니다. 도구를 골랐으면 자기 그림 한 장으로 시험하고, 「이것도 한번 보세요」 글을 또 열지 마세요.

결정 필터: 먼저 하나만 물으세요. 고칠 것이 「지목된 그 블록」인가, 「원을 그릴 수 있는 그 블록」인가, 아니면 「한 문장으로 말할 수 있고 몇 라운드 연속 수정할 작업」인가? 장면이면 부분 편집, 원이면 영역 도구, 말이면 대화.

Arena 스냅샷을 쓰는 법, 오용하는 법

마이크로소프트는 6월 2일 글에서 MAI-Image-2.5가 Arena 이미지 편집 보드 2위(글면은 Nano Banana 2를 앞선다고 씀), 문생 3위(글면은 GPT-Image-1.5와 Nano Banana Pro 2K를 앞선다고 씀)라고 적었습니다. 같은 날 Arena 공식 계정은 Single-Image-Edit 점수 1401을 공개했고, Nano Banana 2·Grok Imagine Image Quality·ChatGPT-Image-Latest-High Fidelity보다 약 10점 높다고 썼습니다. 이 숫자들의 날짜 앵커는 2026-06-02입니다.

이 숫자를 쓰는 방법은 두 가지뿐입니다.

  1. 시점 앵커: 6월 2일 그날, 편집 능력은 이미 1티어에 들어갔고 「그림도 고칠 수 있다」는 부속 기능이 아닙니다.
  2. 대조이지 왕관이 아님: 2위는 출시 서사가 의도적으로 편집 보드에 서 있음을 말하고, 보드가 살아 있어 몇 주 뒤 다시 찍으면 순위가 이미 바뀌었을 수 있음을 말합니다.

쓰면 안 되는 방식: 「2위」를 「지금도 2위」로 번역하거나, 「GPT Image 2를 전면 초과」로 번역하기. Arena는 선호 투표이지 인쇄물 검수가 아닙니다. 인쇄물 검수가 보는 것은 지정 영역이 떠돌았는지, 작은 글씨가 인쇄 가능한지, 더해 넣은 물체 그림자가 원래 거기 있던 것처럼 보이는지입니다.

보드 입구: Arena Image Edit. 인용할 때 스냅샷 날짜를 쓰세요. 날짜 없는 순위는 이 글이 말하지 않은 것으로 칩니다.

세 가지 수정 패러다임의 편집 경험 대조 삽화: 「보드 순위」와 「고칠 그 블록」을 따로 보세요. 출처: ChatIMG 기존 비교 컷.

반증 가능한 예측

  1. Arena 편집 보드가 2주 안에 MAI-Image-2.5를 톱3 밖으로 밀어내면: 이 글의 「편집은 일등 능력」 판단은 내려야 합니다. 부분 편집은 여전히 쓸 만할 수 있지만, 「1티어」라는 문장은 무효입니다.
  2. 마이크로소프트가 재검증 가능한 다국어 텍스트 테스트를 공개하고 포스터 기본 후보를 유의미하게 넘으면: 글자 교체 작업의 기본 도구는 말을 바꿔야 하고, 「한 줄 고치기」와 「처음부터 조판」을 같은 일로 섞어 쓸 수 없습니다.
  3. 소비자 쪽(PowerPoint / OneDrive / Playground)과 API의 능력 집합이 갈라지면: 실제로 누를 수 있는 도구를 기준으로 하고, 보도자료 능력 목록을 기준으로 하지 마세요.
  4. 장면 인식은 원 그리기 대용이 아닙니다. Markup / 마법봉류 「픽셀 단위 선택 영역」과 맞붙이면 잘못된 결론이 납니다.

이 예측을 본문에 쓰는 이유는 14일 뒤 되짚을 때 반증할 재료가 있게 하려는 것이지, 자신에게 변명을 남기려는 것이 아닙니다.

자주 묻는 질문

MAI-Image-2.5는 무엇인가요?
마이크로소프트 AI가 2026년 6월 2일에 공개한 이미지 생성·편집 모델입니다. 공식 셀링 포인트는 장면 인식 부분 편집입니다. 배경 교체·글자 수정·물체 추가 때 지목하지 않은 영역은 되도록 그대로입니다. 입구는 마이크로소프트 공지를 보세요.

지금도 Arena 편집 보드 2위인가요?
모릅니다. 가정하지도 마세요. 6월 2일 글과 Arena 공식 포스트가 말하는 것은 당일 스냅샷입니다. 보드는 살아 있고, 인용에는 날짜가 필수입니다.

ChatIMG에서 MAI-Image-2.5를 바로 고를 수 있나요?
없습니다. 모델 선택기에 없습니다. 이벤트 페이지 MAI-Image-2.5란 무엇인가는 같은 작업을 대화창에 연결합니다. 사진을 올리고, 무엇을 고칠지 한 문장으로 말하세요.

부분 편집과 대화형 수정은 무엇이 다른가요?
부분 편집은 「장면을 이해하고 + 건드리지 않은 영역을 고정」을 강조합니다. 대화형 수정은 「선택 영역을 못 찍고, 몇 문장으로 반복」을 강조합니다. 전자는 모델 능력일 수 있고, 후자는 상호작용 패러다임입니다. 선택은 손가락을 보고, 보도자료 제목을 보지 마세요.

Grok Imagine의 마법봉과 비교하면?
마법봉은 영역을 가리키게 합니다. MAI-Image-2.5의 공개 서사는 장면 추론입니다. 경계를 봐야 하면 영역 도구, 한 문장으로 고치려면 대화. 대조는 Image 2.0 영역 편집 평가를 보세요.

안정적으로 납품하는 사람은 새 모델 이름마다 쫓는 사람이 아니라, 매 수정을 귀속 가능하고 되돌릴 수 있게 만드는 사람입니다. 작업 동사를 먼저 적고, 그다음 도구를 여세요.

대화형으로 가장 가벼운 루트를 바로 시험하려면 chatimg.ai를 열어 그림 한 장을 올리고 한 문장으로 시작하세요. 오늘부터 「고쳐야 할 곳만 고친다」를 기본값으로 두고, 운에 맡기지 마세요.

ChatIMG.ai 팀

'도구 비교와 선택' 글 5편 모두 보기 →

이 AI 도구를 사용해 보세요