ChatGPT 이미지 2.5 출시: 이제 다른 원시 이미지 모델도 긴장해야 할 때

Tapbit Wire - Tapbit NewsTapbit Wire·출처:ChainCatcher·
공유

저자: 샤오징(소징), 텐센트 기술

편집기자: 쉬칭양(쉬칭양), 텐센트 기술

미국 현지 시간 9월 8일, OpenAI가 최신 이미지 생성 모델 'ChatGPT 이미지 2.5'를 공개했다.

신규 버전은 이미지 편집 기능, 참조 이미지 충실도, 다중 라운드 수정 시 일관성 향상에 초점을 맞췄다. 사용자가 이미지를 반복적으로 수정할 때 이전에 조정된 콘텐츠가 더 잘 유지되며, 인물·제품·배경 등을 수정할 때도 지정된 부분만 변경하기 쉬워졌다. 생성 속도는 이미지 2.0 대비 최대 50% 향상됐다.

동시에 ChatGPT는 스케치, 템플릿, 이미지 주석 기능을 추가했다. 사용자는 직접 스케치를 그려 참조 자료로 활용하거나 이미지에서 수정이 필요한 영역을 직접 표시할 수 있다. 개발자는 API를 통해 GPT-Image-2.5 플레어 및 GPT-Image-2.5 선버스트를 사용할 수 있다.

OpenAI에 따르면 현재 사용자들이 ChatGPT 이미지와 API 내 GPT-Image 모델을 통해 주간 30억 장 이상의 이미지를 생성하고 있다. 이미지 2.5는 ChatGPT, ChatGPT 워크, 코덱스 사용자에게 웹·데스크톱·모바일 전 플랫폼에서 제공된다.

ChatGPT 이미지 2.5 출시: 이제 다른 원시 이미지 모델도 긴장해야 할 때

01 전체가 아닌 한 부분만 변경

AI 생성 이미지의 진정한 어려움은 첫 이미지 생성 후에야 나타난다. 예를 들어 인물은 만족스럽지만 옷만 바꿔야 하거나, 제품은 확정됐으나 배경만 교체해야 하거나, 포스터는 완성됐지만 한 줄의 텍스트만 수정해야 할 경우 등이다. 과거에는 계속 수정하면 이미지의 다른 부분까지 변하는 경우가 많았다.

이미지 2.5는 정밀 편집을 핵심으로 강조한다. OpenAI는 '전신 편집'과 '다도시 여행 티켓' 사례를 제시했다. 이러한 시연은 연속된 이미지를 통해 수정 과정을 보여주며, 모델이 지시에 따라 특정 콘텐츠만 조정하면서 원래 주체·구도·기타 세부 요소를 유지할 수 있는지를 중점 평가한다.

ChatGPT 이미지 2.5 출시: 이제 다른 원시 이미지 모델도 긴장해야 할 때

'다도시 여행 티켓' 사례는 비교적 직관적이다. 이미지에서 하나의 정보만 변경해야 할 경우, 모델은 특정 수정 대상을 식별하면서 티켓 전체 디자인 구조를 유지해야 한다. 이 기능은 단순히 아름다운 이미지를 생성하는 것보다 제품 이미지·광고 자료·브랜드 포스터 등 실무 적용 측면에서 훨씬 유용하다.

또 다른 초점은 다중 라운드 편집이다. OpenAI는 '큐브 회전', '여행 인포그래픽', '생일 캔들' 세 가지 사례를 소개했다. 이는 단발성 생성이 아니라 여러 차례 연속적인 수정을 포함하며, 이전 수정 내용이 유지되고 이후 작업이 이미 완료된 콘텐츠를 지속해서 훼손하지 않음을 입증하려는 목적이다.

ChatGPT 이미지 2.5 출시: 이제 다른 원시 이미지 모델도 긴장해야 할 때

이는 이미지 2.5 업그레이드에서 가장 주목할 만한 측면이기도 하다.

사용자 @thesoragirls는 간단한 테스트를 진행했다: 이미지에 캔들을 그리되 꽃잎은 그대로 유지하도록 지시한 후, 다른 영역을 수정할 때 원래 콘텐츠가 영향을 받는지 관찰했다. 그녀의 테스트 결과, 고정된 꽃잎은 그대로 유지되었고, 나머지 부분은 요청에 따라 정확히 변경됐다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

그러나 지속적인 편집으로도 디테일 문제를 완전히 해결하진 못했다. 일본 애니메이터 @genel_ai는 실사 테스트에서 공식 발표와 달리 여러 차례 편집을 반복하면 아티팩트와 질감 변화가 여전히 발생함을 확인했다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

즉, 2.5 버전은 안정성이 향상됐지만 복잡한 장면에서는 여전히 품질 저하가 발생할 수 있다.

02. 참조 이미지 지원 — 더 높은 안정성

Images 2.5의 두 번째 주요 변경점은 참조 이미지 처리 방식이다.

사용자는 캐릭터, 반려동물 등 특정 대상의 사진을 제공한 후, 새로운 장면에 배치하거나 시각 스타일·구도를 바꾸도록 요청할 수 있다. OpenAI는 새 버전이 인물의 식별 가능한 특징을 더 잘 유지하면서 조명과 질감 표현도 개선됐다고 밝혔다.

공식 사례로는 ▲ 리디자인된 아기 초상화 ▲ 의상을 입은 강아지 ▲ 포토부스 초상화 ▲ 그룹 파티 합성 사진 ▲ 침대 정리하기 등 다섯 가지가 제시됐다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

이 사례들은 다양한 상황을 커버한다. 아기 초상화와 포토부스 초상화는 인물 특징 유지 여부를 중심으로, 강아지 사례는 복장 변경 후 원래 이미지의 일관성을 검증하며, 그룹 파티 합성 사진은 여러 인물을 한 장면에 자연스럽게 배치하는 능력을 보여준다. '침대 정리하기'는 일상적인 이미지 편집에 가까워 원본 장면에 대한 구체적 조정이 필요하다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

이 기능은 동일한 캐릭터·제품·브랜드 소재를 지속적으로 활용해야 하는 작업에 특히 중요하다. API 사용자는 동일한 참조 이미지를 기반으로 다양한 버전을 생성해 매번 새로 생성될 때 생기는 큰 변화 가능성을 줄일 수 있다.

복합 이미지도 이번 공식 사례의 주요 초점이다. OpenAI는 녹지, 호수, 미래형 건물이 있는 거대한 원통형 우주 거주지 앞에 가족이 서 있는 1950년대 스타일 일러스트를 선보였다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

OpenAI 공식 소개 페이지에는 이창(宜昌) 여행 페이지 예시가 게재됐다. 여행지, 관광 정보, 이미지, 텍스트를 하나의 페이지에 통합해 완성도 높은 여행 가이드를 구성했는데, 이는 단일 요소보다는 다수 이미지, 다양한 텍스트 계층, 전체 페이지 레이아웃을 동시에 처리해야 함을 의미한다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

또 다른 사례로는 중세 시대를 현대주의 스타일로 재해석한 3×3 격자 형식의 포스터 세트가 있는데, 각 포스터에는 '만들기', '함께 성장하기', '친절 선택하기' 등 서로 다른 기하학적 도형과 문구가 포함돼 있다.

또 다른 이미지는 인상파 스타일의 샌프란시스코 거리 풍경으로, 화려한 집들 사이로 길이 뻗어 있고 그 너머 베이와 골든게이트 브리지가 보인다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

그 외에도 크림-골드 톤의 레이크 코모 웨딩 청첩장, 상하 반전된 미래 도시, 미국 국립공원 8종 레트로 우표, 태양 흑점 과학 슬라이드, 블루-골드 지구 모자이크, ChatGPT 스티커 포스터, 비 내리는 미래 도시 등이 있다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

이 사례들은 일러스트, 포스터, 초대장, 인포그래픽, 과학 일러스트, 제품 홍보 이미지 등 다양한 유형을 다룹니다. OpenAI의 집중 포인트도 분명합니다: 프롬프트에서 이미지 구조, 텍스트, 시각 스타일, 특정 요소를 동시에 지정할 때, 이미지 2.5는 이러한 요구사항을 더 완전히 실행합니다.

패션 기업가 야나 웰린더는 이미지 2.5가 패션 디자인 성능에서 상당한 개선을 보였다고 평가합니다. 이전 모델 사용 시 참조 디자인은 유지됐지만 최종 결과물이 때때로 다소 평면적이었으나, 2.5는 원본 디자인을 보다 완전한 시각 효과로 구현할 수 있다고 말합니다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

그러나 일부에서는 반대되는 테스트 결과를 제시했습니다. AI 및 소프트웨어 엔지니어 마크 크레츠만은 특히 숲 장면에서 노이즈 및 아티팩트 테스트를 수행했습니다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

그는 2.5가 많은 개선점을 보였지만 테스트 결과가 불안정하다고 판단했습니다. 이후 이미지 2.5와 2.0을 비교한 결과, 그가 테스트한 여러 사례에서 2.0이 사실성 측면에서 더 나은 성능을 보였다고 밝혔습니다.

따라서 현재로서는 이미지 2.5가 주로 편집 제어 및 복합 지시 처리 능력을 개선했으나, 실제 효과는 이미지 유형에 따라 여전히 달라진다고 보는 것이 더 정확합니다.

03 몇 번의 스케치만으로도 이해합니다

모델 자체 외에도 OpenAI는 ChatGPT에 여러 새로운 조작 방식을 추가했습니다.

가장 직접적인 기능은 스케치입니다. 사용자는 ChatGPT 내에서 직접 스케치를 그리면, 모델이 이를 기반으로 최종 이미지를 생성합니다. 예를 들어, 방 디자인을 원할 땐 먼저 전반적인 배치를 그리고, 의류 제작을 원할 땐 윤곽선을, 혹은 단순히 대략적인 구성만 빠르게 스케치해도 ChatGPT에 맡겨 완성할 수 있습니다. 이후 시각 스타일 등 추가 요구사항을 적용할 수 있습니다.

사용하려면 간단히 “@Sketch.”라고 입력하면 됩니다. 이는 텍스트 프롬프트에 대한 의존도를 효과적으로 줄여줍니다. 일부 구성은 특히 물체의 위치, 비율, 대략적 윤곽처럼 언어로 설명하기 어려운데, 이제 사용자가 먼저 그린 후 모델이 세부 사항을 채워주는 방식으로 전환할 수 있습니다.

사용자 @fquolodasha는 GPT-이미지 2.5의 손그림 능력을 매우 높게 평가하며, 이번 결과가 ‘정말 멋지다’고 표현하고, OpenAI의 최근 급속한 업데이트와 역량 향상에 감탄을 표했습니다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

템플릿은 또 다른 문제를 해결합니다. ChatGPT는 포스터, 굿즈 등 일반적인 제작 형식을 미리 제공합니다. 사용자는 먼저 템플릿을 선택한 후, 표현하고 싶은 정보, 디자인 요소, 시각 스타일 등을 입력하면 되며, 매번 빈 캔버스에서 시작할 필요가 없습니다.

이미지 공유 기능에도 프롬프트 옵션이 추가됐습니다. 사용자는 이미지를 공유할 때 함께 생성에 사용된 프롬프트도 공유할 수 있습니다. 타 사용자는 이를 받아 자신의 사진과 세부 정보로 교체해 계속해서 이미지를 생성할 수 있습니다.

OpenAI가 제시한 예시는 1980년대 스타일의 초상화로, 곱슬머리, 화려한 자켓, 금 체인, 네온 조명, 음악 플레이어가 포함됩니다. 다른 사용자들은 이 아이디어를 바탕으로 자신의 사진을 대체해 활용할 수 있습니다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원시 이미지 모델들이 진짜 긴장해야 할 차례

04 두 가지 API 버전

이미지 2.5는 API에도 통합됐습니다. OpenAI는 GPT-이미지-2.5 플레어와 GPT-이미지-2.5 선버스트 두 가지 버전을 출시했습니다.

플레어는 속도, 품질, 편집 기능에 초점을 맞춘 기본 버전입니다. OpenAI는 플레어가 GPT-이미지-2보다 높은 품질을 생성하면서 지연 시간을 50% 감소시켜 소셜 콘텐츠, 제품 경험, 시각 검색, 신속한 프로토타이핑, 대규모 이미지 생성에 적합하다고 밝혔습니다.

선버스트는 공식 광고 자료 및 고품질 제품 이미지처럼 세밀한 제어가 필요한 작업에 더 적합합니다. 보다 정확한 편집을 위해 생성 시간을 늘리는 방식을 허용합니다.

OpenAI가 공개한 초기 사용자 피드백도 주로 편집 제어에 집중되었습니다.

히그스필드의 AI 제품 책임자 악술탄 알림쿨로프는 플레어가 변경되지 말아야 할 요소를 더 잘 이해한다고 구체적으로 언급했습니다. 영화, UGC, 광고 팀에게는 이는 한 요소를 수정할 때 원래 캐릭터, 구성, 시각적 인식을 최대한 보존할 수 있음을 의미합니다.

시리얼 엔트러프러너 @gkxspace는 상업용 이미지 워크플로 내에서 이 업데이트를 관찰했습니다. 그는 과거 AI 생성 이미지의 가장 큰 한계 중 하나가 첫 번째 이미지는 양호하더라도 이를 기반으로 한 두 번째·세 번째 이미지를 일관되게 안정적으로 생성하기 어려웠다는 점이라고 평가했습니다. 이미지 2.5의 연속 편집, 속도, 참조 이미지 충실도 개선은 이커머스 복장 변경, 브랜드 자료 확장, 연속 일러스트 등 실용적 활용 영역을 넓힙니다.

ChatGPT 이미지 2.5 출시: 이번엔 다른 원본 이미지 모델들이 진정으로 긴장해야 할 차례입니다

현재 이미지 2.5는 ChatGPT, ChatGPT 워크, 코덱스 사용자를 포함하며, API의 플레어와 선버스트도 공개되었습니다. OpenAI는 프롬프트 및 이미지 안전성 검사, C2PA 메타데이터, 눈에 보이지 않는 워터마크 등 자체 도구로 생성된 이미지를 식별하는 기제를 유지했습니다.

공식 사례 및 현재 사용자 테스트 결과, 이번 업데이트의 초점은 매우 명확합니다: 이미지 생성 후 수정을 보다 쉽게 제어하고, 연속 사용 시 참조 이미지의 안정성을 높이며, 스케치, 템플릿, 이미지 주석 등 작업을 워크플로에 통합하는 것입니다.

다중 편집 후 사실성, 디테일, 이미지 품질 측면에서는 기존 테스트 결과가 다양합니다. 이러한 문제들이 이미지 2.5에서 어느 정도 개선될지는 실제 활용을 통해 추가 검증이 필요합니다.