Skip to main content
OpenAI GPT-Image-2(gpt-image-2)는 ComfyUI에서 파트너 노드를 통해 이용 가능한 OpenAI의 최신 이미지 모델입니다. 이 모델은 생성에 앞서 ‘추론’을 수행하는 최초의 OpenAI 이미지 모델로, 일회성 샘플링 대신 구성 계획을 세우고 작업을 점검하며 반복적으로 수정합니다. 이 노드는 다음을 지원합니다:
  • 밀도 높은 텍스트, UI 요소, 아이콘, 인포그래픽, 지도, 슬라이드, 만화 컷 등을 강력하게 처리하는 텍스트 기반 이미지 생성
  • 최대 2K 해상도에서 높은 구조적 정확도를 유지하는 이미지 편집
  • 하나의 프롬프트로부터 최대 8개의 일관된 이미지 생성, 캐릭터와 객체의 연속성을 보존
GPT-Image-2는 노드 라이브러리의 OpenAI GPT Image 1.5 노드에서 model 옵션으로 선택됩니다. 이 노드는 OpenAI의 이미지 생성 API를 동기적으로 호출하고 설명과 일치하는 이미지를 반환합니다.

GPT-Image-2가 뛰어난 분야

추론 기반 생성

GPT-Image-2는 렌더링 이전에 구도를 계획합니다. 따라서 과거에 이미지 모델을 당황하게 만들었던 프롬프트에 매우 적합합니다. 예를 들어 11pt Helvetica로 중앙 정렬된 7개 항목의 글머리 기호 목록이 있는 포스터 같은 경우입니다. 밀집된 텍스트, 작은 UI 요소, 아이콘, 인포그래픽, 지도, 슬라이드에 대해 깔끔한 출력을 생성합니다.

중요한 부분을 보존하는 이미지 편집

GPT-Image-2는 구조적 충실도를 유지하면서 대상 편집을 처리합니다. 편집 영역 외부의 모든 것을 픽셀 단위로 안정적으로 유지하면서 요청된 변경 사항을 최대 2K 해상도로 깔끔하게 적용합니다. 얼굴, 지오메트리, 미세한 디테일을 왜곡하지 않고 흑백 사진에 색을 입히거나 장면을 정오에서 해질녘으로 전환하는 등의 작업에 사용하세요.

프롬프트당 최대 8개의 일관된 이미지

이 모델은 시리즈 전체에서 캐릭터와 객체의 연속성을 유지하면서 단일 프롬프트에서 최대 8개의 서로 다른 이미지를 반환할 수 있습니다. 이는 시드 고정이나 프롬프트 변형 없이 스토리보드, 참조 시트, 캐릭터 턴어라운드, 제품 변형을 만드는 데 유용합니다. 배치를 Save Image 노드에 바로 공급하거나 다운스트림의 비디오 워크플로에 연결하세요.

하이브리드 파이프라인

GPT-Image-2는 자연스럽게 하이브리드 파이프라인에 통합됩니다: 텍스트가 많은 히어로 프레임에는 GPT-Image-2를 사용한 후, 로컬 모델로 넘겨 업스케일링, 스타일화, 비디오 생성을 진행하세요. 각 단계에 가장 적합한 모델을 한 그래프 내에서 사용할 수 있습니다.

예시 출력

추론 기반 구성으로 텍스트 기반 이미지 생성: 입력 이미지에서 이미지 편집, 편집 영역 밖의 구조는 유지:

ComfyUI에서 사용하기

GPT-Image-2 워크플로

ComfyUI에서 텍스트 기반 이미지 생성 및 이미지 편집 워크플로를 로컬 또는 Comfy Cloud에서 실행하세요.