gpt-image-2)는 ComfyUI에서 파트너 노드를 통해 이용 가능한 OpenAI의 최신 이미지 모델입니다. 이 모델은 생성에 앞서 ‘추론’을 수행하는 최초의 OpenAI 이미지 모델로, 일회성 샘플링 대신 구성 계획을 세우고 작업을 점검하며 반복적으로 수정합니다.
이 노드는 다음을 지원합니다:
- 밀도 높은 텍스트, UI 요소, 아이콘, 인포그래픽, 지도, 슬라이드, 만화 컷 등을 강력하게 처리하는 텍스트 기반 이미지 생성
- 최대 2K 해상도에서 높은 구조적 정확도를 유지하는 이미지 편집
- 하나의 프롬프트로부터 최대 8개의 일관된 이미지 생성, 캐릭터와 객체의 연속성을 보존
model 옵션으로 선택됩니다. 이 노드는 OpenAI의 이미지 생성 API를 동기식으로 호출하고 설명과 일치하는 이미지를 반환합니다.
GPT-Image-2가 잘하는 것
추론 기반 생성
GPT-Image-2는 렌더링 이전에 구성을 계획합니다. 따라서 과거에는 이미지 모델이 감당하지 못했던 프롬프트에 특히 적합합니다. 예를 들어 11pt 헬베티카로 중앙 정렬된 7개 항목의 글머리 기호 목록이 포함된 포스터 같은 프롬프트에도 대응하며, 조밀한 텍스트, 작은 UI 요소, 아이콘, 인포그래픽, 지도, 슬라이드에 대해서도 깔끔한 출력을 생성합니다.중요한 요소를 보존하는 이미지 편집
GPT-Image-2는 구조적 충실도를 유지하면서 특정 부분만 편집합니다. 편집 영역 밖의 모든 것은 픽셀 단위로 안정적으로 유지한 채, 요청한 변경 사항을 최대 2K 해상도로 깔끔하게 적용합니다. 얼굴, 형태, 미세한 디테일을 왜곡하지 않으면서 흑백 사진에 색을 입히거나, 장면을 정오에서 해질녘으로 바꾸는 등의 작업에 활용할 수 있습니다.프롬프트당 최대 8개의 일관된 이미지
이 모델은 시리즈 전체에서 캐릭터와 객체의 연속성을 유지하면서, 단일 프롬프트에서 최대 8개의 서로 다른 이미지를 반환할 수 있습니다. 시드 고정이나 프롬프트를 억지로 조정하는 수고 없이도 스토리보드, 레퍼런스 시트, 캐릭터 턴어라운드, 제품 변형 이미지를 만드는 데 유용합니다. 이 배치를Save Image 노드에 바로 연결하거나, 이후 단계의 비디오 워크플로로 이어서 연결할 수 있습니다.
하이브리드 파이프라인
GPT-Image-2는 자연스럽게 하이브리드 파이프라인에 통합됩니다: 텍스트가 많은 히어로 프레임에는 GPT-Image-2를 사용한 후, 로컬 모델로 넘겨 업스케일링, 스타일화, 비디오 생성을 진행하세요. 각 단계에 가장 적합한 모델을 한 그래프 내에서 사용할 수 있습니다.출력 예시
추론 기반 구성을 사용한 텍스트 기반 이미지 생성: 입력 이미지를 편집하되, 편집 영역 밖의 구조는 보존합니다:시작하기
- ComfyUI를 최신 버전(v0.19.4 이상)으로 업데이트하거나 Comfy Cloud를 사용하세요.
- 노드 라이브러리에서 OpenAI GPT Image 1.5를 검색하여 노드를 추가하세요.
model필드를gpt-image-2로 설정하세요.
사용 가능한 워크플로
텍스트 기반 이미지 생성 (T2I)
GPT-Image-2의 추론 기반 구성으로 텍스트 프롬프트를 통해 이미지를 생성하세요.클라우드에서 텍스트 기반 이미지 생성 실행
Comfy Cloud에서 텍스트 기반 이미지 생성 워크플로를 즉시 시험해 보세요.
텍스트 기반 이미지 생성 워크플로 다운로드
워크플로 JSON을 다운로드하세요.
이미지 편집
최대 2K 해상도에서 높은 구조적 정확도로 입력 이미지를 편집하세요.클라우드에서 이미지 편집 실행
Comfy Cloud에서 이미지 편집 워크플로를 즉시 시험해 보세요.
이미지 편집 워크플로 다운로드
워크플로 JSON을 다운로드하세요.
샘플 입력 이미지 다운로드
이 워크플로의 예제 입력 이미지를 받아보세요.