OpenAI, ChatGPT Images 2.5 발표로 이미지 생성 지연시간 최대 50% 단축

OpenAI는 최근 자사의 최신 이미지 모델인 ChatGPT Images 2.5를 발표하며, 동시에 두 가지 보조 모델을 API에 추가했습니다. OpenAI에 따르면, 현재 ChatGPT Images 및 GPT-Image API 모델을 통해 매주 30억 개 이상의 이미지가 생성되고 있습니다.

핵심 기술 사양 및 성능 분석

ChatGPT Images 2.5는 이전 버전에 비해 이미지 생성 능력과 효율성에서 개선을 보였습니다.

  • 이미지 생성 지연 시간: Images 2.0 대비 최대 50% 단축.
  • 이미지 품질: 보다 자연스러운 조명, 풍부한 질감을 구현하며, 사용자 참조 사진의 피사체를 더 잘 보존.
  • 편집 정확도: 대화의 여러 단계에 걸쳐 편집 지침을 더 안정적으로 추적하며, 복잡한 배경에서도 요청된 요소만 변경하고 나머지 이미지는 유지.
  • 복잡한 레이아웃 처리: 투명 배경을 포함한 복잡한 레이아웃 및 실제 세계 정보 렌더링 정확도 향상.
  • API 모델 ‘GPT-Image-2.5 Flare’: GPT-Image-2 대비 50% 낮은 지연 시간으로 고품질 이미지 제공.

산업 파급 효과

이번 업데이트는 AI 기반 이미지 생성 시장에 직접적인 영향을 미칠 것으로 분석됩니다. 개발자를 위한 ‘Sketch’ 기능 도입은 사용자가 ChatGPT 내에서 직접 스케치하여 시각적 참조를 제공할 수 있게 함으로써, 이미지 생성 프로세스의 직관성을 높였습니다. 또한, 전단지, 제품 사진 등 일반적인 형식의 시작점을 제공하는 새로운 템플릿과 생성된 이미지에 직접 주석을 달아 편집하는 기능은 사용자들의 콘텐츠 제작 효율성을 증대시킬 것입니다. API를 통한 ‘GPT-Image-2.5 Flare’ 모델은 크리에이터 콘텐츠, 소셜 미디어, 제품 경험 및 시각 검색 등 다양한 애플리케이션에서 고품질 이미지를 더 빠르게 생성할 수 있게 하여, 산업 전반의 워크플로우를 최적화하고 비용 절감에 기여할 것으로 예상됩니다. 이는 브랜드 처리 및 구성 요소를 유지한 채 특정 요소만 업데이트하는 등 참조 기반 워크플로우의 신뢰성을 향상시키는 데 기여합니다.