희일용최영우

gpt-image-1 outpaint 시 원본 복제 아티팩트 & 경계 접선 불일치 — 해결 방법이 있을까요?

· 2026-08-03 (월) 15:45:14 · 250 · 2

안녕하세요. 도움이 필요해서 이렇게 올리게 되었습니다 ㅠㅠ
현재 저는 광고회사 개발자로 광고 배너 자동 리사이징 파이프라인을 개발 중입니다.
원본 PSD/PNG/JPG (1200×628)를 여러 광고 규격으로 자동 변환하는데, gpt-image-1의 images.edit API를 활용해 빈 영역을 AI로 채우고 있습니다. 

 

현재 문제점은 아래와 같습니다.

문제1 - 원본 경계에서 접선 방향 불일치.
문제2 - 세이프존 모드에서 원본 요소 복제. 

 

혼자서 방향을 달리 해서 계속 시도 해보고 있는데.. 딱히 그렇다할 성과는 못 얻고 있는 상황입니다.
긴 글을 읽어 주셔서 감사드리고 한번씩 꼭 읽어봐주시길 부탁드립니다.

 

구현 방식 (TYPE D 파이프라인)

  • 원본을 축소해서 목표 캔버스 중앙에 배치. (비율 유지)
  • 빈 영역 마스크 생성 → 확장해야될 영역을 openai통해서 자연스럽게 배경 생성 하라고 지시.
  • 원본 복원 + feather alpha blend로 경계 자연스럽게 처리

1785739231_LNWOb6OTgQ.webp

🔴 문제 1 — 원본 경계에서 접선 방향 불일치

1200×628 → 1250×560 변환 시 좌우 각 89px 빈 영역이 발생합니다.
원본 이미지의 좌측 경계에는 흰색 새틴 천이 있고, AI가 그 곡선을 자연스럽게 이어야 합니다.
하지만 AI가 경계에서 천의 접선 방향(주름 흐름)을 제대로 추론하지 못하고 어색하게 이어집니다.

* 원본 좌측에 단일 배경이 아닌 흰색 천이 있는 사진입니다!

 

시도한 것들

  • 마스크를 원본 안쪽 40px까지 확장 → AI가 경계 픽셀을 더 많이 볼 수 있도록
  • 좌측 먼저 생성 후 우측 입력으로 사용하는 sequential 처리
  • v1~v10 프롬프트 반복 튜닝 ("satin fabric", "tangent lines", "natural arc" 등)
  • 80px, 120px으로 확장 늘려보기 → 경계가 넓어질수록 우측 텍스트 영역 침범

→ 40px 확장 + feather blend가 현재 가장 나은 결과이지만, 접선 방향 일치는 여전히 불완전합니다.

 

 

 

🔴 문제 2 — 세이프존 모드에서 원본 요소 복제

세이프존 규격에서는 원본이 64%로 축소되어 좌우 각 240px, 상하 ~80px의 빈 영역이 생깁니다.
배경만 채워야 하는데, AI가 원본의 얼굴·제품·한국어 텍스트를 그대로 복제합니다.

 

시도한 것들

  • 프롬프트에 "do not duplicate, mirror, or recreate any element from the center" 추가
  • "ABSOLUTE PROHIBITIONS" 섹션으로 금지 항목 명시 강화
  • 마스크 안쪽 확장 비활성화 (원본 경계 침범 차단)

→ 개선되었지만 여전히 부분 복제가 발생합니다. 확장 영역이 240px로 넓어서 AI가 "큰 그림"을 새로 그리는 방식으로 동작하는 것 같습니다.

|

댓글 2개

이미지 생성 에서 추론이 약하다면, gpt-image2 를 쓰면 되지 않을까요?

비용 이외에 gpt-image1 을 꼭 써야 할 이유가 있나요?

만약 figma 로 이 작업을 쉽게 수행할수 있다면, figma mcp 를 연동후 skills 를 만들어 구현하는게 더 좋을수도 있습니다.

백엔드 서버에 figma mcp 서버 + codex desktop(또는 claude desktop) 을 설치후 queue 작업을 처리하는 기능을 추가하여 스케쥴 작업(1분에 한번 수행 등) 방식으로 만드는 방법이나, comfyui 로 워크플로우 생성 + n8n 워크 플로우(웹훅등) 연동 방법.

단순히 gpt image api 로 한번에 생성이 안되는건 여러 다른 방법을 시도 해보는게 좋을것 같습니다.
 https://fal.ai/dashboard 에 보면 image edit 기능을 제공하는 여러 모델이 있습니다. 여러 모델중에서 원하는 기능을 가장 효과적으로 수행하는 모델이 있는지 테스트 해보세요.

그외 여러 방법이 있을것 같은데, 원본 이미지 -> 생성 이미지 예제를 알수 없어서 이정도로만 답변 드립니다. 

ps) 추가로 광고 배너라면, 배너 이펙트 효과가 있다고 가정하면, 이를 구현하기 위해서는  figma mcp 나 after effect(혹은 포토샵) 의 모션 기능과 연동후 생성하는것도 고려해볼만합니다. 

100% 해결 방안을 제시해 드리진 못하지만
모든것은 AI로 해결하려고 하지 마시고
적절한 조화를 통해서 해결하면 오히려 답이 보일수도 있습니다.

AI가 담당할 영역과 기존과 같이 프로그래밍으로 해결할 영역을 적절히 잘 섞어서
의외로 괜찮은 결과가 나올때도 있더라구요!!
특히 이미지 및 3D 모델링 같은경우는 AI가 짜잔 하고 정확한 해결책을 제시하지 못하는 경우가 많더라구요!!
 
댓글을 작성하시려면 로그인이 필요합니다.

자유게시판

202,861건
+
제목 글쓴이 날짜 조회
08-04 조회 395
08-04 조회 398
08-04 조회 455
08-03 조회 365
08-03 조회 581
08-03 조회 251
08-03 조회 249
08-03 조회 329
08-02 조회 372
08-02 조회 320
08-02 조회 414
08-02 조회 421
08-01 조회 454
08-01 조회 332
08-01 조회 385
08-01 조회 268
08-01 조회 328
08-01 조회 404
07-31 조회 415
07-31 조회 360