30. Image generation 이미지 생성
ChatGPT에게 이미지를 생성하거나 편집하도록 요청하는 기능입니다. UI 에셋, 배너, 배경, 일러스트, 스프라이트 시트, 플레이스홀더처럼 코드 작업과 나란히 필요한 이미지를 만드는 데 씁니다. 모델은 gpt-image-2입니다.
이 페이지에서 배우는 것
- 효과적인 이미지 프롬프트의 5가지 구성 요소
- 기존 이미지를 편집할 때 "바뀔 것"과 "유지할 것"을 나누는 법
- 참조 이미지를 여러 장 쓰는 방법
- 이미지 안에 텍스트를 정확히 넣는 방법
- 이미지 생성이 사용량 한도를 3~5배 빠르게 소모한다는 점
- 대량 생성 시 API 경유로 전환하는 방법
gpt-image-2를 사용하며 일반 Codex 사용량 한도에 포함됩니다. 게다가 이미지 품질과 크기에 따라 이미지 생성이 없는 유사한 턴 대비 평균 3~5배 빠르게 한도를 소모합니다.
좋은 프롬프트의 구성 요소
공식 문서는 효과적인 프롬프트가 보통 1~3문장이라고 안내합니다. 길게 쓰기보다 아래 요소를 빠짐없이 담는 것이 중요합니다.
- 목적과 대상 독자 — 이 이미지가 어디에 쓰이고 누가 보는지
- 주요 피사체와 동작 — 무엇이, 무엇을 하고 있는지
- 배경 · 구도 · 시각 스타일
- 구체적 디테일 — 프레이밍, 조명, 색상, 재질
- 제약 조건 — 등장하면 안 되는 요소
예시 — 새로 생성
기존 이미지 편집하기
편집에서 가장 중요한 원칙은 바꿀 것과 그대로 둘 것을 모두 명시하는 것입니다. 한 번에 한 요소씩 수정하고 필요하면 이미지의 특정 영역을 선택해 그 부분을 어떻게 바꿀지 설명할 수도 있습니다.
참조 이미지 여러 장 쓰기
한 이미지가 내용을 정의하고 다른 이미지가 스타일 · 레이아웃을 정의할 때 유용합니다. 각 이미지를 순서로 식별하고 서로 어떤 관계인지 설명하세요.
이미지 안에 텍스트 넣기
텍스트는 짧게, 정확하게 지정합니다. 정확한 문구를 따옴표로 감싸고 원하는 대소문자를 그대로 유지하며 폰트 스타일 · 크기 · 색상 · 위치를 함께 설명합니다.
인포그래픽과 밀도 높은 레이아웃
설명 자료, 포스터, 레이블이 붙은 다이어그램, 타임라인 같은 정보 밀도가 높은 시각물의 초안을 잡는 데도 쓸 수 있습니다. 정보 위계와 레이아웃을 설명하고 레이블은 간결하게 유지하며 선명한 텍스트 렌더링을 요청하세요.
표면별 호출 방법
| 표면 | 호출 방법 | 참조 이미지 첨부 |
|---|---|---|
| 데스크톱 앱 | 이미지 생성·편집을 요청 | 컴포저에서 추가 |
| ChatGPT 웹 | 대화에서 이미지 요청 | 이미지 첨부로 결과 가이드 |
| Codex CLI | 대화형 세션에서 설명하거나 $imagegen으로 스킬을 명시적으로 호출 | -i 또는 --image |
| Chrome 확장 | 확장 채팅에서 이미지 요청 | Shift를 누른 채 드래그 |
공식 문서는 IDE 확장을 언급하지 않습니다.
⚠️ 지켜야 할 것
- 초상권 — 실존 인물을 묘사할 때는 적절한 경우 참조 사진을 제공하고 그 사람의 초상을 쓸 권한이 있는지 확인하세요.
- 저작권 · 브랜드 — 특정 브랜드 · 제품 · 아티스트 · 작품을 모방하는 대신 일반적이거나 독창적인 디자인을 요청하세요.
- 정책 준수 — 소속 조직의 가이드라인과 OpenAI 사용 정책에 맞게 이미지를 사용하세요.
- 대량 생성 — 환경변수에
OPENAI_API_KEY를 설정하고 API로 생성하도록 요청하면 API 요금 체계가 적용됩니다. - 웹 가용성 — ChatGPT 웹의 이미지 가용성과 사용량 한도는 플랜과 워크스페이스 설정에 따라 달라집니다.
- 공식 문서는 종횡비 · 해상도 · 출력 파일 포맷을 명시하지 않습니다.
공식 출처
-
Image generation
learn.chatgpt.com