이미지 프롬프트 쓰는 법: 피사체, 구도, 조명, 스타일, 비율
이미지 프롬프트는 AI 이미지 도구에 만들 그림의 피사체와 구도, 조명, 스타일, 비율을 설명하는 요청 문장입니다. 키워드를 나열하기보다 장면을 한 문장으로 묘사하고 원하지 않는 것은 원하는 모습으로 바꿔 적습니다.
같은 말:이미지 프롬프트이미지 프롬프트 작성법AI 그림 프롬프트이미지 생성 요청 문장네거티브 프롬프트
목차
🤔 "예쁜 카페 사진"이라고 적었더니 평범한 결과만 나올 때
AI 이미지 도구에 "예쁜 카페 사진"이라고 적으면 어디서 본 듯한 카페 내부가 나옵니다. 틀린 그림은 아닌데 쓸 곳이 마땅치 않습니다. 원하는 것은 창가 자리에 놓인 라테 한 잔을 위에서 내려다본 세로 사진이었는데, 그 정보가 문장에 없었으니 AI가 알아서 채운 것입니다.
AI 이미지 생성 뜻에서 본 것처럼 모델은 프롬프트의 뜻을 따라 잡음을 걷어 내며 그림을 만듭니다. 문장에 적지 않은 부분은 모델이 무작위로 정하므로, 결과를 원하는 쪽으로 끌어오려면 무엇을 적어야 하는지 알아야 합니다. 이 편에서는 도구와 상관없이 통하는 이미지 요청 문장의 뼈대를 정리합니다.
🔑 이미지 프롬프트의 정의
이미지 프롬프트는 AI 이미지 도구에 만들 그림의 피사체와 구도, 조명, 스타일, 비율을 설명하는 요청 문장입니다.
글을 쓰게 하는 프롬프트와 달리 이미지 프롬프트는 눈에 보이는 것을 설명해야 합니다. "따뜻한 느낌"처럼 막연한 말보다 "왼쪽 창에서 들어오는 아침 햇살"처럼 사진사가 알아들을 수 있는 말이 결과를 바꿉니다. 글쓰기 프롬프트 전반의 원리는 프롬프트 엔지니어링 기초에서 다뤘습니다.
📷 사진 촬영 의뢰서의 다섯 칸
사진 스튜디오에 촬영을 맡길 때 적는 의뢰서를 떠올리면 무엇을 적을지가 정리됩니다. 무엇을 찍을지, 어떤 각도로, 어떤 빛에서, 어떤 느낌으로, 어떤 크기로 받을지입니다.
| 요소 | 정하는 것 | 적는 예 |
|---|---|---|
| 피사체 | 누구 또는 무엇이 어디에 있는지 | 원목 테이블 위의 흰 라테 잔, 잔 옆에 크루아상 하나 |
| 구도 | 카메라의 거리와 각도 | 바로 위에서 내려다본 구도, 근접 촬영, 낮은 각도 |
| 조명 | 빛의 방향과 성질 | 왼쪽 창에서 들어오는 부드러운 아침 햇살 |
| 스타일 | 사진인지 그림인지, 색과 분위기 | 사실적인 제품 사진, 따뜻한 중간 톤, 차분한 분위기 |
| 비율 | 결과물의 가로세로 비율 | 세로 4:5, 세로 9:16, 가로 16:9 |
미드저니 공식 문서도 비슷한 목록을 둡니다. 주제, 형식(사진이나 회화 같은 표현 방식), 환경, 조명, 색, 분위기, 구도 일곱 가지를 적고, 그 가운데 지금 만들려는 이미지에 중요한 것만 골라 넣으라고 안내합니다. 이름은 조금 달라도 가리키는 칸은 같습니다.
🧱 다섯 칸을 한 문장으로 조립하는 순서
구글 제미나이 이미지 생성 문서는 사진처럼 사실적인 장면을 만들 때 쓰는 틀을 제시합니다. 2026년 9월 28일 문서 기준입니다.
A photorealistic [촬영 종류] of a [피사체] in a [장소].
[빛에 대한 설명]. Shot from a [카메라 각도] with a [렌즈 종류].앞의 카페 사진을 이 틀에 넣으면 이렇게 됩니다.
A photorealistic overhead shot of a white latte cup and one croissant
on a light oak table by a window in a small cafe.
Soft morning sunlight coming from the left window, warm neutral tones, calm mood.
Shot from directly above with a 50mm lens. Vertical 4:5.같은 내용을 한국어로 적는 것도 가능합니다. 제미나이 문서는 한국어를 좋은 결과가 나오는 언어 목록에 넣어 두었습니다. 다만 미드저니가 한국어 프롬프트를 영어만큼 잘 따르는지는 공식 문서에서 확인하지 못했고, 영상 모델 가운데 구글 Veo는 영어만 충분히 평가했다고 밝히고 있습니다. 도구를 처음 쓸 때는 같은 내용을 두 언어로 한 번씩 넣어 비교해 보는 편이 확실합니다.
틀을 쓸 때 기억할 점은 두 가지입니다. 제미나이 문서는 아주 구체적으로 적고, 무엇에 쓸 그림인지 맥락과 의도도 함께 알려 주라고 권합니다. 반대로 미드저니 문서는 짧고 분명한 프롬프트가 대체로 좋은 결과를 낸다며 긴 목록이나 자세한 지시문을 늘어놓지 말라고 적었습니다. 두 안내가 엇갈려 보이지만 공통점은 같습니다. 필요한 정보는 빠짐없이, 필요 없는 수식어는 빼고 적는 것입니다.
📐 비율을 먼저 정해야 하는 이유
비율은 나중에 잘라 내면 된다고 생각하기 쉬운데, 처음부터 정해 두는 편이 낫습니다. 가로 사진을 세로로 잘라 내면 피사체가 잘리거나 여백이 어색해지기 때문입니다. 흔히 쓰는 비율은 이렇습니다.
| 쓸 곳 | 흔히 쓰는 비율 |
|---|---|
| 인스타그램 피드 세로 게시물 | 4:5 |
| 쇼츠, 릴스, 스토리 같은 세로 영상 | 9:16 |
| 유튜브 썸네일, 가로 배너 | 16:9 |
| 프로필 사진, 정사각 피드 | 1:1 |
도구마다 지정하는 방법과 고를 수 있는 비율이 다릅니다. 2026년 9월 28일 각 공식 문서 기준입니다.
- 제미나이(나노바나나 2): 1:1, 4:5, 9:16, 16:9, 21:9를 포함해 14가지 비율을 고르고, 지정하지 않으면 입력 이미지와 같은 크기나 정사각형으로 만듭니다
- 미드저니: 문장 끝에
--ar 4:5처럼 적고, 기본값은 1:1이며 소수점은 넣지 못합니다 - OpenAI 이미지 API: 1024×1024, 1536×1024, 1024×1536을 권장 크기로 두고 그 밖의 크기는 조건 안에서 지정합니다
🚫 빼고 싶은 것은 원하는 모습으로 바꿔 적기
"자동차 없이", "사람 빼고"처럼 금지하는 말을 적으면 오히려 그 대상이 그림에 들어오는 경우가 있습니다. 모델이 문장에 나온 단어를 그림의 재료로 받아들이기 때문입니다.
제미나이 문서는 이를 의미적 네거티브 프롬프트라고 부르며, '차 없음'이라고 쓰는 대신 원하는 장면을 긍정적으로 묘사하라고 권합니다. "자동차 없는 거리" 대신 "차량 통행이 없는 이른 아침의 한적한 보행자 거리"라고 적는 식입니다. 미드저니 문서도 원하지 않는 것보다 원하는 것을 적으라고 안내하고, 꼭 빼야 할 요소는 --no 파라미터에 따로 적게 합니다.
🔁 결과를 고칠 때는 한 번에 한 가지씩
첫 결과가 마음에 들지 않을 때 문장을 통째로 새로 쓰면 앞에서 잘 나온 부분까지 달라집니다. 조명만 어두우면 조명 문장만, 구도만 아쉬우면 구도 문장만 바꿔 다시 요청합니다. 무엇을 바꿔서 결과가 달라졌는지 알아야 다음 요청을 정할 수 있습니다.
제미나이 문서는 이미지를 고쳐 나갈 때 대화를 이어 가는 방식을 권장합니다. 앞 결과를 둔 채로 "배경의 창문만 더 밝게"처럼 이어서 말하면 나머지는 유지하면서 한 부분만 바꿉니다. 미드저니는 실행한 뒤에도 입력창에 문장이 남아 있어서 단어 하나만 고쳐 다시 보낼 수 있습니다.
🔤 그림 속에 글자를 넣을 때
간판, 포스터, 카드처럼 글자가 들어가는 그림은 따로 신경 써야 합니다. 도구마다 글자에 관한 안내가 조금씩 다릅니다.
- 글자는 따옴표로 감싸 정확히 적습니다: 제미나이 문서는 들어갈 글자와 글꼴 느낌, 전체 디자인을 분명히 적으라고 권하고, 글자를 먼저 정한 뒤 그 글자가 들어간 이미지를 요청하는 편이 낫다고 설명합니다
- 짧게 넣습니다: 미드저니 문서는 글자 생성이 영어 같은 라틴 문자에서 가장 잘 되고 짧은 단어나 구절일수록 성공 가능성이 높다고 적었습니다
- 결과를 한 글자씩 확인합니다: OpenAI 문서도 글자의 정확한 위치와 선명도를 한계로 꼽습니다. 한글처럼 획이 많은 글자는 틀리기 쉬워서, 꼭 필요한 글자는 결과물 위에 편집 프로그램으로 얹는 편이 안전합니다
⚠️ 이미지 프롬프트를 쓸 때 자주 하는 실수
- 분위기 형용사만 늘어놓습니다: "감성적이고 고급스럽고 세련된"은 모델마다 다르게 해석합니다. 빛과 색과 재질처럼 눈에 보이는 말로 바꿉니다
- 실존 인물이나 브랜드 이름을 넣습니다: 초상권과 상표 문제가 생길 수 있고 도구의 정책으로 거절되기도 합니다. 상업 사용 조건은 저작권과 광고 표시 편에서 다룹니다
- 한 번에 여러 곳을 고치라고 합니다: 무엇 때문에 결과가 달라졌는지 알 수 없게 됩니다
- 비율을 적지 않습니다: 정사각형으로 나온 그림을 세로로 잘라 쓰다 보면 피사체가 잘립니다
❓ 자주 묻는 질문
프롬프트는 길게 쓸수록 좋은가요?
길이보다 빠진 칸이 없는지가 중요합니다. 피사체, 구도, 조명, 스타일, 비율 가운데 결과에 중요한 칸이 비어 있으면 모델이 무작위로 채웁니다. 반대로 같은 뜻의 수식어를 여러 번 반복하면 결과가 어수선해질 수 있어서, 칸마다 한두 개의 구체적인 말로 채우는 편이 낫습니다.
영어로 써야 결과가 좋은가요?
도구마다 다릅니다. 구글 제미나이 이미지 문서는 한국어를 좋은 결과가 나오는 언어로 올려 두었고, 영상 모델인 Veo 문서는 영어 외 언어는 평가하지 않았다고 적고 있습니다. 같은 내용을 두 언어로 넣어 비교해 보고 결과가 나은 쪽을 쓰면 됩니다.
남이 쓴 프롬프트를 그대로 쓰면 같은 그림이 나오나요?
비슷한 방향의 그림은 나오지만 똑같지는 않습니다. 출발점이 되는 잡음이 매번 달라지고 모델 버전도 바뀌기 때문입니다. 남의 프롬프트는 어떤 칸을 어떻게 채웠는지 참고하는 용도로 보고, 내 피사체와 용도에 맞게 칸을 바꿔 쓰는 편이 쓸모가 있습니다.
📋 3줄 요약
-
이미지 프롬프트는 만들 그림의 피사체와 구도, 조명, 스타일, 비율을 설명하는 요청 문장이고 키워드 나열보다 장면을 한 문장으로 묘사할 때 결과가 안정적입니다.
-
구글 제미나이 문서는 촬영 종류와 피사체, 장소, 빛, 카메라 각도와 렌즈를 순서대로 적는 틀을 제시하고 빼고 싶은 요소는 금지어 대신 원하는 모습으로 바꿔 적으라고 권합니다.
-
결과를 고칠 때는 한 번에 한 가지 요소만 바꿔 다시 요청하고 그림 속 글자는 도구마다 한계가 있으므로 짧게 따옴표로 지정한 뒤 한 글자씩 확인합니다.
📚 참고 자료
- 구글 Gemini API 문서, Image generation: https://ai.google.dev/gemini-api/docs/image-generation
- Midjourney Docs, Prompt Basics: https://docs.midjourney.com/hc/en-us/articles/32023408776205-Prompt-Basics
- Midjourney Docs, Text Generation: https://docs.midjourney.com/hc/en-us/articles/32502277092109-Text-Generation
- OpenAI, Image generation guide: https://developers.openai.com/api/docs/guides/image-generation
- 구글 Gemini API 문서, Veo: https://ai.google.dev/gemini-api/docs/veo

제대로 이해했는지 한 문제로 확인해 볼까요?
답을 고르면 바로 풀이가 나와요.
거리 사진에서 자동차가 나오지 않게 하고 싶습니다. 구글 제미나이 이미지 생성 문서의 권장에 가장 가까운 요청은 무엇일까요?

