썸네일 제작 시간 30초로 줄이는 프롬프트

30초 썸네일 제작 아트

작성자

카테고리:

유튜브 썸네일 이미지 텍스트 프롬프트를 그대로 복붙해 봤자 나오는 건 깨진 한글뿐이다. AI 한테 “신박한 썸네일 만들어줘”라고 시키면, 화려한 배경은 그려주는데 정작 중요한 제목은 주사위 눈금처럼 알 수 없는 기호로 나온다. 그래서 사람들은 포토샵을 켜고 글자를 따로 올린다. 나도 그랬다. 한 달에 100개가 넘는 썸네일을 만들다 보니, 이 ‘깨진 한글’ 문제가 얼마나 짜증나는지 몸소 체험했다. 결론부터 말하자면, 이미지와 텍스트를 한 번에 뚝딱 만드는 마법의 주문은 없다. 있는 건 AI가 그린 배경 위에 텍스트를 얹어주는 합성 작업 뿐이다.

이미지와 텍스트가 한 번에 나오는 ‘완벽한 프롬프트’는 없다

DALL-E 3든 미드저니든, 현재 생성형 AI는 한글 텍스트 처리에 약점이 있다. 모델의 학습 데이터 특성상, 라틴 문자(영어)는 토큰화가 잘 되지만 한글은 복잡한 결합 구조 때문에 종종 ‘주사위 현상’이라 불리는 문자 깨짐이 발생한다. 내가 처음 자동화 공장을 구축할 때, 프롬프트 엔지니어링으로 이걸 뚫어보려고 며칠을 날렸다. “굵은 고딕체로 ‘돈 버는 법’이라고 정확히 써줘”라고 지시해도 결과는 ‘ㄷ ㅐ ㄴ’ 같은 엉뚱한 글자들이다.

검색 의도와 다른 이런 결과물은 시간 낭비다. AI에게 글씨까지 쓰라고 억지로 시키는 건 AI의 강점인 ‘시각적 연출’을 약화시킨다. 그래서 전략을 바꿨다. 이미지 생성과 텍스트 배치를 완전히 분리한 것이다. AI한테는 “그래픽 요소만 그려라”라고 시키고, 텍스트는 툴이나 내가 직접 올리는 식이다. 이렇게 접근하니 퀄리티가 확 올라갔다. 더 이상 깨진 글자 때문에 이미지를 다시 생성할 필요가 없어졌다.

AI 이미지 생성의 한글 오류는 기술적 한계가 아니라, 모델의 학습 영역 밖 문제다. 이를 인정하고 작업 공정을 나누는 것이 정답이다.

조회수를 높이는 색상과 구도, 30초 만에 잡는 법

텍스트를 따로 떼어내고 나면, AI는 오로지 클릭을 부르는 배경 그리기에만 집중할 수 있다. 실제 내가 운영하는 10여 개 SaaS 채널의 A/B 테스트 데이터를 보면, 특정 색상 조합에서 CTR(클릭률)이 확연히 높아진다. 빨간색과 노란색, 혹은 고대비의 보라색과 시안(Cyan) 조합이 눈에 띄었다. 프롬프트에 이 색상 팔레트를 강제로 넣어야 한다.

“Neon yellow and deep violet background, high contrast, cinematic lighting, 8k resolution, realistic photography style –ar 16:9”

시선을 집중시키는 구도도 중요하다. 인물 사진을 쓸 때는 얼굴이 화면의 1/3 이상을 차지하게 하고, 시선은 카메라 또는 텍스트가 들어갈 공간을 향하게 해야 한다. AI한테 “Close-up shot of a focused developer, looking at the right side, dramatic lighting”이라고 명확히 지정하면, 텍스트가 들어갈 ‘여백’을 자연스럽게 만들어준다. 이렇게 구도까지 잡힌 이미지를 받으면, 텍스트 올리는 건 1분도 안 걸린다.

조회수 높은 썸네일의 비결은 화려한 효과가 아니라, 시선이 분산되지 않는 구도와 명확한 색상 대비다.

한글 텍스트가 깨지지 않게 예쁘게 나오는 핵심 옵션

이제 텍스트 문제다. AI가 그린 텍스트는 쓰지 말자고 했다. 그럼 대안은 뭘까? 바로 텍스트를 이미지가 아닌 ‘오버레이(overlay)’ 요소로 취급하는 것이다. 내가 쓰는 자동화 루틴에서는 AI가 배경만 그려주고, 텍스트는 별도의 레이어로 처리한다. 이게 핵심이다. 프롬프트에 “Keep the center empty for text”라고 넣어두면 AI가 가운데를 비워준다. 거기에 우리는 한글 텍스트를 얹는다.

폰트 스타일과 그림자 효과도 중요하다. 텍스트에 그림자(Shadow)나 테두리(Stroke)를 주면 배경과 분리되어 가독성이 폭발한다. 포토샵이나 캔바 같은 툴을 쓰지 않고 이걸 자동화하려면, 텍스트 합성 기능이 있는 API를 써야 한다. 나는 배경 이미지 위에 텍스트 레이어를 덮어씌우는 방식으로 코드를 짰다. 이렇게 하니 ‘글자 깨짐 해결’이라는 골칫거리가 사라졌다.

텍스트 합성은 이미지 생성의 결과물과 분리되었을 때 가장 깔끔하고 빠르게 처리된다.

썸네일 제작 자동화 루틴

실제 제작 시간 30초로 단축하는 자동화 루틴

손으로 하나하나 하면 20분은 걸릴 작업을 30초로 줄이는 방법은 무엇일까? 비결은 브랜드 키워드 하나 입력만으로 4가지 버전이 뽑히게 만드는 워크플로우다. 나는 OneClip Omni Studio를 개발하면서 이 루틴을 테스트했다. 브랜드명만 입력하면, 시스템이 미리 정의한 4가지 색상 테마와 프롬프트 조합을 백그라운드에서 돌린다.

수동 작업은 20분이다. 프롬프트를 여러 번 쳐보고, 이미지를 고르고, 텍스트를 배치하고, 크기를 조절하고… 이 과정이 멘탈을 갉아먹는다. 하지만 자동화 루틴을 거치면 내가 하는 건 브랜드명 타이핑 한 번과, 생성된 4개 중 제일 마음에 드는 것 하나 고르는 것뿐이다. 시간 단축 메트릭은 명확했다. 하루 종일 걸리던 썸네일 작업이 아침 커피 마시는 시간에 끝났다.

  • 브랜드 키워드 입력
  • 4가지 썸네일 후보지 자동 생성 (이미지+한글 텍스트 합성 완료 상태)
  • 최종본 선택 및 업로드

이 흐름이 고정되면 썸네일은 더 이상 작업이 아니라 선택의 문제가 된다.

요약: 브랜드만 넣고 30초 만에 완성하는 방법

1인 빌더로서 하루에 10개 이상의 썸네일을 소화하려면 시간이 돈이다. 이 방법의 핵심은 AI한테 모든 걸 시키지 않는다는 데 있다. AI는 그림만, 텍스트는 별도 시스템이 처리하게 분리해야 한다. 지금 당장 써먹을 수 있는 3단계는 간단하다.

  1. AI 프롬프트에는 텍스트 공간을 확보하는 구도와 색상만 지정한다.
  2. 생성된 이미지 위에 한글 텍스트를 오버레이하는 방식을 쓴다.
  3. 이 과정을 브랜드 키워드 하나로 실행하는 자동화 툴을 연결한다.

더 이상 썸네일에 시간을 쓰지 않으려면, ‘완벽한 한 번의 생성’을 포기해야 한다. 대신 ‘빠르고 확실한 합성’을 택하라. 그게 30초 만에 썸네일 공장을 돌리는 길이다.


AILEEGO TOOLKIT

이 글의 내용을 도구로 바로 쓰고 싶다면

브랜드명만 넣으면 AI가 이미지·영상 프롬프트·광고 카피 4안을 30초에 만들어 주는 영상 제안 스튜디오 — 제가 직접 만들어 운영 중인 OneClip Omni Studio에서 바로 해볼 수 있습니다.

이 블로그의 글도 매일 아침 AI 파이프라인이 자동 발행합니다. 어떻게 만들었는지 궁금하다면 포트폴리오를 구경해 보세요.

자주 묻는 질문

AI 썸네일에 한글 텍스트가 깨져서 나오는 이유는 뭔가요?

현재 생성형 AI 모델은 한글의 복잡한 결합 구조를 학습 데이터에서 완벽히 다루지 못해, 텍스트를 기호나 주사위처럼 깨져서 표현하는 경우가 많습니다. 그래서 ‘한글 쓰기’보다는 이미지 생성과 텍스트 배치 작업을 분리하는 것이 훨씬 효율적입니다.

썸네일 클릭률(CTR)을 높이는 색상과 구도는 무엇인가요?

빨간색과 노란색, 혹은 보라색과 시안(Cyan) 같은 고대비 색상 조합이 시선을 잘 끕니다. 인물 사진을 쓸 때는 얼굴이 화면의 1/3 이상을 차지하게 하고 시선을 텍스트가 들어갈 여백을 향하게 구도를 잡으면 가독성이 좋아집니다.

이미지 위에 한글 텍스트를 깨짐 없이 넣는 방법은?

AI에게는 배경 그래픽만 그리도록 하고 프롬프트에 가운데를 비워달라고 요청한 뒤, 별도의 툴이나 레이어 합성 기능으로 텍스트를 덮어씌워야 합니다. 텍스트에 그림자나 테두리를 넣으면 배경과 분리되어 훨씬 잘 보입니다.

썸네일 제작 시간을 30초로 줄이는 자동화 루틴은?

브랜드 키워드 하나만 입력하면 미리 정의된 색상 테마와 프롬프트 조합을 통해 4가지 버전의 썸네일 후보지가 자동 생성되는 워크플로우를 만들어야 합니다. 이렇게 하면 반복적인 프롬프트 입력과 수정 과정 없이 결과물 중 하나만 고르면 되어 작업 시간이 획기적으로 줄어듭니다.

AI 한테 썸네일 텍스트까지 다 그리라고 시키면 안 되나요?

AI에게 글씨까지 쓰라고 억지로 시키면 모델의 강점인 ‘시각적 연출’ 능력이 떨어지고, 깨진 글자 때문에 이미지를 다시 생성해야 하는 시간 낭비가 생깁니다. 결론적으로 텍스트는 AI가 아닌 별도의 과정에서 처리하는 것이 퀄리티와 속도 면에서 훨씬 유리합니다.