프롬프트

AI 이미지는 왜 개수를 틀릴까, 그리고 제대로 나오는 군중을 요청하는 법

정확히 세 개를 요청했는데 다섯 개가 나옵니다. 이미지 모델이 개수를 못 세는 이유와, 원하는 군중, 줄, 세트를 얻는 다섯 가지 방법을 소개합니다.

3분 소요
어둠 속에 홀로 놓인 오래된 황동 주판, 알들이 고르지 않게 밀려 있고 몇 개는 보랏빛으로 은은하게 빛난다

"창턱 위의 양초 세 개"라고 썼는데 네 개가 나왔습니다. "정확히 세 개"로 바꾸니 두 개, 다음엔 다섯 개. 고장 난 게 아닙니다. 개수 세기는 이미지 모델이 구조적으로 서툰 일이고, 이유를 알면 맞서 싸우는 대신 비켜 갈 수 있습니다.

개수가 어긋나는 이유

이미지 모델은 사물을 하나씩 그린 다음 합계를 확인하지 않습니다. 캔버스 전체를 한꺼번에 다듬으며, 각 영역을 "이 단어들에 맞는 이미지가 보통 어떻게 생겼는가"로 끌어당깁니다. "세"라는 단어는 수십 개 단어 중 약한 한 번의 밀침일 뿐이고, 학습 이미지에서 "양초"라는 단어 옆에 몇 개인지 적혀 있는 경우는 거의 없었습니다.

하나나 둘 같은 작은 수는 흔한 패턴(한 명의 피사체, 한 쌍)이라 가장 쉽습니다. 그 이상은 모델이 산수가 아니라 질감과 리듬에 의존합니다. 창문 한 줄은 간격이 맞아 보여야 맞아 보이는 것이지, 일곱 개라서 맞아 보이는 게 아닙니다. 그래서 모델이 지킬 수 없는 숫자보다 "몇 개"가 더 잘 통합니다.

중요한 곳과 그렇지 않은 곳

장면을 두 종류로 나누세요. 군중, 숲, 과일 바구니에서는 아무도 세지 않으므로 두 개쯤 틀려도 보이지 않습니다. 제품 사진, 도표, 아이콘 세트, 보드게임에서는 보는 사람이 바로 세고, 틀린 숫자는 실수처럼 보입니다. 노력은 두 번째 종류에만 쓰세요.

원하는 개수를 얻는 다섯 가지 방법

1. 적게 요청하고 그룹에 이름을 붙이기

모델은 숫자만 덜렁 쓰는 것보다 "한 쌍"이나 "세 개 한 벌"을 더 잘 다룹니다. 산수가 아니라 하나의 개념이기 때문입니다. "높은 것, 중간 것, 낮은 것으로 이루어진 양초 세 개 한 벌"은 각각에 정체성을 주고, 정체성은 합계보다 유지하기 쉽습니다.

2. 각 항목을 위치로 설명하기

개수 대신 각 항목에 자리를 주세요. 모델은 왼쪽과 오른쪽, 앞과 뒤에 능하고, 문장이 이미 창턱의 왼쪽, 가운데, 오른쪽을 채웠다면 네 번째 양초를 더하기 어렵습니다.

프롬프트
해 질 녘의 창턱, 맨 왼쪽에 키 큰 흰 양초, 가운데에 낮은 호박색 양초, 오른쪽에 그을린 유리잔 속 중간 크기 양초, 뒤의 창문은 부드럽게 흐리게, 따뜻한 빛, 4:5 세로 구도
세 개의 항목, 세 개의 위치, 세 개의 설명. 숫자는 한 번도 나오지 않고, 개수는 훨씬 자주 지켜집니다.

3. 작게 생성하고 나중에 합치기

아이콘 다섯 개나 카드 여섯 장처럼 정확해야 하는 세트는, 조각마다 별도의 이미지로 생성한 뒤 자신의 편집기에서 배열하세요. 렌더링이 몇 번 더 들지만 하나하나가 피사체 하나짜리 작업이라 가장 싸게 성공시킬 수 있습니다. 초안은 Still Lite로, 렌더링당 €0.30부터 만들고, 고른 것만 Still로 마무리하세요.

4. 군중은 일부러 모호하게 두기

배경의 사람이나 사물은 숫자가 아니라 밀도로 설명하세요. "드문드문한 인파", "흩어져 있는", "어깨를 맞댄". 밀도는 질감이라 모델이 잘합니다. 숫자를 넣으면 눈에 띄게 틀릴 거리만 줄 뿐입니다.

5. 다시 뽑지 말고 나중에 고치기

하나가 더 많은 것만 빼면 이미지가 맞다면 주사위를 다시 굴리지 마세요. 그 렌더링을 참조 이미지로 첨부하고 같은 장면을 "네 번째 양초 없이" 요청하세요. 모델이 색감과 배치를 유지한 채 하나만 바꾸면 되므로, 새로 뽑는 것보다 훨씬 나은 선택입니다.

스튜디오가 할 수 없는 것

스튜디오의 어떤 도구도 정확한 개수를 약속할 수 없으며, 지금은 다른 이미지 생성기도 마찬가지입니다. 품질을 높이면 디테일이 선명해질 뿐 산수를 배우지는 않습니다. 페이지의 숫자가 엄격한 요구 사항이라면 별도의 이미지로 세트를 만들거나, 최종 레이아웃을 직접 그리고 렌더링은 분위기에만 쓰세요. 읽을 수 있는 글자도 비슷한 이유로 실패하며, 손과 글자 가이드에서 다룹니다.

빠른 루틴

  1. 누가 개수를 셀지 결정하세요. 아니라면 신경 쓰지 마세요.
  2. 센다면 항목을 위치로 설명하고 각각에 고유한 형용사를 붙이세요.
  3. 저렴한 초안을 소량 렌더링하고, 개수가 틀린 것은 한눈에 탈락시키세요.
  4. 아쉬운 실패는 처음부터 다시 하지 말고 참조 이미지에서 고치세요.
  5. 정확한 세트는 조각을 따로 생성해 직접 조립하세요.

이를 다시 뽑기 세금 글의 습관과 함께 쓰면 낭비되는 렌더링 대부분이 사라집니다. 개수 오류는 가장 비싼 다시 뽑기에 속하기 때문입니다. 각 모델의 현재 가격은 Generate를 누르기 전에 모델 페이지에서 볼 수 있습니다.

질문

AI는 왜 손가락이나 사물을 더 그릴까요?

모델은 이미지 전체를 한꺼번에 다듬으며 합계가 아니라 국소적인 패턴을 맞춥니다. 손가락, 창문, 양초는 반복되므로 영역이 가득 차 보일 때까지 반복하고, 정확한 개수는 추적하지 않습니다.

더 좋은 모델이면 개수 문제가 해결되나요?

하나에서 셋 정도의 작은 수와 결과의 깔끔함에는 도움이 됩니다. 그 이상을 안정적으로 세는 모델은 아직 없어서, 위치 지정과 직접 조립하는 방법은 계속 유효합니다.

다시 뽑는 것과 참조 이미지로 수정하는 것 중 어느 쪽이 더 저렴한가요?

하나의 사물만 빼고 이미지가 맞다면, 참조 이미지로 수정하는 쪽이 보통 더 저렴합니다. 좋은 부분을 모두 남기고 하나만 바꾸기 때문입니다. 다시 뽑으면 좋은 부분도 나쁜 부분과 함께 버려집니다.

#프롬프트#이미지