"결론부터: 진짜 같은 사진의 8할은 '무엇을 빼라'고 적는 데서 갈렸어요. 카메라를 더한 건 그다음이고요."
왜 내 AI 사진은 늘 '광고 합성' 같을까
ChatGPT한테 "경복궁 야간 사진"이라고만 던지면 결과는 늘 비슷해요. 너무 선명하고, 하늘은 새파랗고, 어딘가 광고 브로슈어 같은 느낌. 분명 잘 만들었는데 "진짜 사진"으로는 안 보입니다.
그래서 한 가지 실험을 했어요. 같은 장면을 두 번 생성합니다. 한 번은 그냥 한 줄로, 한 번은 "카메라와 필름"을 프롬프트에 끼워서. 무엇이 달라지는지, 그리고 무엇이 끝까지 안 통하는지를 정직하게 기록해봤습니다.
테스트 도구: ChatGPT(GPT-4o 이미지 생성, Pro 플랜) / 테스트 날짜: 2026년 6월 30일 / 같은 날 같은 계정에서 연속 생성.
이 글의 레이어 구조는 로그 Logue(@AlexZio00)님의 "SOVEREIGN LENS" 사진 프롬프트 프레임워크에서 가져와 제 식대로 줄여 쓴 거예요. (원문 출처는 글 끝에 링크)
―――――――――――――――――――
테스트 1: 경복궁 야간
그냥 요청했을 때
경복궁 야간 풍경 사진. 근정전과 마당이 보이는 밤. 딱 이 한 줄로 생성했어요.

결과는 깔끔합니다. 너무 깔끔해서 문제예요. 돌바닥 하나하나가 비현실적으로 또렷하고, 하늘은 짙은 코발트, 전체가 HDR을 잔뜩 먹인 여행 엽서 같아요. "가짜 티"의 정체가 바로 이 과한 선명함과 완벽한 대비입니다.
카메라를 더했을 때
같은 장면에 세 덩어리를 붙였어요. ① 배제 목록(CGI, 과한 HDR, 과포화, 플라스틱 질감, 인위적 대칭 금지) ② 카메라/필름(35mm 필름, 강한 그레인, 부드러운 콘트라스트, 은은한 할레이션, 살짝 바랜 하이라이트) ③ 장면 조건(따뜻한 야간 조명, 인파 거의 없음).

확실히 달라졌습니다. 하늘이 자연스럽게 어두워지고, 색이 따뜻하게 가라앉고, 미세한 그레인이 끼면서 "필름으로 찍은 밤" 분위기가 났어요. 같은 건물인데 한쪽은 렌더링, 한쪽은 사진처럼 보입니다.
실사용 후기 레이어를 하나씩 떼서 검증하진 못했어요. 다만 한 줄짜리 처음 결과에 없던 게 바로 이 "하지 마" 목록이라, 체감상 여기가 가장 크게 작용한 것 같아요. 카메라 설정보다 배제 문장이 먼저 보였습니다.
그런데 이 결과도 완벽하진 않았어요
어두워진 대가가 있었습니다. 처마 밑 공포(나무 구조물)가 뭉개져서 실제 단청 구조랑 좀 달라요. 배경 산과 담장도 더 흐릿해졌고요. 그레인이 이 약점을 가려주긴 하는데, 자세히 보면 "정확한 건축"은 아닙니다.
그래서 제 판단은 이래요. 밝고 정보가 또렷해야 하는 용도라면 오히려 처음 결과가 낫습니다. 분위기가 목적일 때만 카메라 레이어가 이겨요. 무조건 좋아지는 게 아니라 트레이드오프였습니다.
―――――――――――――――――――
테스트 2: 카페 커피 (피사체를 바꿔도 통할까)
풍경에서만 되는 건지 확인하려고, 전혀 다른 피사체로 한 번 더 했어요.
그냥 요청했을 때
카페 나무 테이블 위에 놓인 따뜻한 커피 한 잔 사진.

전형적인 스톡 사진이 나옵니다. 얕은 심도, 유리병에 꽂은 식물, 완벽한 라테아트. 예쁜데 어디서 백 번 본 광고컷이에요.
카메라를 더했을 때
이번엔 카메라 레이어에 "Canon 35mm 느낌, 자연스러운 보케, 생활감 있는 배경, 창가 자연광"을 넣고, "지나치게 완벽하지 않게"를 강조했어요.

결과가 흥미롭습니다. AI가 알아서 신문, 의자 모서리, 창문으로 들어오는 빛을 더했어요. 라테아트도 살짝 흐트러졌고요. "광고컷"에서 "누가 카페에서 폰으로 찍은 한 장"으로 내려왔습니다. 의도한 생활감이 정확히 나왔어요.
여기서도 한계는 분명했어요
신문 위 글자는 완전히 뭉개져서 읽을 수 없어요. AI 이미지의 고질병인 텍스트 깨짐이 그대로 나왔습니다. 만약 신문 헤드라인이 보여야 하는 사진이었다면 이 컷은 못 씁니다.
실사용 후기 그래서 저는 글자가 중요한 장면이면 아예 텍스트가 안 보이게 구도를 잡아달라고 다시 시켜요. 깨진 글자 하나가 사진 전체의 진짜 같음을 깨뜨리거든요.
―――――――――――――――――――
두 번 해보고 내가 내린 결론
- "진짜처럼"의 핵심은 더하기보다 빼기 쪽이었어요. CGI, HDR, 과포화를 금지하는 배제 목록이 가짜 티를 잡는 데 가장 크게 작용한 걸로 보입니다. (레이어를 하나씩 분리해 검증한 건 아니고, 두 결과를 비교한 체감이에요.) 카메라/필름 설정은 그 위에 질감을 입히는 2단계고요.
- 카메라 레이어가 항상 우월하진 않습니다. 어두워지고 디테일이 묻히는 대가가 있어요. 밝고 또렷해야 하면 처음 결과, 분위기가 목적이면 레이어 적용본.
- 글자와 정밀 구조는 여전히 못 넘습니다. 신문 글자, 단청 공포 같은 정밀한 부분은 레이어로도 안 고쳐져요. 이건 프롬프트가 아니라 구도로 피하는 게 답이었습니다.
복제 가능한 "프롬프트 공식"을 기대했다면 조금 실망스러울 수 있어요. 하지만 두 번 직접 돌려보니, 진짜 노하우는 공식이 아니라 무엇을 빼고 어떤 컷을 포기하느냐는 판단에 있었습니다.
함께 읽으면 좋은 글: ChatGPT 이미지 생성, 무엇을 그릴지 못 박는 법 / Gemini로 콘텐츠 소재 기획하기
외부 참고: 로그 Logue(@AlexZio00) — SOVEREIGN LENS 사진 프롬프트 프레임워크 — 이 글 레이어 구조의 원본 출처
※ 본 글의 이미지는 ChatGPT(GPT-4o)로 직접 생성·캡처했고, 레이어 프롬프트는 위 출처를 재구성한 것입니다. 사실관계는 운영자가 검증했습니다.