HowtoAI
ai-guide2026-09-19 5 min read

AI 이미지 판별을 파일 정보로 하려니 8,991장 중 38장만 표시가 남아 있었어요

🤖
HowtoAI 편집팀AI 전문 에디터

AI 기술을 누구나 쉽게 활용할 수 있도록 실전 가이드를 작성합니다. ChatGPT, Claude, AI 자동화, SEO 분야를 전문으로 다룹니다.

📅 2026-09-19⏱️ 5 min read🌐 how-toai.com
목차 보기

AI가 만든 그림인지 확인하는 방법을 찾아보면 파일 정보를 열어 보라는 조언이 자주 나와요. 콘텐츠 자격증명이라는 이름으로 생성 기록이 파일에 들어간다는 설명이죠.

정말 그렇게 되는지 직접 세어 봤어요. 결론부터 적을게요. 이미지 8,991장 중 생성 표시가 남아 있던 것은 38장, 0.42퍼센트였어요.

8,991장을 열어서 무엇을 봤나

제가 관리하는 블로그 아홉 곳의 이미지 폴더를 전부 훑었어요. 화면에 보이는 그림이 아니라 파일 내부 구조를 직접 읽었어요. 형식마다 정보가 들어가는 자리가 다르기 때문에 세 갈래로 나눠 확인했어요.

  • PNG: 텍스트 영역과 촬영정보 영역, 그리고 콘텐츠 자격증명 전용 영역
  • JPEG: 촬영정보 구간, 설명 구간, 자격증명 구간
  • WebP: 파일 안의 정보 묶음 목록

결과는 이렇게 나왔어요.

형식장수생성 표시 있음아무 정보 없음
WebP8,40708,407
PNG58138537
JPEG303
합계8,991388,947

PNG 581장 중 6장에는 자격증명이 아니라 편집 프로그램이 남긴 설명 정보가 있었어요. 생성 표시로 셀 수 있는 것은 38장이에요.

38장에 무엇이 들어 있었나

38장의 전용 영역은 크기가 모두 똑같이 14,088바이트였어요. 같은 경로로 한 번에 만들어진 파일이라는 뜻이에요. 그 안을 열어 보니 서명된 기록이 들어 있었어요. 발견된 항목을 정리하면 이래요.

항목
만든 쪽 이름특정 AI 회사와 그 회사의 이미지 모델 이름
생성 기록 형식자격증명 표준의 동작 기록 구조
디지털 원본 유형학습된 알고리즘이 만든 매체
서명발급 기관 정보가 붙은 전자 서명
기록 생성 도구표준 구현 라이브러리와 그 버전

세 번째 줄이 핵심이에요. 디지털 원본 유형 항목은 언론 사진 분야의 표준 어휘집에 등록된 값을 쓰는데, 이 파일들에 적힌 값의 정의는 학습된 인공지능 모델을 사용해 알고리즘으로 만든 디지털 매체예요. 판별기가 추측한 결과가 아니라 만든 쪽이 스스로 적어 둔 신고라는 점이 중요해요.

즉 표시가 있을 때는 아주 강한 증거예요. 문제는 표시가 남아 있는 비율이에요.

웹용으로 저장된 8,407장에는 하나도 없었어요

여기서 한 가지가 눈에 걸려요. 표시가 남은 38장은 전부 PNG인데, 웹용 형식으로 저장된 파일에는 한 장도 표시가 없어요. WebP 8,407장 전부가 그래요.

변환이 원인인지 직접 확인했어요. 표시가 남아 있는 PNG 한 장을 열어 세 가지로 다시 저장하고, 다시 내부 구조를 읽었어요.

저장 방식파일 크기남아 있는 정보 영역
원본 PNG1,479,465바이트자격증명 영역 있음
WebP로 변환136,870바이트그림 데이터뿐
JPEG로 변환238,909바이트기본 헤더뿐
PNG로 그대로 재저장1,512,967바이트그림 데이터뿐

마지막 줄이 놀라운 자리예요. 형식을 바꾸지 않고 같은 PNG로 다시 저장하기만 해도 표시가 사라졌어요. 파일 크기는 오히려 커졌는데 자격증명 영역만 없어졌어요.

왜 이렇게 되는지는 규격에 적혀 있어요

우연이 아니라 설계된 결과예요. 이유가 표준 문서에 그대로 적혀 있어요.

자격증명 표준은 이 기록을 PNG에 넣을 때 보조적이고 사적이며 복사해도 안전하지 않은 종류의 영역에 넣으라고 규정해요. 그리고 PNG 사양은 보조 영역에 대해 이렇게 적어요. 만드는 쪽은 굳이 쓸 필요가 없고 읽는 쪽은 무시해도 된다는 것이에요.

두 문장을 이으면 결론이 나와요. 이미지를 다시 저장하는 프로그램이 그 영역을 버리는 것은 규격 위반이 아니라 규격대로 동작한 것이에요. 그래서 이미지 편집 도구를 한 번 통과하거나 웹 최적화를 한 번 거치면 없어져요. 8,991장 중 38장만 남은 것도 같은 이유예요.

만든 도구에 따라 남는 기록의 성격이 달라요

표시가 남은 38장은 상업 서비스로 만든 그림이었어요. 그렇다면 내 컴퓨터에서 직접 돌리는 공개 모델은 어떨까요. 같은 방식으로 로컬 생성 폴더의 PNG 418장을 읽어 봤어요.

확인 항목결과
읽은 PNG418장
서명된 자격증명 기록0장
텍스트 기록390장
그 텍스트의 항목 이름prompt 하나

서명된 기록은 한 장도 없었어요. 대신 390장에 평문 텍스트 기록이 들어 있었고, 항목 이름은 전부 prompt 였어요. 내용을 열어 보니 사용한 모델 파일 이름과 생성 설정 전체가 그대로 들어 있었어요. 샘플 한 장의 그 영역 크기는 2,473바이트였어요.

여기서 두 가지가 갈려요.

첫째, 판별 관점에서 이 기록은 자격증명과 성격이 달라요. 서명이 없으니 누구나 고쳐 쓸 수 있고, 반대로 없다고 해서 사람이 만들었다는 뜻도 아니에요. 증거의 무게가 훨씬 가벼워요.

둘째, 프라이버시 관점에서는 방향이 반대예요. 로컬로 만든 PNG를 그대로 어딘가에 올리면 내가 어떤 문장으로 무엇을 만들었는지가 파일 안에 평문으로 따라가요. 판별을 걱정하기 전에 이쪽을 먼저 챙기는 편이 실용적이에요. 앞서 본 대로 웹용으로 한 번 변환하면 이 기록도 같이 사라져요.

촬영 정보가 있는 파일도 한 장 없었어요

한 가지를 더 확인했어요. 사람이 찍은 사진이라면 남아 있을 촬영 정보는 몇 장에 있었을까요. 8,991장 전체에서 촬영 정보 영역을 가진 파일은 0장이었어요.

이 숫자가 중요한 이유가 있어요. 판별을 파일 정보로 하려는 사람은 보통 이렇게 생각해요. 카메라 정보가 있으면 실제 사진이고, 없으면 AI 그림일 것이라고요. 그런데 웹에 올라간 이미지는 형식 변환과 압축을 거치면서 카메라 정보도 같이 지워져요. 이번 표본은 전부 웹 게시용 자산이라 양쪽 정보가 모두 0에 가까웠어요.

즉 파일 정보만으로는 AI 그림과 정보가 지워진 사진을 구분할 수 없어요. 둘 다 똑같이 비어 있기 때문이에요.

픽셀에 심는 방식은 다르게 동작해요

파일 정보가 아니라 그림 자체에 눈에 보이지 않는 표시를 심는 계열도 있어요. 구글이 공개한 설명에 따르면 이 표시는 만드는 순간 심어지고 사람에게는 감지되지 않으며, 자르기나 필터 적용 같은 수정에도 견디도록 설계되어 있어요. 확인은 해당 모델의 대화창에 이미지를 올려 물어보거나 별도의 확인 포털에 업로드해서 해요.

이 방식의 장점과 한계는 분명해요. 재저장으로 사라지지 않는 것이 장점이고, 그 회사 모델로 만든 이미지에만 적용된다는 것이 한계예요. 다른 도구로 만든 그림이나 이미 표시가 지워진 파일에는 쓸 수 없어요.

딥페이크처럼 악용 목적으로 만든 이미지를 가려내는 방법은 AI 딥페이크 판별 가이드 쪽에 따로 정리해 두었어요. 사진을 올릴 때 촬영정보가 노출되는 문제는 여행 사진 SNS 업로드 전 확인 5가지 쪽을 보시면 도움이 돼요.

실무 판정 순서

정리하면 이래요.

  1. 서명된 생성 기록이 있으면 만든 쪽의 자기 신고이므로 강한 증거로 쓰세요.

  2. 기록이 없으면 판정 보류예요. 이번 측정에서 없는 것이 8,991장 중 8,947장, 기본값이었어요.

  3. 픽셀 기반 확인이 적용되는 출처라면 그쪽을 추가로 확인하세요.

  4. 내가 만든 이미지를 올릴 때는 반대로 파일에 무엇이 붙어 있는지 먼저 확인하세요. 로컬 생성 파일에는 설정이 평문으로 들어 있을 수 있어요.

그리고 하지 말아야 할 것이 하나 있어요. 파일 정보가 비어 있다는 사실을 사람이 만들었다는 근거로 쓰는 것이에요. 비어 있음은 판별에 실패했다는 뜻이고, 이 글의 측정은 그 실패가 예외가 아니라 정상 상태라는 것을 보여줘요.

생성한 이미지를 상업적으로 쓸 때의 표시 의무와 저작권 문제는 AI 이미지 저작권과 상업적 이용 쪽에 정리되어 있어요. 판별과 별개로 챙겨야 하는 부분이라 함께 보시면 좋아요.

측정은 2026년 9월 19일에 로컬 파일을 직접 읽어 진행했고, 표준 문서의 문구는 같은 날 공개된 판본을 인용했어요. 특정 도구의 성능을 평가하려는 목적이 아니라 파일 정보로 판별이 되는 조건과 안 되는 조건을 가르는 것이 목적이에요.

❓ 자주 묻는 질문 (FAQ)

파일 정보를 보면 AI 이미지인지 알 수 있나요?

표시가 남아 있는 파일에서만 알 수 있고, 남아 있는 비율이 아주 낮아요. 손에 있는 이미지 8,991장의 내부 구조를 전부 열어 보니 생성 표시가 들어 있던 것은 38장이었어요. 0.42퍼센트예요. 남아 있던 38장은 모두 PNG였고, 웹용 형식으로 저장된 8,407장에는 한 장도 없었어요. 그러니 파일 정보가 비어 있다는 것은 사람이 찍은 사진이라는 뜻이 아니라 아무것도 알 수 없다는 뜻이에요. 있으면 강한 증거이고 없으면 증거가 아닌 비대칭 구조라고 보시면 돼요.

표시가 남아 있던 38장에는 무엇이 적혀 있었나요?

서명이 붙은 생성 기록이 들어 있었어요. 파일 안의 전용 영역에 14,088바이트짜리 기록이 들어 있고, 그 안에 만든 도구의 이름과 서명 정보, 그리고 디지털 원본 유형을 뜻하는 항목이 있었어요. 유형 값은 학습된 알고리즘이 만든 매체를 가리키는 용어였어요. 이 용어는 언론 사진 분야의 표준 어휘집에 등록된 값이고, 정의는 학습된 인공지능 모델을 사용해 알고리즘으로 만든 디지털 매체예요. 즉 만든 쪽이 스스로 남긴 기록이고, 판별기가 추측한 결과가 아니에요.

그 표시는 왜 그렇게 쉽게 사라지나요?

규격이 그렇게 정해 두었기 때문이에요. 표준 문서는 이 기록을 PNG 안에 넣을 때 보조적이고 사적이며 복사해도 안전하지 않은 종류의 영역에 넣으라고 적어요. PNG 사양은 보조 영역에 대해 만드는 쪽이 굳이 쓸 필요가 없고 읽는 쪽이 무시해도 된다고 규정해요. 즉 이미지를 다시 저장하는 프로그램은 그 영역을 버려도 규격을 위반하지 않아요. 실제로 확인해 보니 형식을 바꾸지 않고 PNG로 다시 저장하기만 해도 그 영역이 사라졌어요.

직접 확인해 보고 싶으면 어떻게 하나요?

파일 정보를 보여주는 도구로 이미지를 열어 보면 돼요. 윈도우에서는 파일을 오른쪽 클릭해 속성을 보면 일부 정보가 보이고, 더 자세히 보려면 메타데이터 확인 도구를 쓰면 돼요. 확인할 항목은 두 가지예요. 하나는 콘텐츠 자격증명이라 불리는 서명된 생성 기록이 있는지, 다른 하나는 촬영 기기 정보가 있는지예요. 다만 둘 다 없는 경우가 대부분이라는 점을 기억하세요. 이번 측정에서 8,991장 중 8,947장이 아무 정보도 갖고 있지 않았어요.

파일 정보가 없으면 판별할 방법이 아예 없나요?

다른 계열의 방법이 있어요. 픽셀 자체에 사람 눈에 보이지 않는 표시를 심는 방식이에요. 구글이 공개한 설명에 따르면 이 표시는 만드는 순간 심어지고 사람에게는 감지되지 않으며, 자르기나 필터 적용 같은 수정에도 견디도록 설계되어 있어요. 확인은 해당 모델의 대화창에 이미지를 올려 물어보거나 별도의 확인 포털에 올려서 해요. 다만 이 방식은 그 회사의 모델로 만든 이미지에만 적용돼요. 다른 도구로 만든 그림이나 이미 표시가 지워진 파일에는 쓸 수 없어요.

그럼 실무에서는 무엇을 기준으로 삼아야 하나요?

판정을 세 단계로 나누면 실수를 줄일 수 있어요. 첫째, 서명된 생성 기록이 있으면 그것은 만든 쪽의 자기 기록이므로 강한 증거로 쓰세요. 둘째, 기록이 없으면 판정 보류로 두세요. 이번 측정처럼 없는 것이 기본값이기 때문이에요. 셋째, 픽셀 기반 확인 도구가 적용되는 출처라면 그쪽을 추가로 확인하세요. 반대로 하지 말아야 할 것은 하나예요. 파일 정보가 비어 있다는 사실을 사람이 만들었다는 근거로 쓰는 것이에요.

📚 함께 읽으면 좋은 글 (Related Posts)

AI 사용법 가이드 더 보기 →
ChatGPT 한글 깨짐의 절반은 자음 모음이 분리된 것이에요
ai-guide2026-09-18

ChatGPT 한글 깨짐의 절반은 자음 모음이 분리된 것이에요

올린 파일 이름이 ㅎㅏㄴㄱㅡㄹ 처럼 자음 모음으로 흩어져 보이거나, 검색해도 안 걸리고 정렬이 뒤죽박죽이라면 글씨가 깨진 게 아니라 같은 글자를 저장하는 방식이 두 가지여서 생긴 일이에요. 직접 재 보니 한글 두 글자가 한쪽 방식으로는 6바이트인데 다른 방식으로는 18바이트, 정확히 세 배였어요. 같은 글자인데 컴퓨터가 서로 다르다고 판정하는 이유와, 두 방식을 눈으로 구분하는 방법, 한 줄로 고치는 방법을 실측값으로 정리했어요.

Civitai 인기 모델 1,000개의 이용권한 전수 집계 — 상업적 사용 불가가 300개예요
ai-revenue2026-09-12

Civitai 인기 모델 1,000개의 이용권한 전수 집계 — 상업적 사용 불가가 300개예요

Civitai 공개 조회 창구에서 다운로드 상위 체크포인트 500개와 로라 500개, 합계 1,000개를 받아 제작자가 설정해 둔 이용권한 항목을 전수로 셌어요. 모델 페이지에 「No commercial use」 배지가 붙는 모델이 300개로 30.0퍼센트였고, 그 모델로 만든 이미지를 팔 수 있는 모델은 698개였어요. 제작자 표기를 요구하는 모델이 333개, 병합을 막아 둔 모델이 241개예요. 조회 시각은 2026년 9월 12일 오후 1시 10분부터 1시 15분까지(한국 시각)예요.

맥 패키지 관리자 설치 집계에서 AI 코딩 도구가 1·2위였어요 — 상위 100개 중 최소 14개가 AI 도구예요
ai-tools2026-09-11

맥 패키지 관리자 설치 집계에서 AI 코딩 도구가 1·2위였어요 — 상위 100개 중 최소 14개가 AI 도구예요

홈브루가 공개하는 집계 주소를 직접 불러서 최근 30일 캐스크 설치 1,889,149건을 세어 봤어요. 1위가 codex로 122,607건, 2위가 claude-code로 51,469건이었고, 설치 건수 상위 100개 중 최소 14개가 AI 도구였어요. 조회 시각은 2026년 9월 11일 오전 11시 38분부터 11시 45분까지(한국 시각)예요.