▤ 핵심 요약

  • ✓ 글자가 텍스트로 들어 있는 파일과, 사진처럼 이미지로 된 파일은 처리 방식이 다릅니다.
  • ✓ 표와 도표는 사람 눈에 보이는 구조가 그대로 전달되지 않을 수 있습니다.
  • ✓ 파일을 올리는 순간 그 내용이 외부로 나간다는 점을 늘 전제해야 합니다.

잘 되는 쪽

  • 텍스트가 살아 있는 문서 — 워드나 텍스트 기반 PDF는 내용을 그대로 읽어 요약·비교·재구성에 잘 맞습니다.
  • 구조가 단순한 표 — 열과 행이 반듯한 표는 값을 뽑아 정리하는 작업이 비교적 정확합니다.
  • 사진 속 글자 읽기 — 또렷하게 찍힌 안내문이나 라벨의 문구를 옮겨 적는 작업은 쓸 만합니다.

자주 어긋나는 쪽

스캔한 종이를 그대로 담은 PDF는 사실상 이미지 묶음이라, 글자를 인식하는 과정에서 숫자나 기호가 바뀔 수 있습니다. 금액이나 날짜처럼 한 글자만 틀려도 의미가 달라지는 값은 반드시 원본과 대조해야 합니다.

셀이 병합돼 있거나 항목이 여러 단으로 나뉜 표는 어느 값이 어느 항목에 붙는지 잘못 연결되는 일이 흔합니다. 그래프 이미지에서 정확한 수치를 읽어 달라는 요청도 마찬가지로 신뢰하기 어렵습니다.

분량이 아주 긴 파일은 앞부분만 반영되거나 중간이 뭉개질 수 있습니다. 이럴 때는 필요한 장만 잘라서 올리는 편이 정확합니다.

올리기 전에 확인할 것

  • 개인정보나 회사 기밀이 들어 있지 않은지 확인하고, 있다면 지우거나 가린 뒤 올리세요.
  • 서비스가 입력 내용을 학습에 쓰는지, 설정에서 끌 수 있는지 확인해 두면 좋습니다.
  • 결과에 숫자가 들어 있다면 원본에서 눈으로 한 번 대조하는 습관을 들이세요.

함께 보면 좋은 콘텐츠