UUPMI Lab

교육 · 2026-09-06

건축 번역 자료의 품질을 문장과 페이지로 나누어 검수하기

교수자의 용어·편집 기준을 Codex의 반복 검사로 연결한 사례입니다. 번역 표본 검토, 도판과 본문 분리, 337쪽 배치 검사에서 각각 무엇을 확인했는지 살펴봅니다.

THE EVIDENCE & LIMITS

기록을 더 자세히 보기

어떤 기록으로 확인했나요?

2026년 9월 6일 최종 QA 보고서·JSON과 Codex 작업 기록을 대조했습니다. 9월 9일 남아 있는 PDF 후보본의 SHA-256이 당시 QA 기록과 일치함을 확인했습니다. 본문 수치는 당시 구조 검사 결과이며 번역 정확도 점수가 아닙니다.

01문장을 읽는 검사와 페이지를 보는 검사는 다르다

작업은 건축적 의미와 문맥을 고려한 번역 품질 검토 요청으로 시작했습니다. 교수자는 먼저 영문·기존 번역·개선안을 열 문장 정도 비교한 뒤 수정 방향을 결정하도록 했습니다. Codex는 의미 누락, 지시 대상, 전문 개념, 부자연스러운 문장과 OCR 오류를 구분했습니다. 이 표본 검토는 수정 기준을 만드는 단계였으며 책 전체의 정확도를 측정한 시험은 아니었습니다. 이후 문제는 번역문 자체에서 페이지의 읽기 순서와 도판 대응으로 확대됐습니다.

02교수자가 편집 정책을 정하고 에이전트가 반복 적용한다

교수자는 전문용어를 한글과 원어로 함께 표기하고 추가 설명을 주석으로 제공하도록 지시했습니다. 그림 안의 영문은 유지하고 그림 밖의 캡션과 설명문은 번역한다는 기준도 정했습니다. Codex는 이 구분을 문서 생성과 검사 규칙에 반영했습니다. 그러나 짧은 영문이라는 이유만으로 도판 내부 글자로 판단하면 외부 캡션이 남을 수 있었습니다. 따라서 글자 길이뿐 아니라 실제 이미지 경계와 위치를 함께 확인하는 규칙으로 보완했습니다.

03형식별 산출물에 서로 다른 역할을 부여한다

기록에는 주석을 보완한 편집 가능한 Word 문서, 원본과 대조할 수 있는 HTML, 인쇄용 PDF, JSON 검사 결과와 검수 보고서가 남아 있습니다. Word가 원본의 복잡한 단 구성과 도판 배치를 충분히 재현하지 못한다는 교수자의 지적 뒤에는 HTML과 PDF를 이용한 페이지 대조가 이어졌습니다. 핵심은 파일 형식을 늘리는 데 있지 않습니다. 텍스트 수정, 비교 검토, 출력 확인을 분리하고 각각 무엇을 검증하는지 정하는 방식입니다.

04넘침이 없어도 도판을 가리거나 설명이 빠질 수 있다

반복된 오류의 한 원인은 같은 높이에 있는 좌우 문단을 OCR이 하나의 넓은 영역으로 합친 것이었습니다. Codex는 단을 분리하고 복잡한 페이지에는 별도 좌표를 적용했습니다. 초기 넘침 검사 뒤에도 도판 위 본문과 비어 있는 설명 패널이 발견됐습니다. 최종 보고서는 회색 설명 패널 19개 복원과 외부 영문 장 제목 정리를 기록합니다. 2026년 9월 6일의 최종 JSON에는 337쪽, 글상자 950개, 자산 누락·상자 경계 이탈·상자 상호 겹침·렌더링 넘침 각 0건이 기재돼 있습니다.

05검수 수치의 의미를 제한해서 해석한다

이번 사례 정리에서는 당시 QA 보고서의 해시와 현재 남아 있는 PDF 후보본의 SHA-256이 일치하는 것을 확인했습니다. 이 일치는 검사 기록과 파일을 연결하지만 모든 번역이 정확하다는 증명은 아닙니다. 특히 전문용어 해석, 문맥의 정확성, 설명의 충분성은 교수자의 재검토가 필요합니다. 참고문헌 여섯 쪽을 원본 래스터로 유지해 해당 부분은 검색이나 선택이 제한될 수 있다는 형식상의 한계도 보고서에 남아 있습니다.

06다음 수업 자료에 재사용할 수 있는 절차

새 자료에도 먼저 대표 문장을 검토해 용어와 문체 기준을 정하고, 도판과 본문을 구분하는 정책을 적어 두는 순서를 적용할 수 있습니다. 이어 페이지와 자산의 완전성, 글상자 배치, 실제 렌더링, 어려운 페이지의 원본 대조를 각각 검사합니다. 오류가 발견되면 공통 규칙으로 고칠 부분과 개별 페이지에서 조정할 부분을 나눕니다. 마지막에는 기준일, 검사 범위, 남은 한계를 기록하고 교수자가 수업 활용 여부를 판단합니다.

같은 분야의 기록