출시 전에 번역 품질을 측정 가능한 결정으로 만들기
번역 품질 보증은 납품 직전에 문장을 한 번 더 읽는 작업이 아니다. “자연스럽게 번역해 주세요”라는 주관적 요청을 반복 가능한 출시 결정으로 바꾸는 운영 체계다. 실무적인 워크플로는 독자, 목적, 위험을 먼저 정의하고 번역, 독립 검수, LQA 평가, 실제 화면 테스트, 출시 승인을 구분한다. 또한 오류 유형과 심각도, 표본 추출, 수정 및 재검증 기록을 통해 각 언어가 왜 출시 가능한지 또는 왜 보류되어야 하는지 설명한다.
구매자가 원하는 것은 모든 콘텐츠에 통용되는 하나의 점수가 아니라 지정된 목적에 적합하다는 증거다. 의료 지침, 소프트웨어 버튼, 법적 고지, 캠페인 문구, 사내 지식 문서는 오류의 결과가 다르다. 이 가이드는 현지화 관리자, 구매 팀, 글로벌 콘텐츠 책임자가 인수 기준을 정하고 공급사의 LQA 보고서를 비교하며 검증할 수 없는 “원어민 수준” 약속을 피하도록 돕는다.
번역 QA와 교정은 어떻게 다른가
교정은 더 큰 품질 시스템 안의 한 단계다. 보통 대상 언어의 철자, 문법, 문장부호, 일관성, 눈에 띄는 표시 문제를 찾는다. 그러나 모든 의미를 원문과 대조하거나 실제 UI에서 변수와 링크를 시험하거나 오류가 출시를 중단할 만큼 심각한지 판단하지 않을 수 있다.
완전한 흐름에는 원문 준비, 용어 승인, 번역가 자체 검토, 이중언어 교정, 자동 검사, 언어 품질 평가(LQA), 기능 및 맥락 테스트, 수정, 회귀 검토, 최종 승인이 포함될 수 있다. ISO 17100은 번역 서비스의 자원과 핵심 프로세스를 다루며, ISO 11669:2024는 구매자가 프로젝트 사양, 요구 분석, 위험 평가, 워크플로 커뮤니케이션을 설계할 수 있는 지침을 제공한다. 표준을 언급하는 것만으로는 프로젝트별 인수 조건을 대신할 수 없다.
제작 전에 역할을 정한다. 번역가는 번역과 자체 검토를 수행하고, 교정자는 원문과 번역문을 비교하여 의미·용어·목적을 확인한다. LQA 평가자는 합의된 모델로 표본이나 전체 납품물을 평가하고, 맥락 테스터는 실제 제품·페이지·문서·미디어에서 확인한다. 출시 책임자는 남은 위험을 수용하고 최종 결정을 내린다. 소규모 프로젝트에서는 한 사람이 여러 역할을 맡을 수 있지만, 단계와 근거는 추적 가능해야 한다.
검토자가 일관되게 적용할 수 있는 오류 분류 만들기
오류 분류는 충분히 포괄적이면서도 검토자가 안정적으로 구분할 수 있을 만큼 단순해야 한다. 구매자 중심 분류는 다음을 포함할 수 있다.
- 정확성: 오역, 누락, 부당한 추가, 미번역, 원문 관계 오류
- 용어: 승인 용어 미사용, 용어 불일치, 도메인에 맞지 않는 단어
- 언어: 문법, 철자, 문장부호, 구문, 유창성, 부자연스러운 표현
- 스타일과 문체: 어조, 브랜드 보이스, 격식 수준, 독자 수준 불일치
- 로캘과 규정: 날짜, 숫자, 단위, 주소, 법적 참조, 문화 관습, 필수 고지 오류
- 기능과 형식: 태그, 플레이스홀더, 링크, 줄바꿈, 잘림, 레이아웃, 문자 방향, 파일 동작 문제
W3C ITS 2.0은 도구 간 교환 가능한 현지화 품질 이슈 유형과 유형·설명·심각도 기록 방법을 제시한다. 좋은 참고점이지만 프로젝트는 검토자가 신뢰성 있게 판단할 수 있는 세분화만 채택해야 한다. 유럽연합 집행위원회 번역총국의 2024년 품질 평가 안내서는 품질 요구사항을 오류 코드에 연결하고 무작위 표본을 평가하는 공개 사례다.
심각도는 검토자의 취향이 아니라 영향으로 정한다. 치명적 오류는 안전, 법률, 재무, 개인정보 또는 중대한 평판 위험을 만들거나 필수 기능을 망가뜨린다. 주요 오류는 의미를 바꾸고 사용자를 오도하거나 중요한 지시를 위반해 과업을 실질적으로 방해한다. 경미 오류는 핵심 의미와 기능을 바꾸지 않는 제한된 언어 또는 표시 문제다.
콘텐츠별 예시를 제공한다. 복용량 소수점은 치명적일 수 있다. 버튼 용어 불일치가 잘못된 행동을 유도하면 주요 오류가 될 수 있다. 줄바꿈 방지 공백 하나는 보통 경미하지만 법정 형식을 망가뜨리면 더 높은 심각도를 가져야 한다. 카테고리만으로 심각도를 자동 결정해서는 안 된다.
오류를 실행 가능한 인수 규칙으로 바꾸기
ISO 5060:2024는 오류 유형과 벌점을 사용해 오류 점수와 품질 등급을 만드는 분석적 평가, 표본 추출, 평가자 역량을 다룬다. 구매자는 이 논리를 활용하되 하나의 점수가 모든 프로젝트에 맞는다고 가정하지 않아야 한다.
예를 들어 경미 오류 1점, 주요 오류 5점으로 두고 확인된 치명적 오류는 자동 보류로 정할 수 있다. 점수는 검토한 1,000단어, 세그먼트, 화면 등 안정적인 단위로 정규화한다. “치명적 오류 없음, 검토 1,000단어당 가중점수 10점 이하, 모든 기능 오류 수정, 주요 수정사항 회귀 테스트 완료”와 같이 쓸 수 있다. 수치는 예시이며 실제 임계값은 위험, 파일럿 근거, 이해관계자의 허용 수준으로 정해야 한다.
반복 오류의 계산 방식도 정의한다. 잘못된 용어가 80회 반복되면 근본 원인은 하나일 수 있지만 사용자 접점은 80개다. 발생 횟수와 고유 근본 원인을 모두 보고한다. 원문 결함, 취향 변경, 범위 밖 재작성은 공급사 오류 점수에서 제외할 수 있지만 해결 항목으로는 계속 추적한다.
위험을 숨기지 않는 표본 전략
항상 100% 인적 검수가 경제적인 것은 아니다. 그러나 “10% 검사”는 선택 방법이 없으면 전략이 아니다. 검토 전에 표본 단위, 모집단, 크기, 선택 방식, 확대 규칙을 정한다.
견고한 계획은 일반 콘텐츠를 대표하는 무작위 표본과 안전 문구, 가격, 주장, 법적 고지, CTA, 고트래픽 화면, 신규 용어를 포함하는 위험 기반 표본을 결합한다. 파일, 번역가, 언어, 콘텐츠 유형, 생산 배치 전반을 포함하고, 치명적 오류나 한 계층에 집중된 주요 오류가 발견되면 검토 범위를 확대한다.
예를 들어 10만 단어 릴리스에서 각 파일의 무작위 표본을 검토하고 안전 경고, 숫자, 신규 승인 용어는 전수 확인할 수 있다. 한 계층에서 치명적 오류가 나오거나 주요 오류가 임계값을 넘으면 출시를 보류하고 해당 계층을 전수 검토한다. 이 방식은 비율이 커 보여서가 아니라 표본이 결정 규칙과 연결되어 있어 방어 가능하다.
여러 언어를 한 평균으로 합치지 않는다. 전체 평균 합격이 소규모 시장의 실패를 숨길 수 있다. 언어와 고위험 콘텐츠 그룹별로 표본 크기, 오류 수, 심각도, 정규화 점수, 출시 상태를 보고한다.
실제 평가 전에 검토자 보정하기
검토자 간 불일치는 지연과 불필요한 재작업을 만든다. 보정은 점수가 대금이나 출시에 영향을 미치기 전에 규칙 해석을 맞추는 과정이다.
의도적으로 모호한 사례를 포함한 대표 세그먼트를 모든 검토자에게 제공한다. 각자가 문제 범위, 분류, 심각도, 수정안, 근거를 독립적으로 기록하게 한다. 이후 프로젝트 브리프, 용어집, 스타일 가이드, 제품 맥락을 기준으로 차이를 조정하고 오류 가이드에 사례를 추가한다. 핵심 구분을 안정적으로 적용할 때까지 다시 실행한다.
합의는 여러 수준에서 본다. 같은 문제를 찾았는가, 같은 분류를 골랐는가, 같은 심각도를 주었는가를 각각 확인한다. 하나의 일치율은 차이의 원인을 숨길 수 있다. 판정 결과를 살아 있는 결정 로그에 남겨 같은 예외를 배치마다 다시 논의하지 않도록 한다.
검토자의 선호도도 통제해야 한다. 올바른 문장을 개인 취향에 맞추기 위해 다시 쓰면 안 된다. 점수에 포함되는 오류에는 명시된 지침, 의미 결함, 독자 문제, 기능 영향 중 하나가 있어야 한다. 유용한 스타일 제안은 “선호”로 별도 기록해 인수 지표를 왜곡하지 않게 한다.
최종 화면에서 번역 테스트하기
이중언어 파일에서 맞는 문장도 제품에 들어가면 실패할 수 있다. 맥락 테스트는 내보낸 텍스트가 아니라 사용자가 경험하는 결과를 확인한다.
소프트웨어와 웹사이트에서는 텍스트 확장, 잘림, 줄바꿈, 버튼, 링크, 변수, 복수형, 성별, 정렬, 검색, 오른쪽에서 왼쪽으로 쓰는 언어, 날짜와 숫자 형식, 고위험 흐름을 테스트한다. 문서는 표, 페이지 참조, 머리말, 글꼴, 도표, PDF와 인쇄 결과를 본다. 자막은 타이밍, 화자 맥락, 줄바꿈, 읽기 부담, 화면 내 텍스트를 확인한다. 마케팅은 제목, 이미지, CTA, 랜딩 페이지, 시장별 주장이 함께 작동하는지 확인한다.
모든 이슈를 문자열 ID, 세그먼트, 페이지, 화면, 타임스탬프, 파일 위치와 연결하고 스크린샷이나 렌더링 파일을 증거로 남긴다. 수정 후에는 해당 맥락과 인접 콘텐츠를 회귀 테스트한다. 한 수정이 새로운 잘림, 태그 오류, 용어 불일치를 만들 수 있기 때문이다.
생산 방식과 검토 깊이는 번역 워크플로의 인적 검토, 번역과 MTPE 비교, 웹사이트 현지화와 번역의 차이에서 더 자세히 확인할 수 있다.
출시 결정을 지원하는 LQA 보고서 요구하기
좋은 보고서는 결론 없는 코멘트 목록이 아니다. 프로젝트와 버전, 언어와 파일, 평가자와 날짜, 적용 사양과 용어집·스타일 가이드·분류 버전, 모집단과 표본 크기·선택 방식·위험 계층, 각 이슈의 위치·원문·번역문·분류·심각도·근거·수정안이 있어야 한다. 또한 언어·분류·심각도·콘텐츠 그룹별 정규화 점수, 치명적 및 시스템 이슈, 근본 원인, 수정 책임자와 기한, 재검증 증거, 미해결 예외, 합격·조건부 합격·불합격 권고를 포함한다.
구매 팀은 총점만 비교하지 말고 공급사가 인수 기준, 표본, 검토자 보정, 이의 제기, 수정 증명을 어떻게 관리하는지 비교해야 한다. 비식별 샘플 보고서를 요청하고 하나의 오류가 발견, 판정, 수정, 회귀 확인, 출시 결정으로 이어지는 과정을 설명하게 한다.
현지화 출시 체크리스트
출시 전에 다음을 확인한다.
- 최신 원문, 범위, 독자, 시장, 위험이 기록되어 있다.
- 언어뿐 아니라 정확한 대상 로캘이 지정되어 있다.
- 용어, 스타일, 제품 참조, 번역 금지 항목이 승인되었다.
- 번역가, 교정자, 평가자, 테스터, 출시 책임자의 역할이 명확하다.
- 오류 분류, 심각도, 표본, 임계값, 확대 규칙이 평가 전에 합의되었다.
- 숫자, 태그, 플레이스홀더, 용어, 완전성 자동 검사가 통과했다.
- 필요한 이중언어 검수와 위험 기반 LQA가 완료되었다.
- 최종 렌더링이 맥락 및 기능 테스트를 통과했다.
- 모든 치명적·주요 오류에 처리 결과, 담당자, 재검증 기록이 있다.
- LQA 이후 변경이 회귀 테스트되었다.
- 최종 보고서에 남은 위험과 승인자가 명시되어 있다.
- 원문, 승인 번역, 보고서, 결정, 버전 이력이 정책에 따라 보관된다.
품질 보증의 결과는 감사 가능한 선택이어야 한다. 즉 출시, 문서화된 예외를 포함한 출시, 또는 수정 보류다. 잠재 파트너에게 LQA 샘플 보고서와 문서화된 인수 기준을 요청하라. Smart Language Service는 위험 기반 번역 품질 보증 흐름을 설계하고 콘텐츠를 번역·검수하며 최종 출시 결정을 뒷받침하는 언어별 증거를 제공할 수 있다.

