Convierta la calidad de traducción en una decisión medible
El aseguramiento de calidad de traducción no consiste en volver a leer el texto justo antes de entregarlo. Es el sistema operativo que convierte una petición subjetiva —“que suene bien”— en una decisión de publicación repetible. Un flujo sólido define público, propósito y riesgo; separa traducción, revisión independiente, evaluación LQA, pruebas en contexto y aprobación; y conserva evidencia mediante categorías de error, severidad, muestreo, correcciones y nuevas pruebas.
El comprador no necesita una puntuación universal. Necesita demostrar que la traducción sirve para el propósito especificado. Una instrucción médica, un botón de software, un aviso jurídico, un titular publicitario y un artículo interno no tienen las mismas consecuencias. Esta guía ayuda a responsables de localización, compras y contenido global a fijar criterios de aceptación, comparar informes LQA y evitar pagar por promesas vagas de “calidad nativa”.
Diferencia entre QA de traducción y corrección
La corrección es una actividad dentro de un sistema más amplio. Suele detectar ortografía, gramática, puntuación, coherencia y problemas visibles de presentación en el idioma de destino. Puede no verificar cada significado frente al original, probar variables en una interfaz real, confirmar hechos del mercado ni decidir si un error debe bloquear la publicación.
Un flujo completo puede incluir preparación del original, aprobación terminológica, autocontrol del traductor, revisión bilingüe, controles automáticos, evaluación lingüística (LQA), pruebas funcionales o en contexto, corrección, regresión y aprobación final. ISO 17100 trata los recursos y procesos esenciales de los servicios de traducción. ISO 11669:2024 ofrece a los compradores un marco para especificaciones, análisis de necesidades, riesgo y comunicación del flujo. Ninguna referencia sustituye los criterios específicos del proyecto.
Defina los roles antes de producir: el traductor crea y revisa su texto; el revisor compara origen y destino y valida significado, terminología y propósito; el evaluador LQA puntúa una muestra o entrega con el modelo acordado; el probador examina el producto, página, documento o medio renderizado; y el responsable de publicación acepta el riesgo residual y autoriza la salida. En proyectos pequeños una persona puede cubrir varios roles, pero las etapas y la evidencia deben seguir visibles.
Cree una taxonomía de errores que los revisores puedan aplicar
La clasificación debe ser completa, pero no tan granular que los revisores no puedan usarla de forma coherente. Un modelo orientado al comprador suele incluir:
- exactitud: traducción incorrecta, omisión, adición, contenido sin traducir o relación errónea con el original;
- terminología: término aprobado incorrecto, incoherencia o palabra impropia del dominio;
- idioma: gramática, ortografía, puntuación, sintaxis, fluidez o formulación antinatural;
- estilo y registro: tono, voz de marca, formalidad o nivel de audiencia inadecuados;
- configuración regional y cumplimiento: fecha, número, unidad, dirección, referencia jurídica, convención cultural o aviso obligatorio incorrectos;
- función y formato: etiqueta, variable, enlace, salto de línea, truncamiento, maquetación, dirección del texto o comportamiento del archivo defectuosos.
El W3C ITS 2.0 define tipos interoperables de problemas de calidad de localización y campos para registrar tipo, comentario y severidad. Es una referencia útil, pero cada proyecto debe adoptar solo el detalle que pueda distinguirse con fiabilidad. El paquete de evaluación de 2024 de la Dirección General de Traducción de la Comisión Europea muestra públicamente cómo vincular requisitos con códigos de error y evaluar una muestra aleatoria.
La severidad debe describir impacto, no irritación del revisor. Un error crítico puede provocar daños de seguridad, jurídicos, financieros, de privacidad o reputación; romper una función necesaria; o inutilizar el contenido. Uno mayor cambia el significado, engaña, incumple una instrucción importante o perjudica materialmente la tarea. Uno menor es un defecto limitado que no cambia el significado principal ni bloquea la acción.
Añada ejemplos por contenido. Un decimal en una dosis puede ser crítico. Un botón incoherente puede ser mayor si conduce a la acción equivocada. Un espacio de no separación puede ser menor salvo que rompa un formato obligatorio. No asigne severidad automáticamente solo por categoría.
Transforme errores en una regla de aceptación
ISO 5060:2024 aborda la evaluación analítica mediante tipos de error y puntos de penalización para producir una puntuación y calificación; también trata el muestreo y la competencia del evaluador. El comprador puede usar esa lógica sin asumir que una sola cifra sirve para cualquier proyecto.
Por ejemplo, asigne 1 punto a un error menor, 5 a uno mayor y haga que cualquier crítico confirmado detenga la publicación. Normalice los puntos por 1.000 palabras revisadas, segmentos, pantallas u otra unidad estable. El umbral podría decir: “sin críticos; máximo de 10 puntos ponderados por 1.000 palabras; todos los fallos funcionales corregidos; todas las correcciones mayores sometidas a regresión”. Son cifras ilustrativas. Fíjelas según riesgo, evidencia del piloto y tolerancia de las partes.
Defina cómo contar repeticiones. Un término incorrecto 80 veces puede tener una sola causa raíz, pero afecta 80 interacciones. Informe ocurrencias y causas únicas. Los defectos del original, cambios de preferencia y reescrituras fuera de alcance pueden excluirse de la puntuación del proveedor, pero deben seguirse hasta su resolución.
Muestree sin ocultar el riesgo
La revisión humana completa no siempre es rentable, pero “revisar el 10%” no es una estrategia si no se documenta la selección. Antes de comenzar, defina unidad, población, tamaño, método y regla de ampliación.
Un plan robusto combina una muestra aleatoria de contenido habitual y una muestra por riesgo de avisos de seguridad, precios, afirmaciones, textos jurídicos, llamadas a la acción, pantallas de alto tráfico y terminología nueva. Debe cubrir archivos, traductores, idiomas, tipos de contenido y lotes. Si aparece un crítico o un grupo de mayores en un estrato, amplíe la revisión.
Para una entrega de 100.000 palabras, el comprador podría extraer al azar de cada archivo y revisar al 100% advertencias, números y términos nuevos. Si aparece un crítico o los mayores superan el umbral de un estrato, se bloquea ese idioma y se revisa todo el estrato. El plan es defendible porque conecta la muestra con una decisión, no porque el porcentaje parezca alto.
No mezcle idiomas en una media. Una puntuación global aprobada puede ocultar el fallo de un mercado pequeño. Informe tamaño, errores, severidad, puntuación normalizada y estado por idioma y grupo de alto riesgo.
Calibre a los revisores antes de puntuar producción
El desacuerdo genera ruido, retraso y retrabajo. La calibración alinea interpretaciones antes de que la puntuación afecte pagos o publicación.
Entregue a todos el mismo conjunto representativo, con casos ambiguos. Cada persona debe marcar fragmento, categoría, severidad, corrección y fundamento de forma independiente. Compare resultados y resuelva diferencias con el brief, glosario, guía de estilo y contexto del producto. Añada ejemplos a la guía y repita hasta aplicar de forma consistente las distinciones importantes.
Mida el acuerdo por niveles: ¿detectaron el mismo problema, eligieron la misma categoría y asignaron la misma severidad? Un solo porcentaje puede ocultar la causa. Registre las decisiones de adjudicación para no debatir el mismo caso en cada lote.
Controle el sesgo de preferencia. Un revisor no debe reescribir contenido correcto solo porque prefiere otra frase. Exija una instrucción citada, defecto de significado, problema para la audiencia o impacto funcional para puntuar. Registre las preferencias por separado para que las sugerencias útiles no distorsionen la aceptación.
Pruebe la traducción en su contexto real
Una cadena correcta en un archivo bilingüe puede fallar dentro del producto. Las pruebas en contexto verifican la experiencia final.
En software y web, pruebe expansión, truncamiento, saltos, botones, enlaces, variables, plurales, género, ordenación, búsqueda, escritura derecha-izquierda, formatos y flujos de alto riesgo. En documentos, revise tablas, referencias de página, encabezados, fuentes, gráficos y PDF o impresión. En subtítulos, compruebe tiempo, hablante, cortes de línea, carga de lectura y texto en pantalla. En marketing, confirme que titular, imagen, CTA, landing y afirmación local funcionan juntos.
Use identificadores estables para vincular cada problema con cadena, segmento, página, pantalla, tiempo o archivo. Capture una pantalla o archivo renderizado, no solo un comentario. Tras corregir, pruebe de nuevo el contexto y contenido cercano: una corrección puede introducir truncamiento, etiquetas rotas o términos incoherentes.
Consulte también nuestras guías sobre revisión humana en flujos de traducción, traducción frente a MTPE y localización web frente a traducción para elegir método de producción y profundidad de QA.
Exija un informe LQA preparado para decidir
Un informe útil no es una hoja de comentarios sin conclusión. Debe incluir proyecto, versión, idioma, archivos, evaluador y fecha; especificaciones, glosario, estilo y versión de taxonomía; población, muestra, selección y estratos; cada problema con ubicación, origen, destino, categoría, severidad, fundamento y corrección; resultados normalizados por idioma, categoría, severidad y grupo; hallazgos críticos y sistémicos, causa raíz, responsable y fecha; pruebas de corrección, excepciones abiertas y recomendación clara de aprobado, aprobado condicional o rechazado.
Compras debe comparar cómo los proveedores definen aceptación, seleccionan muestras, calibran, gestionan apelaciones y demuestran correcciones, no solo la puntuación principal. Solicite un informe anonimizado y pida explicar un error desde detección hasta adjudicación, corrección, regresión y decisión.
Lista de control de publicación localizada
Antes de aprobar, confirme:
- se documentaron origen vigente, alcance, audiencia, mercado y riesgo;
- se identificó la configuración regional exacta, no solo el idioma;
- se aprobaron terminología, estilo, referencias y elementos no traducibles;
- están claras las funciones de traductor, revisor, evaluador, probador y responsable;
- taxonomía, severidad, muestra, umbrales y escalado se acordaron antes de puntuar;
- pasaron controles automáticos de números, etiquetas, variables, términos e integridad;
- finalizaron revisión bilingüe y LQA basada en riesgo;
- el contenido final pasó pruebas funcionales y en contexto;
- todo crítico y mayor tiene decisión, responsable y evidencia de nueva prueba;
- los cambios posteriores a LQA pasaron regresión;
- el informe final identifica riesgo residual y aprobador autorizado;
- se conservan originales, traducciones aprobadas, informes, decisiones y versiones.
El aseguramiento de calidad debe producir una elección auditable: publicar, publicar con excepciones documentadas o retener para corregir. Pida a posibles socios un informe LQA de muestra y criterios de aceptación escritos. Smart Language Service puede diseñar un flujo de aseguramiento de calidad de traducción basado en riesgo, traducir y revisar el contenido y entregar evidencia por idioma para respaldar la decisión final.

