Traducir documentos localmente: la alternativa a DeepL
Pegar un contrato, un informe financiero o un expediente de RR. HH. en DeepL o ChatGPT significa enviar ese documento a servidores que no controlas. La traducción local con IA resuelve este problema: un LLM multilingüe se ejecuta en tu máquina y ningún dato sale de ella. Esta guía muestra qué modelos elegir, cómo preservar el formato de los archivos y cómo traducir decenas de documentos por lotes con un simple script de Ollama.
#¿Por qué no enviar tus documentos a DeepL?
DeepL y Google Translate son excelentes, pero su modelo de negocio se basa en la nube: tu texto pasa por sus servidores y, según la oferta, puede conservarse o utilizarse para mejorar los modelos. Para un correo inofensivo, no importa. Para un contrato sujeto a un NDA, una patente cuya solicitud está en proceso de presentación, un balance contable o datos personales de empleados, supone un riesgo jurídico y competitivo concreto.
La traducción con IA local cambia las reglas del juego: el modelo se descarga en tu disco y se ejecuta en tu CPU o GPU. Sin solicitudes de red, sin cuenta y sin límite de volumen. Puedes traducir una carpeta entera de documentos confidenciales sin que un solo byte salga de tu ordenador, incluso sin conexión, en un avión o en una red aislada.
- Confidencialidad
- Contratos, patentes, datos médicos o de RRHH permanecen en tu máquina.
- Sin coste de uso
- Sin suscripción ni facturación por carácter: traduce 10 o 10.000 páginas al mismo precio.
- Hors-ligne
- Funciona sin conexión, útil en un ordenador aislado o cuando estás de viaje.
- Volumen ilimitado
- No hay cuotas mensuales ni limitaciones de velocidad como en las API en la nube.
#¿Qué modelos locales traducen realmente bien?
Tus documentos, tu IA: un RAG local fiable sobre tus PDF, notas y correos — sin enviar nada a la nube.
- Espacio en línea de por vida
- PDF + archivos
- Reembolsado 30 j
No todos los LLM ofrecen la misma calidad de traducción. Un buen traductor local debe haberse entrenado con un amplio corpus multilingüe y manejar el francés con precisión. En 2026, algunas familias destacan claramente para un uso autoalojado.
- Qwen 3.5 9B
- Excelente en múltiples idiomas, muy bueno en francés, maneja bien los matices y el vocabulario técnico. ≈6,6 GB en Q4, 256k de contexto, licencia Apache 2.0: el mejor equilibrio calidad/recursos en 2026. Sube a Qwen 3.8 27B (≈18 GB) si la calidad no es suficiente.
- Gemma 4 12B
- Traducciones fluidas y naturales, puntuación francesa cuidadosa. Multimodal, ahora bajo licencia Apache 2.0 (Gemma pasó a Apache 2.0 en 2026). ≈7,6 GB en Q4, cómodo en un GPU de 12-16 GB o en un Mac con memoria unificada.
- Qwen 3.5 4B
- El pequeño modelo multilingüe predeterminado en 2026: solo ≈3,4 GB, funciona en cualquier equipo —incluso en CPU— y ya traduce sorprendentemente bien para su tamaño. Apache 2.0.
- Mistral Small 24B
- Excelente en francés, rápido, ≈14 GB en Q4. Un generalista sólido, una muy buena opción para procesar grandes volúmenes en una GPU de 16 GB.
- Qwen 3.6 35B-A3B
- Calidad similar a la de los modelos en la nube gracias a su arquitectura MoE, ahora accesible a partir de 32 GB (≈23 GB en Q4, RTX 4090 o Mac con mucha memoria unificada). Reservado para traducciones exigentes.
También existen modelos especializados en traducción, como NLLB u Opus-MT, que son muy ligeros, pero un LLM generalista reciente suele superarlos en textos largos y en el respeto al contexto (registro, terminología profesional, coherencia de un documento completo).
#Prerrequisitos e instalación
La base es clásica: Ollama como motor de inferencia, un modelo multilingüe, y Python para los scripts de procesamiento de archivos. Ollama escucha por defecto en http://localhost:11434.
- Ollama instalado
- El daemon que descarga y ejecuta los modelos. Consultar la guía de instalación si aún no está instalado.
- Una GPU con potencia suficiente
- Una RTX 3060 de 12 GB ejecuta sin problemas un Qwen 3.5 9B en Q4 (~6,6 GB). Funciona también en CPU, pero más lentamente.
- Python 3.10+
- Para manipular DOCX, PDF y Markdown y llamar a la API Ollama.
#Primer test de traducción
Antes de automatizar, verifica la calidad en un fragmento representativo. La clave de una buena traducción local está en el prompt de sistema: define el rol, el idioma de destino y, sobre todo, la instrucción de no añadir nada.
#Preservar el formato (DOCX, PDF, Markdown)
Traducir texto plano es fácil; conservar el formato de un documento real lo es menos. El enfoque correcto no es enviar todo el archivo al modelo, sino traducir cada segmento de texto en su lugar, manteniendo la estructura intacta.
#Archivos Word (DOCX)
python-docx expone cada párrafo y cada celda de tabla. Se traduce el texto de cada «run» conservando el estilo y luego se vuelve a escribir el archivo. Se conservan la disposición de la página, los títulos y las tablas.
#Markdown
Markdown es el formato más sencillo de traducir correctamente: basta con indicar al modelo que preserve la sintaxis. Los títulos, listas, enlaces y bloques de código permanecen intactos si el prompt lo exige.
El PDF es el caso más delicado: es un formato de presentación, no de contenido. Se extrae el texto con pypdf, se traduce y luego se genera un nuevo documento con él (a menudo un DOCX o un PDF generado). Reproducir la maquetación exacta de un PDF rara vez es rentable; busca un documento legible en lugar de una copia idéntica píxel por píxel.
#Traducción por lotes con Ollama
La principal ventaja de trabajar en local es el volumen sin factura. Un script que recorre una carpeta y traduce cada archivo convierte tu equipo en un servicio de traducción por lotes. Aquí tienes un script que procesa todos los .docx de un directorio.
#Mejorar la calidad de las traducciones
Un LLM local traduce bien por defecto, pero algunos ajustes hacen que el resultado pase de «correcto» a «publicable», especialmente en textos profesionales.
- 01Proporcionar un glosarioAñade al prompt del sistema un glosario de términos de tu ámbito profesional y sus traducciones obligatorias (razón social, nombres de productos, acrónimos). El modelo respetará tu terminología en lugar de inventarla.
- 02Dividir inteligentementeTraduce por párrafos o por secciones, no frase por frase: el modelo necesita contexto para gestionar bien la concordancia, las referencias pronominales y el registro.
- 03Proporcionar el contexto del documentoEspecifica el tipo de texto («contrato comercial», «manual técnico», «email interno») en el prompt. El registro y el vocabulario se ajustan en consecuencia.
- 04Releer los pasajes críticosPara un contrato o documento legal, una revisión humana de las cláusulas sensibles sigue siendo indispensable: ejecutar el modelo en local te da confidencialidad, no infalibilidad.
- 05Pasar a un modelo más potente si es necesarioSi la calidad se estanca, pasa de Qwen 3.5 9B a Qwen 3.8 27B (recuerda ajustar su razonamiento a «low»: por defecto razona en exceso, algo innecesario para la traducción), o incluso a un modelo MoE como Qwen 3.6 35B-A3B. La mejora es clara en las frases largas y en la precisión terminológica.
#Solución de problemas
- El modelo añade comentarios
- Refuerza la instrucción «devuelve ÚNICAMENTE la traducción» y baja la temperatura. Algunos modelos añaden al principio «Aquí está la traducción:»; elimina ese prefijo en el posprocesamiento si es necesario.
- Traduce en el idioma incorrecto
- Indica explícitamente el idioma de destino en el prompt y da un ejemplo. En un texto corto, un modelo puede equivocarse de idioma.
- Se pierde el formato del DOCX
- Es la sustitución de para.text la que aplana los runs. Traduce run a run los documentos con mucho formato.
- Traducción lenta en grandes volúmenes
- Verifica que el modelo quepa en la VRAM (de lo contrario, la descarga de parte del modelo a la CPU ralentiza la ejecución). Reduce el tamaño del modelo o utiliza OLLAMA_KEEP_ALIVE.
- Bloques de código Markdown traducidos
- Insiste en el prompt: «no traduzcas el contenido de los bloques de código». Como alternativa, extráelos antes de la traducción y vuelve a insertarlos después.
- Contexto demasiado largo recortado
- Un documento muy grande supera la ventana de contexto. Divídelo en secciones y traduce cada una por separado.
#Para ir más allá
La traducción con IA local se apoya en una base bien elegida con Ollama. Estas guías del sitio complementan la puesta en marcha:
- Instalar Ollama
- Para instalar el motor de inferencia si no se ha hecho ya.
- Q4, Q5, Q8: ¿qué cuantización elegir?
- Para encontrar el equilibrio entre calidad de traducción, velocidad y VRAM según tu GPU.
- n8n + Ollama: automatizar con IA local
- Para integrar la traducción en un flujo de trabajo sin código (correos entrantes, archivos subidos, etc.).
¿Un comentario, un error, una precisión? Avísanos, eso mejora la guía para todos.