Evalúa modelos de MT comerciales para una plataforma turística canaria
Visión general
De qué trata este proyecto.
Diseña un test set de 1.000 oraciones por par de idiomas, evalúa APIs de MT con BLEU, chrF y COMET, y realiza MQM con nativos. Obtén un certificado verificable.
El escenario
La plataforma (~70 personas) gasta ~340.000 EUR/año en MT comercial; un cambio bien fundamentado puede recortar el 30 % sin perder calidad percibida.
El Briefing
Lo que harás y lo que demostrarás.
Recomendar el mejor proveedor de MT por par de idiomas con métricas automáticas + humanas y justificación de coste.
Earning criteria — what you'll demonstrate
- Diseñar test sets balanceados y representativos
- Comparar proveedores comerciales con métricas reproducibles
- Combinar evaluación automática y humana en un benchmark
- Comunicar trade-offs coste-calidad a producto
Encaje académico
Dónde encaja esto en tus estudios.
Afina las mismas habilidades que tu titulación espera de ti.
Alineación con asignaturas próximamente.
Habilidades
Habilidades que demostrarás.
Cada una aparece en tu credencial verificada.
- Mt Evaluation
Apply mt evaluation to solve real industry problems and demonstrate production-level capability.
- Bleu Evaluation
Apply bleu evaluation to solve real industry problems and demonstrate production-level capability.
- Human Evaluation
Apply human evaluation to solve real industry problems and demonstrate production-level capability.
- Cost Analysis
Apply cost analysis to solve real industry problems and demonstrate production-level capability.
- Benchmark Design
Apply benchmark design to solve real industry problems and demonstrate production-level capability.
- Python
Write clean, efficient Python for data processing, automation, and backend services.
Carreras
Roles para los que esto te prepara.
Títulos reales. Puentes de habilidades reales. Elige el que más se acerque a tu trayectoria.
Ingeniero/a de Procesamiento de Lenguaje Natural
Benchmark de proveedores MT es una habilidad típica de NLP en empresas que dependen de localización a escala.
Este proyecto afina
- mt-evaluation
- human-evaluation
- benchmark-design
Product Manager de IA
Decidir vendor por análisis coste-calidad es trabajo cotidiano del PM de IA en producto multilingüe.
Este proyecto afina
- cost-analysis
- mt-evaluation
- benchmark-design
Arquitecto/a de Soluciones de IA
Recomendar arquitectura por par con criterios objetivos es la habilidad central del rol.
Este proyecto afina
- mt-evaluation
- cost-analysis
- bleu-evaluation