Mejora de la base tecnológica para el euskera y transferencia al occitano

29 septiembre, 2026 By

En el último año del proyecto LINGUATEC-IA la maquinaria de todos los desarrollos está en plena marcha, incluidos los relativos al euskera.

En cuanto al euskera, “podríamos diferenciar dos trabajos —explica Aitzol Astigarraga, coordinador de Orai NLP (Elhuyar)—. Por un lado, hemos mejorado la base tecnológica para la transcripción y la síntesis de voz. En la transcripción, hemos incluido terminología especial para conseguir un mejor reconocimiento de nombres propios, toponimias, etc. Y en cuanto a la síntesis de voz, hemos trabajado en voces que expresan emociones”.

Ahora, el objetivo es acabar esos trabajos en primer lugar para el euskera y, “a partir de ahí, transferir esa tecnología a otras lenguas”, explica Astigarraga.

El investigador también señala que están trabajando en otro trabajo más ligado a la investigación: “En colaboración con el Centro HiTZ de la EHU, hemos aplicado al occitano dos metodologías de desarrollo de LLMs en euskera, y ahora estamos evaluando los resultados de estos dos métodos. Con el sistema que proporcione el mejor resultado desarrollaremos una demo”. Por tanto, la transferencia al occitano del trabajo de investigación realizado en este campo para el euskera será una gran aportación.