Europa tiene 24 lenguas oficiales.
Durante décadas, esa diversidad se ha entendido principalmente como una cuestión cultural, educativa, administrativa y política. Se traducen leyes, se protegen lenguas, se financia su enseñanza y se garantiza que un ciudadano pueda relacionarse con las instituciones europeas en su propio idioma.
Pero la inteligencia artificial introduce una pregunta diferente.
¿Qué significa proteger una lengua cuando una parte creciente del conocimiento empieza a estar mediada por modelos de lenguaje?
El desarrollo de modelos de lenguaje europeos abre la posibilidad de que esa diversidad deje de ser únicamente algo que proteger y se convierta también en una infraestructura tecnológica sobre la que construir.
Una lengua es algo más que palabras
Un modelo de lenguaje no contiene simplemente un diccionario.
Aprende relaciones entre conceptos, expresiones, estructuras, referencias culturales y formas de construir significado. Y esa cuestión importa porque las lenguas no son únicamente diferentes maneras de expresar una misma realidad.
También contienen maneras distintas de organizarla.
Hay conceptos difíciles de trasladar exactamente de una lengua a otra. Referencias históricas que adquieren significados diferentes. Formas particulares de expresar cortesía, duda, autoridad, humor o proximidad.
Por eso, cuando un modelo funciona extraordinariamente bien en una lengua y razonablemente bien en otra, la diferencia no es únicamente técnica.
Puede convertirse también en una diferencia de acceso.
El riesgo de una inteligencia artificial traducida
Gran parte del desarrollo tecnológico global se ha producido alrededor del inglés. No resulta extraño: existe una enorme cantidad de contenido digital disponible en esa lengua.
El reto aparece cuando se asume que desarrollar inteligencia artificial en inglés y traducir posteriormente sus resultados equivale a construir inteligencia artificial verdaderamente multilingüe.
No necesariamente.
Traducir una respuesta no es exactamente lo mismo que construir conocimiento desde una lengua.
Europa conoce especialmente bien esta diferencia. La Unión Europea tiene 24 lenguas oficiales y más de 60 lenguas regionales o minoritarias. Su diversidad lingüística, que durante mucho tiempo pudo parecer una dificultad operativa frente a mercados lingüísticamente más homogéneos, podría convertirse ahora en un interesante laboratorio tecnológico.
¿Y si la fragmentación fuera una ventaja?
Tal vez el desarrollo de modelos de lenguaje europeos no deba consistir únicamente en competir por construir el modelo más grande.
Podría competir por construir la mejor infraestructura lingüística abierta.
Modelos, conjuntos de datos, sistemas de evaluación y herramientas capaces de funcionar con profundidad en español, portugués, alemán, francés, italiano, polaco, griego, finés o maltés, pero también progresivamente en lenguas regionales y minoritarias.
Y, sobre todo, hacerlo de manera abierta.
Esto permitiría que universidades, administraciones, empresas y desarrolladores no tuvieran que empezar desde cero ni depender exclusivamente de modelos propietarios desarrollados fuera de Europa.
La infraestructura sería común; las aplicaciones podrían ser innumerables.
Algo parecido a una capa lingüística pública sobre la que construir servicios privados, investigación, educación, administración digital o nuevas empresas tecnológicas.
Modelos de lenguaje europeos como infraestructura común
La idea no pertenece únicamente al terreno teórico.
Proyectos europeos como EuroLLM trabajan ya con modelos abiertos capaces de operar en las 24 lenguas oficiales de la Unión. OpenEuroLLM busca desarrollar una familia de modelos abiertos y transparentes con una fuerte orientación multilingüe. Y ALT-EDIC está construyendo infraestructura común alrededor de datos y tecnologías lingüísticas.
En 2026, además, la Comisión Europea seleccionó al consorcio EUROPA para desarrollar un modelo abierto de frontera que cubra las 24 lenguas oficiales.
Las piezas empiezan, por tanto, a existir.
La cuestión interesante es qué se decide construir con ellas.
No necesariamente 24 inteligencias artificiales
Aquí aparece una distinción importante.
Defender la diversidad lingüística no significa necesariamente entrenar 24 grandes modelos completamente independientes.
Probablemente tendría más sentido construir arquitecturas comunes capaces de compartir conocimiento entre lenguas y, al mismo tiempo, desarrollar datos, evaluaciones y especializaciones suficientemente profundas para cada una de ellas.
La ambición no debería ser que una inteligencia artificial pueda responder en maltés, estonio o portugués.
Debería ser que pueda desenvolverse en esas lenguas sin tratarlas como versiones secundarias de otra.
Ese matiz cambia bastante la conversación.
De la soberanía tecnológica a la soberanía cognitiva
Se habla mucho de soberanía tecnológica europea: chips, centros de datos, cloud, supercomputación o modelos fundacionales.
Pero quizá exista otra capa menos visible.
La soberanía cognitiva.
No entendida como aislamiento tecnológico ni como rechazo a modelos desarrollados en otros lugares, sino como la capacidad de una sociedad para conservar herramientas propias con las que representar, procesar y transmitir su conocimiento.
Porque si los modelos de lenguaje terminan convirtiéndose en una interfaz habitual entre las personas y la información, las lenguas que estén mejor representadas en ellos tendrán también una posición diferente en la economía digital.
En ese escenario, disponer de modelos de lenguaje europeos abiertos deja de ser solamente una cuestión de competitividad.
También puede convertirse en una forma de infraestructura cultural.
La paradoja europea
Durante años, la diversidad lingüística europea se ha percibido en ocasiones como una complejidad: más traducción, más regulación, más coordinación y mercados digitales más fragmentados.
La inteligencia artificial permite observar exactamente la misma característica desde otro ángulo.
Europa posee décadas de documentación multilingüe, instituciones acostumbradas a trabajar simultáneamente en numerosas lenguas, universidades especializadas, infraestructuras de supercomputación y una enorme diversidad cultural concentrada en un espacio político común.
Quizá aquello que parecía una desventaja sea precisamente el activo.
Porque la próxima competición tecnológica no tendrá que decidir únicamente quién construye los modelos más grandes.
También tendrá que decidir qué lenguas, qué conocimiento y qué formas de comprender el mundo consiguen habitar dentro de ellos.
Y pocas regiones tienen tanto que aportar a esa pregunta como Europa.