Última Hora
Domingo, 27 de septiembre de 2026

Inferencia

Diario Nacional de Investigación • Cobertura Territorial

Tecnología Nueva Delhi, India Internacional

El reto de la inteligencia artificial para preservar la diversidad lingüística en la India

La India impulsa el desarrollo de inteligencia artificial multilingüe para integrar sus lenguas minoritarias al entorno digital, enfrentando desafíos críticos como la escasez de datos y el riesgo de profundizar jerarquías lingüísticas.

R

Por Con información de DW Español

Mesa de Edición • Inferencia

• 2 min de lectura
Tipo:
Tamaño:
Escuchar esta noticia Audio

Edición en audio

El reto de la inteligencia artificial para preservar la diversidad lingüística en la India
El reto de la inteligencia artificial para preservar la diversidad lingüística en la India Foto: DW Español

Lo Esencial • Puntos Clave

  • La iniciativa estatal BHASHINI promueve aplicaciones de 'Edge-AI' para llevar servicios digitales a lenguas minoritarias sin depender de conexiones constantes a Internet.
  • La falta de datos estandarizados y la baja calidad de los corpus lingüísticos son los principales obstáculos técnicos identificados en un estudio de 2024.
  • Expertos advierten que la IA podría consolidar jerarquías lingüísticas si no se involucra a las comunidades locales en la recopilación y uso de los datos.

La inteligencia artificial (IA) ha demostrado una alta capacidad para procesar idiomas dominantes como el hindi y el inglés, gracias a la abundancia de datos digitales disponibles. Sin embargo, la integración de lenguas minoritarias en este ecosistema tecnológico representa un desafío complejo para la India, especialmente en regiones con conectividad limitada a Internet.

Para abordar esta brecha, la iniciativa estatal BHASHINI presentó a mediados de septiembre, junto a sus socios, los resultados de un concurso de innovación enfocado en aplicaciones de "Edge-AI". Estas herramientas buscan ejecutar IA multilingüe directamente en dispositivos móviles, ofreciendo soluciones prácticas en sectores como la agricultura, la salud, la asistencia social y el asesoramiento jurídico.

El camino hacia la inclusión digital enfrenta obstáculos técnicos y estructurales. Un estudio de 2024, que analizó 84 investigaciones sobre IA generativa y grandes modelos de lenguaje aplicados a lenguas indias, identificó la falta de datos, la ausencia de estandarización y la insuficiencia de métodos de evaluación como barreras fundamentales. Julius Haas, ingeniero eléctrico y experto en IA, subraya que la disparidad en la calidad y cantidad de los corpus de texto frente a idiomas como el inglés o el alemán es notable. "Esto vale tanto para la cantidad como para la calidad", afirma Haas, quien reside parcialmente en la India.

La sociolingüista Ariba Hidayet Khan, profesora de la Universidad de Kiel, explica que para las lenguas con escasa documentación, la IA tiene una capacidad de apoyo limitada. No obstante, en el caso de lenguas en peligro de extinción que aún cuentan con hablantes y material disponible, la tecnología podría incentivar a las nuevas generaciones a preservarlas. "Si utilizamos la IA ahora, podría contribuir a preservar la lengua durante más tiempo", señala Khan.

Instituciones como AI4Bharat, adscrita al Instituto Indio de Tecnología de Madrás, trabajan en la creación de bases de datos para traducción y síntesis de voz. Sin embargo, expertos como Haas advierten que el éxito depende de la inversión estratégica: "Ya no se necesitan avances tecnológicos fundamentales", sostiene, enfatizando que la clave reside en la asignación de recursos para infraestructura y formación.

El Informe sobre el estado de la educación en la India 2025, de la UNESCO, destaca que la lengua es un pilar de la identidad cultural, por lo que aboga por tecnologías inclusivas. A pesar de esto, existe el riesgo de que la digitalización cree nuevas jerarquías. Si los modelos se entrenan principalmente con variantes estandarizadas, los dialectos regionales podrían perder visibilidad. "La IA podría reforzar las jerarquías lingüísticas existentes", advierte Khan, quien propone que las comunidades lingüísticas participen activamente en la recopilación y gestión de sus propios datos.

Aviso de cobertura: Edición, verificación y contextualización elaborada por la Mesa de Redacción de Inferencia a partir de despachos informativos de DW Español.

I

Mesa de Redacción de Inferencia

Cobertura elaborada bajo lineamientos de rigor periodístico e imparcialidad editorial. Consulta de datos y fuentes en tiempo real.

Historias Relacionadas