LATAM-GPT: el primer modelo de lenguaje para Latinoamérica creado en Chile

Tiempo de lectura: 20 minutos
Redacción CienciaEnChile
Somos un medio de comunicación y una agencia nacional de difusión y divulgación de ciencia. Estamos comprometidos con la difusión de una variedad de proyectos respaldados por ANID y diversas fuentes de financiamiento.

Compartir publicación

El pasado 10 de febrero fue el lanzamiento oficial del modelo de lenguaje LATAM-GPT impulsado por el Centro Nacional de Inteligencia Artificial (Cenia) junto a la colaboración de organismos internacionales de la región. Su objetivo es mitigar los sesgos culturales y lingüísticos presentes en los datasets tradicionales y ofrecer una herramienta que represente de manera más precisa la identidad y realidad latinoamericana.

Latam-GPT surge de una alianza público-privada liderada por el Estado de Chile y Cenia, con la participación de universidades nacionales e internacionales, centros de investigación y organismos mundiales como el Banco de Desarrollo de América Latina y el Caribe (CAF), además de más de 50 alianzas técnicas en 15 países de la región.

El modelo fue entrenado con aproximadamente 18 terabytes de información en español, portugués e inglés, equivalente a millones de libros, lo que permite desarrollar aplicaciones capaces de comprender modismos, jergas y contextos locales. Así, se busca fortalecer la soberanía tecnológica regional y evitar que América Latina sea únicamente usuaria pasiva de innovaciones externas.

El proyecto contó con una financiación inicial cercana a 550.000 dólares, aportados principalmente por la CAF y recursos propios, junto con colaboraciones de distintas entidades. Su primera versión se desarrolló utilizando la infraestructura en la nube de Amazon Web Services (AWS). A futuro, se proyecta continuar el entrenamiento en un supercomputador, valorado en casi 5 millones de dólares, que será instalado en el 2026 en la Universidad de Tarapacá, en el norte del país.

El lanzamiento oficial se celebró en una ceremonia junto al presidente Gabriel Boric el pasado 10 de febrero, ad portas de entregar su mandato en marzo de este año, en el estudio 4 de Televisión Nacional de Chile. También estuvieron presentes el ministro de Ciencia, Tecnología, Conocimiento e Innovación, Aldo Valle; el ministro (s) del Trabajo y Previsión Social, Claudio Reyes; el director del Centro Nacional de Inteligencia Artificial (CENIA), Álvaro Soto; el Ejecutivo Especialista en Ciudades Inteligentes y Desarrollo Digital de CAF, Marcelo Faccina; el jefe de Tecnología de Amazon Web Service, Rafael Mattje y el director Ejecutivo de Data Observatory (DO), Rodrigo Roa.

 

Un modelo base, no un chatbot comercial

Investigaciones sobre IA geográfica y datasets multimodales confirman que los conjuntos de datos usados para entrenar tareas de IA están fuertemente sesgados hacia países como Estados Unidos, Reino Unido y Canadá. En contraste, la representación de regiones como América Latina y África es significativamente menor. Artículos en la revista Nature y en portales de análisis de Inteligencia Artificial (IA) resaltan una limitación de los Grandes Modelos de Lenguaje (LLM) para comprender contextos culturales poco representados en sus datos de entrenamiento. Esto resulta en errores o respuestas incompletas, especialmente al abordar historia o matices culturales ajenos al ámbito anglosajón.

Latam-GPT no es un chatbot de acceso directo para el público general ni una aplicación comercial. Tampoco busca competir en razonamiento general con los grandes modelos desarrollados por corporaciones tecnológicas globales. Su propósito es servir como infraestructura base de inteligencia artificial con identidad latinoamericana, sobre la cual universidades, gobiernos, startups y empresas puedan construir soluciones adaptadas a los contextos culturales, lingüísticos e históricos de la región.

Álvaro Soto, director de Cenia, señaló en Radio Cooperativa que el modelo apunta a ser eficiente en términos de procesamiento, permitiendo aplicaciones prácticas sin depender exclusivamente de infraestructuras masivas extranjeras. Asimismo, destacó que un desarrollo local facilita un mayor control sobre la privacidad y la gestión de datos sensibles, aspecto especialmente relevante para su implementación en servicios públicos y sistemas estatales.

 

Política Nacional de Inteligencia Artificial

Este lanzamiento se enmarca en los objetivos de la Política Nacional de Inteligencia Artificial de Chile, creada en 2021 y actualizada recientemente en 2024 para adaptarse a los avances de la IA generativa. Su plan de acción es la hoja de ruta estratégica del Estado para guiar el desarrollo, la adopción y el uso ético de esta tecnología en el país. Fue impulsada por el Ministerio de Ciencia, Tecnología, Conocimiento e Innovación (MinCiencia), tras un extenso proceso de participación ciudadana, mesas técnicas de expertos y consultas públicas.

La política se estructuró para potenciar infraestructura en supercomputación y conectividad, además de fomentar el talento humano y la alfabetización digital en la población. Con ello se pretende desarrollar la investigación científica en IA, promover su uso en el sector productivo y en los servicios públicos para mejorar la eficiencia y la calidad de vida. Otro de sus ejes es procurar que la IA se utilice de forma responsable, protegiendo la privacidad de los datos, evitando sesgos y asegurando que siempre haya una supervisión humana.

Sus principales acciones han sido la formación del Centro Nacional de Inteligencia Artificial (Cenia) para ser el motor de la investigación y el desarrollo de proyectos como el Índice Latinoamericano de Inteligencia Artificial (ILIA). Asimismo la tramitación de un proyecto de ley, actualmente en discusión en el Congreso, que busca regular los sistemas de IA según su nivel de riesgo, siguiendo estándares internacionales como los de la Unión Europea. Esta política ha posicionado a Chile como un líder en la región según el Índice Latinoamericano de IA, destacando especialmente en las áreas de infraestructura y gobernanza.

Índice Latinoamericano de Inteligencia Artificial

Indicelatam.cl es la página oficial del Índice Latinoamericano de Inteligencia Artificial (ILIA),  un informe que presenta una medición cuantitativa y cualitativa del desarrollo de IA en países latinoamericanos y caribeños. Proporciona datos, análisis, rankings y ofrece informes descargables sobre el ecosistema de IA en cada uno de los 19 países que lo integran según tres dimensiones evaluadas: Factores habilitantes, I+D+A (Investigación, Desarrollo y Adopción) y Gobernanza.

La primera dimensión analiza indicadores como infraestructura digital, disponibilidad de datos, talento humano capacitado, y conectividad (internet, redes modernas), que son necesarios para que la IA pueda desarrollarse. La dimensión I+D+A (Investigación, Desarrollo y Adopción) evalúa la producción científica en IA, el desarrollo de tecnologías y códigos abiertos, la adopción de soluciones de IA en sectores productivos y la innovación académica y empresarial. Por último, la dimensión de gobernanza analiza las políticas públicas en IA, sus marcos regulatorios, estrategias nacionales, supervisión y reglas para uso responsable de IA.

El índice jerarquiza a los países según un puntaje global, construido a partir de las dimensiones mencionadas y el puntaje total se basa en cómo esos valores se combinan. No es un ranking económico general, sino uno específico de IA. Este proyecto colaborativo funciona además como un repositorio de los principales avances de cada país en materia de IA y se espera que la información recopilada pueda desplegarse de manera sostenible para el desarrollo tecnológico que Latinoamérica lanza al mundo.

 

Compartir publicación

Etiquetas de esta publicación

Artículos
relacionados