Tecnología

La Inteligencia Artificial alcanza, por primera vez, la calificación máxima en la Olimpiada Internacional de Matemáticas

En una primicia histórica, un algoritmo de inteligencia artificial obtuvo la calificación perfecta en la Olimpiada Internacional de Matemáticas (OIM), una competición reconocida como la más prestigiosa a nivel global para jóvenes prodigios de la materia, donde hasta la fecha únicamente un reducido número de participantes humanos había conseguido la puntuación ideal. El hito fue logrado por los equipos de investigación de las compañías chinas Huawei y Xiaohongshu, también conocida como RedNote, que resolvieron íntegramente los problemas propuestos en la edición reciente del certamen, celebrada en Shanghái.

Aunque en esta ocasión los reconocimientos fueron otorgados a los mencionados laboratorios de IA, se anticipa que en los próximos días otros equipos revelarán sus resultados y que más modelos alcanzarán este histórico logro.

La IA iguala las destrezas matemáticas de las mentes más destacadas

La primera en anunciar la hazaña fue la empresa Xiaohongshu, que en un comunicado difundido esta semana manifestó: «Nos llena de satisfacción este logro, pues conseguir una puntuación perfecta en la OIM es una tarea sumamente exigente«.

«Hasta la fecha, ninguno de los grandes modelos de lenguaje había conseguido jamás una puntuación perfecta bajo el riguroso proceso de evaluación oficial de la OIM», añadió la compañía, aludiendo a la tecnología que sustenta herramientas de IA como los chatbots.

En la edición de este año, que tuvo lugar del 10 al 21 de julio, compitieron 666 estudiantes procedentes de 117 naciones.

Este éxito representa un avance significativo respecto a 2025, cuando modelos desarrollados por firmas como Google y OpenAI lograron por primera vez un desempeño equiparable a una medalla de oro. No obstante, en aquella ocasión no pudieron igualar a los cinco concursantes humanos que obtuvieron la puntuación perfecta.

En la presente edición, participaron 666 estudiantes de diversas naciones. Según el marcador oficial de la OIM, únicamente siete competidores alcanzaron la puntuación máxima. La competición se celebra anualmente en distintas sedes y está dirigida a participantes menores de 20 años.

Huawei comunicó el miércoles que su sistema de IA, denominado Celia, evidenció «capacidades integrales para la resolución de problemas» en varias ramas de las matemáticas. Por su parte, Xiaohongshu informó que su modelo dots-note-3.0 participó por primera vez en la evaluación de la OIM. Como parte del proceso oficial, las empresas recibieron los ejercicios únicamente después de que los concursantes humanos concluyeran el examen y debieron presentar sus respuestas dentro de un plazo establecido.

La evolución de los sistemas de IA

El progreso de estas tecnologías se evidenció al compararse con la edición de 2024, cuando Google obtuvo un resultado equiparable a una medalla de plata después de resolver cuatro de los seis problemas en un lapso de entre dos y tres días.

En la edición más reciente, correspondiente a 2025, la IA ya mostraba una mejora sustancial. Los modelos de Google y OpenAI alcanzaron un desempeño comparable al de una medalla de oro en la OIM.

Aunque no compitieron como participantes oficiales, ambas compañías sometieron sus algoritmos a los mismos retos empleados en la edición actual de la OIM para determinar hasta qué punto podían replicar el razonamiento de los alumnos más sobresalientes del certamen.

Según informó la agencia Reuters en su momento, tanto Google como OpenAI emplearon modelos de razonamiento de propósito general capaces de resolver ejercicios mediante lenguaje natural. A diferencia de sistemas anteriores, que dependían de lenguajes matemáticos especializados y métodos de cálculo formal, estos modelos son capaces de interpretar y desarrollar soluciones a partir de enunciados redactados en lenguaje corriente.

Google presentó Gemini Deep Think, un modelo que consiguió resolver los problemas dentro del límite oficial de 4,5 horas. OpenAI, por su parte, no participó oficialmente en la evaluación, pero comunicó que su modelo experimental también alcanzó un nivel equiparable a una medalla de oro. La empresa explicó que el sistema logró ese desempeño gracias a un aumento notable de la capacidad de cómputo durante la prueba, lo que le permitió «pensar» durante más tiempo y ejecutar razonamientos en paralelo de forma simultánea.

Fuente: Ambito.com

Comentarios de Facebook

Publicaciones relacionadas

Botón volver arriba