De un tiempo a esta parte, la Inteligencia Artificial es mucho más que una gigantesca enciclopedia donde resolver cualquier duda que tengamos. Conforme esta ha ido avanzando, se han introducido mejoras en el razonamiento, que le permite analizar diferentes fuentes para encontrar la solución más correcta en cada caso aplicable a prácticamente cualquier ámbito.
Una muestra de cómo ha evolucionado el funcionamiento de la IA en los últimos años lo encontramos en la medalla de oro que ha ganado Gemini con Deep Thinking activado, en la Olimpiada Internacional de Matemáticas que se celebra todos los años desde 1959 donde participan prácticamente todos los países con 6 matemáticas preuniversitarios que compiten para resolver 6 problemas en álgebra, combinatoria, geometría y teoría de números.
Razonamiento matemático de Gemini
Es importante señal que tan solo del 8% de todos los participantes, consiguen ganar la medalla de oro, un logro que ha conseguido Gemini, superando el resultado obtenido el año anterior con AlphaProof y AlphaGeometry 2 de DeepMind. En 2024, la IA de DeepMind fue capaz de resolver 4 de los 6 ejercicios planteados, mientras que, con Gemini ha conseguido resolver de forma correcta 5 de los 6 ejercicios lo que le ha permitido obtener la medalla de oro obteniendo un total de 35 puntos sobre 42 posibles.
Según afirma, Gregor Dolinar, presidente de la Olimpiada Internacional de Matemáticas
Podemos confirmar que Google DeepMind ha alcanzado el hito tan deseado, ganando 35 de 42 puntos posibles: una puntuación de medalla de oro. Sus soluciones fueron asombrosas en muchos aspectos. Los evaluadores de la OMI los encontraron claros, precisos y la mayoría de ellos fáciles de seguir.
La mejora en el rendimiento de la IA de Google, no solo se ha demostrado al ser capaz de resolver correctamente 5 de 6 preguntas, sino también en el tiempo empleado para hacerlo. En la prueba de 2024, que invitaba a traducir problemas de lenguaje natural a otros lenguajes como Lean, AlphaGeometry 2 y AlphaProof empleado entre 2 y 3 días de cómputo.
La versión más avanzada de razonamiento de Gemini tan solo ha tardado 4,5 horas en realizar los ejercicios que se han presentado este año. Según afirman Google, la sustancial mejora de rendimiento de Gemini con respecto a las versiones de 2024, se deben a las nuevas técnicas de aprendizaje con refuerzo que puede aprovechar más datos de razonamiento de varios pasos para la resolución de problemas y demostración de teoremas.
Google DeepMind colabora estrechamente con la comunidad de matemáticos afirmando que todavía falta mucho camino por recorrer ya que solo estamos al principio de lo que puede ser capaz de hacer especialmente Gemini, ya que recordemos, la IA de Google, no es la única que incorpora un sistema de razonamiento matemático. Open AI, que también se presentó al concurso, también fue capaz de resolver 5 de los 6 ejercicios propuestos, aunque la mejor nota se la llevó Gemini de Google, Además, tardo mucho más tiempo en realizar los cálculos necesario para resolver los problemas.
En base al ritmo al que está evolucionando la Inteligencia Artificial, especialmente en la resolución de problemas matemáticos en diferentes campos, dentro de poco estos serán capaces de encontrar la solución problemas que, a día de hoy, siguen sin solución utilizando lenguaje natural que cualquier experto pueda entender.
La capacidad de razonamiento de Gemini en su versión más potente está disponible a través del plan Gemini Ultra, el plan más caro de todos y que tiene un coste de 249,99 dólares al mes. Esto significa que las 4,5 horas que ha tardado en resolver los ejercicios pueden haber costado unos cuantos miles de dólares.
