La Olimpiada Internacional de Matemáticas (IMO) 2026, considerada la competencia matemática más difícil para estudiantes de secundaria, acaba de concluir con un resultado histórico: cuatro sistemas de inteligencia artificial lograron puntuación perfecta de 42/42.
Los modelos que resolvieron exitosamente todos los problemas fueron: Claude Fable 5 (Anthropic), GPT 5.6 Sol (OpenAI), Kimi K3 (Moonshot AI) y Axiom Math. Cada uno demostró capacidades de razonamiento matemático que superan ampliamente el nivel de los mejores estudiantes del mundo.
Claude Fable 5 fue el más destacado: resolvió todos los problemas en solo un intento y fue el más rápido, completando la competencia en menos de 4 horas. GPT 5.6 Sol necesitó un intento adicional pero fue el más eficiente en costo. Kimi K3 logró la puntuación perfecta pero requirió 4 intentos adicionales y consumió una cantidad significativa de tokens.
El caso de Axiom Math es particularmente notable: no solo resolvió los problemas, sino que demostró formalmente todas las soluciones en Lean, un lenguaje de programación para verificación de teoremas. Esto significa que las soluciones no solo son correctas, sino que están matemáticamente probadas de manera rigurosa.
Los problemas P3 y P6 resultaron ser los más difíciles, según el número de intentos y tokens utilizados. Los estudiantes humanos tuvieron 9 horas para resolver los 6 problemas, mientras que los modelos de IA completaron la tarea en menos de 4 horas.
Este resultado marca un hito significativo en el desarrollo de la inteligencia artificial: la frontera de la IA ha superado oficialmente el nivel de las olimpiadas matemáticas, una de las competencias intelectuales más exigentes para jóvenes talentos.
La IA supera el nivel humano en la Olimpiada Internacional de Matemáticas 2026
