Cайт веб-разработчика, программиста Ruby on Rails ESV Corp. Екатеринбург, Москва, Санкт-Петербург, Новосибирск, Первоуральск

Нейросети сделали то, на что способны были всего 7 человек за всю историю математики

Впервые за всю историю Международной математической олимпиады искусственный интеллект набрал максимально возможные 42 балла. Раньше идеальный результат удавалось показать лишь нескольким школьникам в мире, а теперь такого же уровня достигли сразу несколько языковых моделей. Событие может стать одной из самых заметных вех в развитии систем, способных рассуждать и решать сложные задачи без подсказок человека.

Первыми о результате сообщили китайские компании Huawei и Xiaohongshu. Обе заявили, что их модели получили по 42 балла из 42 на заданиях Международной математической олимпиады 2026 года. Решения проверялись по тем же критериям, что и работы участников соревнования.

Международная математическая олимпиада считается самым престижным школьным соревнованием по математике. Каждый год в ней участвуют лучшие молодые математики со всего мира, причём возраст участников не может превышать 20 лет. В 2026 году олимпиаду принимал Шанхай, а в соревновании выступили 666 человек.

Максимальный результат смогли показать всего семь участников. До нынешнего года ни одна большая языковая модель не проходила официальную проверку олимпиады с идеальным итогом. В 2025 году системы нескольких ведущих компаний впервые добрались до уровня золотой медали, однако всё равно уступили пяти школьникам, которые решили абсолютно все задачи без единой ошибки.

Huawei сообщила, что система Celia успешно справилась с заданиями по нескольким разделам математики и продемонстрировала устойчивые навыки решения задач разного типа. Xiaohongshu впервые отправила на олимпиаду собственную модель dots-note-3.0 и также получила максимальную оценку.

Организаторы заранее предусмотрели правила, исключающие преимущества перед людьми. Компании получили тексты задач только после того, как школьники завершили экзамен. На поиск решений отводилось ограниченное время, а вмешательство человека в работу моделей полностью запрещалось. Готовые ответы передавались организаторам олимпиады, которые проверяли их по обычной процедуре.

Прогресс оказался особенно заметным на фоне предыдущих лет. Во время олимпиады 2024 года одна из ведущих моделей смогла решить лишь четыре задачи из шести. Для работы потребовалось два-три дня, а итоговый результат соответствовал серебряной медали. Всего через два года несколько современных моделей уже укладываются в установленный регламент и безошибочно решают весь комплект заданий.

Похожие результаты получили и другие разработчики, хотя официальные объявления ещё продолжают появляться. Инвестор Deedy Das рассказал, что передал задачи нынешней олимпиады сразу четырём современным моделям. Системы OpenAI, Anthropic, Axiom Math и китайской Moonshot AI также набрали по 42 балла из 42.

Получается, что Международная математическая олимпиада перестала быть пределом возможностей для самых сильных языковых моделей. Задачи, которые десятилетиями считались испытанием для выдающихся школьников, теперь успешно решают сразу несколько систем без помощи человека. Следующим ориентиром для разработчиков, вероятно, станут математические задачи более высокого уровня, где пока ещё сохраняется заметный разрыв между искусственным интеллектом и профессиональными исследователями.

SecurityLab