Відкритий AI взяв «золото» математичної олімпіади: NVIDIA виклала моделі, код і дані
Система на Nemotron 3 Ultra офіційно набрала 30 із 42 балів на IMO 2026. NVIDIA відкрила два спеціалізовані чекпойнти, навчальні дані, код і 200 нових задач.

Система NVIDIA на базі відкритої моделі Nemotron 3 Ultra офіційно набрала 30 із 42 балів на Міжнародній математичній олімпіаді 2026 — на один бал вище порога золотої медалі. Тепер команда опублікувала не лише результат, а й два спеціалізовані чекпойнти, дані, код навчання та повний рецепт пошуку доведень.
Це важливо не тому, що AI знову розвʼязав олімпіадні задачі. Закриті системи Google DeepMind і OpenAI досягли золотого рівня ще у 2025 році. Новина в іншому: цього разу дослідники отримали відтворювану основу, яку можна вивчати, перевіряти й розвивати поза однією лабораторією.
Що саме зробила система
В основі — три версії Nemotron 3 Ultra 550B-A55B: загальнодоступна модель, варіант після керованого донавчання на прикладах і варіант після навчання з підкріпленням. Вони не просто генерували багато відповідей, а виконували різні ролі: пропонували доведення, перевіряли їх, писали критику й переробляли найперспективніші спроби.
У першому раунді система створювала 384 варіанти доведення для кожної задачі — по 16 спроб від кожного з трьох чекпойнтів для восьми різних стратегій. Потім дві спеціалізовані моделі оцінювали кожну відповідь 16 разів. Доведення приймали лише тоді, коли всі 16 оцінок визнавали його повністю правильним.
- Повний бал за задачі 1, 2, 4 і 5.
- По одному балу за задачі 3 і 6.
- Підсумок — 30 із 42 за офіційним оцінюванням IMO при золотому порозі 29.
- Жодного формального доводчика, зовнішніх інструментів або доступу до інтернету під час розвʼязання.
Золото виявилося дуже дорогим
Результат не означає, що одна локальна модель миттєво розвʼязала олімпіаду. Щоб знайти шість поданих доведень, система згенерувала приблизно 707 мільйонів токенів і витратила 1 464 GPU-години на прискорювачах GB200. Повний конкурсний запуск, включно з раундами, які вже виконувалися, дійшов до 2,31 мільярда токенів і 4 800 GPU-годин.
Найкращі відповіді зʼявилися швидко: чотири повністю правильні доведення пройшли фінальний відбір за перші 76 хвилин, решта два — до 100 хвилин. Подальші обчислення майже не покращили офіційний результат. Це корисний сигнал для майбутніх систем: після певної межі додатковий пошук просто спалює ресурси.
Моделі все ще погано перевіряють самі себе
Внутрішні перевіряльники оцінили фінальні відповіді приблизно у 32 бали — на два більше за офіційних суддів. Помилка припала на задачі 3 і 6: моделі побачили в неповних доведеннях більше, ніж люди. Автори називають це спільною сліпою плямою модельної перевірки.
Тому головний урок роботи — не «генеруйте більше». Результат дали різні спеціалізовані чекпойнти, сувора перевірка, повторне доопрацювання перспективних відповідей і дорогий фінальний відбір. Водночас навіть 16 одностайних модельних оцінок не замінюють людську перевірку.
Що NVIDIA відкрила
У колекції на Hugging Face є два математичні чекпойнти, набори даних для керованого навчання й навчання з підкріпленням, код тренування та інференсу, подані на олімпіаду доведення і Nemotron-IMO-Bench. Останній містить 200 нових олімпіадних задач, створених так, щоб вони не могли опинитися в навчальних даних моделей.
«Відкритий рецепт» не означає дешевий домашній запуск. Базова модель має сотні мільярдів параметрів, а конкурсний результат вимагав тисяч GPU-годин на GB200. Відкритими стали артефакти й методика, а не доступність обчислень.
Для дослідників це все одно великий крок. Тепер можна окремо перевіряти, що дає донавчання, як поводиться модельний суддя, де зупиняти пошук і чи можна отримати близький результат меншими моделями та бюджетом. Саме така відтворюваність перетворює красиву демонстрацію на інженерну основу.
- 1An Open Recipe for IMO Gold: Training Nemotron for Olympiad Mathematics — arXiv, 9 вересня 2026
- 2Nemotron Labs IMO 2026 — Hugging Face / NVIDIA, вересень 2026
- 3Nemotron-IMO-Bench — Hugging Face / NVIDIA, вересень 2026
Щотижневий дайджест — у вашій пошті
Один лист на тиждень: головне зі світу AI українською. Без спаму, відписка одним кліком.




Коментарі 0