Моделі штучного інтелекту від OpenAI та Google DeepMind отримали золоті медалі на Міжнародній математичній олімпіаді 2025 року (IMO), яка є однією з найстаріших та найскладніших математичних конкурсів для школярів, про що компанії оголосили окремо в останні дні.
Ці результати підкреслюють швидкість розвитку систем штучного інтелекту, а також вказують на те, що Google та OpenAI приблизно на одному рівні у змаганні за лідерство в цій галузі. Компанії змагаються за громадську думку щодо того, хто попереду у цій гонитві, адже це може мати великий вплив на залучення топових талантів у сфері AI. Багато дослідників у цій галузі мають досвід у конкурентній математиці, тому такі змагання, як IMO, мають особливу вагу.
Минулого року Google отримав срібну медаль на IMO, використовуючи «формальну» систему, що вимагала від людей перекладати задачі в формат, зрозумілий машинам. Цього року OpenAI та Google представили «неформальні» системи, які змогли отримувати питання та генерувати відповіді на основі доказів у природній мові. Обидві компанії стверджують, що їхні моделі AI правильно відповіли на п’ять із шести запитань тесту IMO, перевищивши результати більшості школярів та минулорічної моделі Google, без необхідності в будь-якому перекладі людей і машин.
У коментарях для одного з видань дослідники OpenAI та Google зазначили, що ці результати представляють собою прориви в моделюванні міркувань AI в неверифікованих сферах. Хоча моделі AI зазвичай добре справляються із запитаннями, відповідями на які є ясними — такими як прості математичні або програмування, — ці системи стикаються із труднощами в завданнях із більш неоднозначними варіантами, такими як покупка якісного стільця або допомога в складних дослідженнях.
Однак Google raised raises questions concerning how OpenAI conducted and announced its gold-medal IMO performance. If one plans to submit AI models to a math competition for high school students, they might as well engage in a debate like teenagers.
Незабаром після оголошення OpenAI про свій успіх у суботу вранці, генеральний директор Google DeepMind та його дослідники виступили в соціальних мережах з критикою OpenAI за те, що той заздалегідь оприлюднив інформацію про золоту медаль — одразу після того, як IMO оголосила результати конкурсу серед школярів у п’ятницю ввечері — і за те, що їхня модель не пройшла офіційну оцінку IMO.
Тхан Луан, старший дослідник Google DeepMind, який очолює проект IMO, зазначив, що Google відкладав своє оголошення результатів, щоб поважати учасників конкурсів.
Луан зазначив, що Google працює з організаторами IMO з минулого року в підготовці до тестування і хотів отримати благословення президента IMO та офіційну оцінку до оголошення своїх результатів, що воно і зробило в понеділок вранці.
«Організатори IMO мають свої критерії оцінки», — сказав Луан. «Тож будь-яка оцінка, що не базується на цих критеріях, не може стверджувати про результати на рівні золотої медалі».
Ноам Браун, старший дослідник OpenAI, який працював над моделлю для IMO, повідомив, що IMO зверталася до OpenAI кілька місяців тому з пропозицією взяти участь у формальному математичному конкурсі, але розробник ChatGPT відмовився, оскільки займається системами природної мови, які вважав більш важливими для дослідження. Браун зазначив, що OpenAI не знала, що IMO проводить неформальний тест з Google.
OpenAI повідомляє, що залучила сторонніх оцінювачів — трьох колишніх медалістів IMO, які розуміли систему оцінки — для оцінювання результатів своєї моделі. Після того як OpenAI дізналася про отриману золоту медаль, Браун заявив, що компанія зв’язалася з IMO, яка в свою чергу порекомендувала почекати з оголошенням до завершення церемонії нагородження в п’ятницю ввечері.
IMO не відповіла на запит про коментар до видання.
Google не позбавлений права в даному випадку — воно пройшло більш офіційний і суворий процес, аби отримати свою золоту медаль — але суперечка може упустити більш глобальне питання: моделі AI з кількох провідних лабораторій стрімко покращуються. Країни з усього світу відправили своїх найкращих учнів для участі в IMO цього року, і лише кілька відсотків з них досягли таких же успіхів, як моделі AI OpenAI та Google.
Хоча OpenAI раніше мала значну перевагу над галуззю, зараз здається, що змагання стало більш конкурентоспроможним, ніж будь-яка компанія хотіла б визнати. Очікується, що OpenAI випустить GPT-5 найближчими місяцями, і компанія сподівається створити враження, що все ще лідирує у галузі AI.