OpenAI оголосила про випуск нової версії GPT-5, яка буде використовуватись у її AI-кодовому агенті Codex. Нову модель, звану GPT-5-Codex, компанія описує як таку, що більше динамічно витрачає свій «розумовий» час в порівнянні з попередніми версіями. Вона може витратити від декількох секунд до семи годин на виконання завдання з програмування, що дозволяє їй досягати кращих результатів у тестах з агентного програмування.
OpenAI запускає GPT-5-Codex
Ця нова модель вже з’явилася в продуктах Codex, доступних через термінал, IDE, GitHub або ChatGPT, для всіх користувачів ChatGPT Plus, Pro, Business, Edu та Enterprise. В OpenAI також повідомляють, що планують зробити модель доступною для клієнтів API в майбутньому.
Це оновлення є частиною зусиль OpenAI зробити Codex більш конкурентоспроможним з іншими продуктами штучного інтелекту в сфері програмування, такими як Claude Code, Cursor від Anysphere або GitHub Copilot від Microsoft. Ринок інструментів для програмування на основі AI став значно більш насиченим за останній рік через високу потребу користувачів. Cursor досягла понад 500 мільйонів доларів річного доходу, а Windsurf, аналогічний редактор коду, став об’єктом хаотичної спроби придбання, внаслідок чого його команда розділилася між Google і Cognition.
OpenAI зазначає, що GPT-5-Codex перевершує GPT-5 на SWE-bench Verified, тесті, що оцінює агентне програмування, а також на тестах продуктивності в задачах рефакторингу коду з великих, відомих репозиторіїв.
Компанія також повідомила, що навчила GPT-5-Codex для проведення рев’ю коду, залучивши досвідчених програмістів для оцінювання коментарів моделі. Інженери відзначили, що GPT-5-Codex генерує менше помилкових коментарів та надає більше «коментарів з високим впливом».
У прес-брифінгу керівник продукту Codex OpenAI Олександр Ембірікос повідомив, що багато з прискорення продуктивності зумовлено динамічними «мисленнєвими можливостями» GPT-5-Codex. Користувачі можуть бути знайомі з маршрутизатором GPT-5 у ChatGPT, який направляє запити до різних моделей в залежності від складності завдання. Ембірікос зазначив, що GPT-5-Codex діє подібно, але не має маршрутизатора під капотом і може в реальному часі коригувати час, який потрібно витратити на завдання.
Він підкреслив, що це є перевагою в порівнянні з маршрутизатором, який на початку вирішує, скільки обчислювальних ресурсів та часу використовувати для розв’язання проблеми. Натомість, GPT-5-Codex може зрозуміти через п’ять хвилин, що потрібно витратити ще годину. Ембірікос також зазначив, що бачив модель, яка витрачала понад сім годин у деяких випадках.