«Може думати до семи годин»: OpenAI оновила Codex новою версією GPT-5
OpenAI випустила нову версію GPT-5 для свого ШІ-агента програмування Codex.

Що таке GPT-5-Codex і чим він відрізняється
Нова модель отримала назву GPT-5-Codex. Головна відмінність від попередніх моделей — це динамічний підхід до часу виконання завдань: від кількох секунд до семи годин. Завдяки цьому модель суттєво підняла результати на агентних бенчмарках.
Наразі модель поступово впроваджується в продукти Codex — через термінал, IDE, GitHub або ChatGPT, і вже доступна користувачам ChatGPT Plus, Pro, Business, Edu та Enterprise. У майбутньому OpenAI планує відкрити доступ і для клієнтів API.
Краща якість коду та рев’ю
За словами OpenAI, GPT-5-Codex перевершує GPT-5 у тесті SWE-bench Verified, який оцінює агентні можливості програмування, а також у завданнях із рефакторингу коду у великих репозиторіях.

Також модель навчили не лише писати код, а й робити рев’ю. Тестування за участю досвідчених інженерів показало, що GPT-5-Codex залишає менше некоректних коментарів і натомість додає більше справді корисних.

«Динамічне мислення» — головна перевага GPT-5-Codex
На брифінгу керівник продукту Codex Олександр Ембірікос зазначив, що значна частина приросту продуктивності стала можливою завдяки динамічним «здатностям до роздумів» GPT-5-Codex. Користувачі могли вже помічати в ChatGPT роутер GPT-5, який перенаправляє запити до різних моделей залежно від складності завдання. За словами Ембірікоса, GPT-5-Codex працює схожим чином, але без роутера «під капотом» — і може самостійно визначати, скільки часу витратити на задачу в реальному часі.
За словами керівника продукту Codex, Олександра Ембірікоса, секрет полягає у «динамічному мисленні». На відміну від роутера GPT-5, який одразу визначає, скільки ресурсів виділити на задачу, GPT-5-Codex може змінювати рішення на ходу, наприклад, через кілька хвилин вирішити, що потрібна ще година роботи. У деяких випадках модель працювала над одним завданням понад сім годин.
Таким чином OpenAI прагне закріпити за собою лідерство, а GPT-5-Codex може стати ключовим фактором у цій битві.
1 коментар
Додати коментар Підписатись на коментаріВідписатись від коментарівУчитывая что после 4 мин раздумий в среднем success rate уже ниже 50%...