«Може думати до семи годин»: OpenAI оновила Codex новою версією GPT-5

💡 Усі статті, обговорення, новини про AI — в одному місці. Приєднуйтесь до AI спільноти!

OpenAI випустила нову версію GPT-5 для свого ШІ-агента програмування Codex.

Що таке GPT-5-Codex і чим він відрізняється

Нова модель отримала назву GPT-5-Codex. Головна відмінність від попередніх моделей — це динамічний підхід до часу виконання завдань: від кількох секунд до семи годин. Завдяки цьому модель суттєво підняла результати на агентних бенчмарках.

Наразі модель поступово впроваджується в продукти Codex — через термінал, IDE, GitHub або ChatGPT, і вже доступна користувачам ChatGPT Plus, Pro, Business, Edu та Enterprise. У майбутньому OpenAI планує відкрити доступ і для клієнтів API.

Краща якість коду та рев’ю

За словами OpenAI, GPT-5-Codex перевершує GPT-5 у тесті SWE-bench Verified, який оцінює агентні можливості програмування, а також у завданнях із рефакторингу коду у великих репозиторіях.

Також модель навчили не лише писати код, а й робити рев’ю. Тестування за участю досвідчених інженерів показало, що GPT-5-Codex залишає менше некоректних коментарів і натомість додає більше справді корисних.

«Динамічне мислення» — головна перевага GPT-5-Codex

На брифінгу керівник продукту Codex Олександр Ембірікос зазначив, що значна частина приросту продуктивності стала можливою завдяки динамічним «здатностям до роздумів» GPT-5-Codex. Користувачі могли вже помічати в ChatGPT роутер GPT-5, який перенаправляє запити до різних моделей залежно від складності завдання. За словами Ембірікоса, GPT-5-Codex працює схожим чином, але без роутера «під капотом» — і може самостійно визначати, скільки часу витратити на задачу в реальному часі.

За словами керівника продукту Codex, Олександра Ембірікоса, секрет полягає у «динамічному мисленні». На відміну від роутера GPT-5, який одразу визначає, скільки ресурсів виділити на задачу, GPT-5-Codex може змінювати рішення на ходу, наприклад, через кілька хвилин вирішити, що потрібна ще година роботи. У деяких випадках модель працювала над одним завданням понад сім годин.

Таким чином OpenAI прагне закріпити за собою лідерство, а GPT-5-Codex може стати ключовим фактором у цій битві.

👍ПодобаєтьсяСподобалось5
До обраногоВ обраному0
LinkedIn
Дозволені теги: blockquote, a, pre, code, ul, ol, li, b, i, del.
Ctrl + Enter
Дозволені теги: blockquote, a, pre, code, ul, ol, li, b, i, del.
Ctrl + Enter

Учитывая что после 4 мин раздумий в среднем success rate уже ниже 50%...

Підписатись на коментарі