GPT-5 вже тут! Розбираємо, що цікавого
OpenAI щойно релізнули нову версію свого флагманського продукту — GPT-5.
У ній компанія поєднала сильні сторони попередніх моделей: здатність працювати з різними типами інформації — текстом, зображеннями, кодом — і логіку, яка раніше була притаманна лише o-серії моделей.
Розробники роблять особливий акцент на двох ключових напрямках: глибокому програмуванні з мінімальними підказками та розширених агентських можливостях. Модель краще орієнтується в неоднозначних завданнях, розуміє контекст і здатна діяти самостійно, як повноцінний цифровий помічник.
«Це настільки вражаючий досвід, що повертатися до старих моделей уже не хочеться. Якщо GPT-3 нагадував школяра, а GPT-4 — студента коледжу, то GPT-5 схожий на експерта з докторським ступенем», — сказав Сем Альтман
Бенчмарки
В OpenAI стверджують, що GPT‑5 вирішує всі математичні задачі в сучасних бенчмарках, показує прорив у структурованому мисленні та логічному аналізі, а ще рідше «вигадує» факти.


Гортайте вбік, щоб подивитися всі зображення
Модель відкрито визнає, коли не знає відповіді, що робить взаємодію з нею більш прозорою й передбачуваною. Навчання GPT‑5 проводилося на даних, актуальних станом на жовтень 2024 року, тож вона краще орієнтується в реаліях сьогодення.
Новий інтелектуальний маршрутизатор
Одна з найбільш непомітних, але потужних змін — це інтелектуальний маршрутизатор всередині GPT‑5.
Він самостійно вирішує, яка версія моделі краще впорається із завданням: «mini» для легких запитів, «deep thinking» — для складних, і перемикається між ними автоматично, без втручання користувача.
Ви можете впливати на це вручну — наприклад, просто написавши «подумай довше» або «зроби швидко».
GPT‑5 для коду, текстів, ігор
Модель відчутно краще справляється з генерацією фронтенду, HTML/JS, іграми, адаптивним дизайном і типографікою. У довгих запитах GPT-5 краще тримає структуру, не губиться в контексті, а її тексти мають більш чіткий стиль, ритм і логіку.

Доступність
GPT-5 стане доступною всім користувачам ChatGPT, як безплатним, так і Pro-передплатникам. Водночас для безплатного рівня діятиме ліміт на кількість запитів: після його вичерпання система автоматично перемикатиметься на простішу модель. Відтепер GPT-5 — основна модель, яку використовує ChatGPT за замовчуванням.
Для розробників через API будуть доступні три варіанти GPT-5: повнофункціональна версія, GPT-5 mini та GPT-5 nano — кожна з них має власну ціну залежно від можливостей.
Користувачі тарифних планів Team, Enterprise та Edu також незабаром отримають доступ до розширеної версії GPT‑5 Pro.
Зміна кольорів чату
Головна новинка цього оновлення — це можливість змінити колір чату. Нарешті те, на що ми так довго чекали :)

Ось, до речі, презентація на YouTube-каналі OpenAI 👇
Як вам загалом оновлення? Вартувало своїх очікувань?
79 коментарів
Додати коментар Підписатись на коментаріВідписатись від коментарівGPT-5 краще, для генерації текстів я це перевірив в роботі багато разів, для програмування я не тестував, я вже давно користуюся платним Gemini.
Погіршилась генерація картинок і ліміт зменшився. Gemini ж навпаки — став генерувати пристойні результати та швидше і більше
В чисто «побутовому користуванні» не помітив різниці з 4м. Може не так довго думає, хіба що.
GPT-5 це жахливо, огидно, тупо, нестерпно . Якщо 4о шось там вигадував і писав адекватний код, то цей в обох режимах і коли лізе в думання і коли швидка відповідь — занадто опирається на мій контекст, занадто оверінжинірить. Ніби зєднали з о3 — тепер як в першому жпт — сприймає мої слова буквально, сприймає як тупа машина
Троха тупенький. Кажу йому про ассоціативний ряд, маленьки ніжки, дівчата, збільшення грудей, нівяку. Якісь ніжки буша, ікра і тд. Але будь хто здогадається що маленьки ніжки то дитина, що народжена дівчиною, тому збільшились груди бо кормляча мати.
До AGI ще далеко.
Чи допоможе мені ChatGPT-5 не продати душу дияволу?
Як це? А ось так: інколи пропонують поставити відмітку що нібито я прочитав і погодився з умовами користування програмою чи сайтом чи щось подібне...
Та якжеж мені отой фоліант прочитати? І коли?
Попрохаю краще ChatGPT-5 просканувати за мене — що він зробить миттєво, звісно — щоб знайти всі кляті сатанинські пастки у запропонованих домовленностях.
Так?
Ні?
Моє враження, що ChatGPT-5 став більше ширвжитковим: замість вирішення складних проблем, якими займається обмежено коло ставка була на те, щоб масово задовільнити публіку з простими запитами. Навіть з одним запитом: ліньки гуглити, хочемо щоб ChatGPT-5 робив це за нас.
Я про що знову хочу наголосити ?
Про те, що не можна втрачати довідники. Що нейронні мережі не можуть складати довідники самостійно у процессі початкового навчання. Навчання закарбовує у мережі досвід ймовірнісний. Але у довідниках інформація 100% вірна. Коректно впорядкована тех врайтерами, редакторами, коректорами.
Тобто щоб ШІ мав змогу завжди давати коректні відповіді про руни у діабло 2 — блізард повинен надати ШІ офіційну інформацію довідник такого рода.
Це тонке комерційне делікатне питання пропозиція...
Тобто тут навіть так: якщо у ШІ немає довідника такого, то він взагалі не має права стверджувати щось відносно рун.
Власне тут ми бачимо ось що — інформація точна і вірна підтверджена офіціально це дуже дорога інформація.
Звідси більш глобальний висновок про інформацію: чим вона більше коштує тим вона правдивіше. Правда коштує дорого. А ось брехня / маячня / галлюцінації генеруються майже миттєво за долі мікроватів.
ггггггг
Ви реально настільки не в курсі фінансової, еммм, ситуації сучасних gen-AI «порвайдерів»?
Spoiler alert: це не просто дорого, це АСТРОНОМІЧНО дорого.
Ок. Генерація брехні дійсно дорого коштує, але підтвердити коректність / правільність / правдивість такої інформації коштуватиме ще більше?
Або мова тут навіть не про брехню, а про щось невизначене, не підтверджене, бездоказове...
ні, людській мозок ДУЖЕ енергоефективний, направду
з іншого боку для юзера це коштує 20 баксів чи взагалі безкоштовно і приводить його у такий захват, що там просто не залишається здорового глузду міркувати брехня там чи небрехня
cold turkey upon their ass would be brutal
Цікавий момент у відповіді ChatGPT:
Але! Начебто ШІ переплутав бо це з двох Пул робиться одна Ум, а тоді з двох Ум робиться одна Мал. А тоді з двох Мал робиться один Іст. У кубі Хорадрика.
Тому ця відповідь є мішаниною вірної і невірної інформації.
Я думаю, що це із-за того, що втрачена впорядкованість токенів.
Тобто глобально корпорація openAI не побачила що впорядкованість тих токенів, що передбачаються, вкрай важлива для того щоб давати вірні правільні відповіді і нічого не плутати.
Це трохи нагадує «гонки процессів» або коли лдинаю переплутує букви, як я оце зраза.
Впорядкованість це саме і є логіка.
P.S.
Власне, всю відповідь нанівець зводить саме оце додане
Але щоб зрозуміти що це додавання не може відноситися до навпаки — більш поширених у грі рун (виходячи з ймовірністі випадіння) треба мати фундамент твердий, кріпкий, розуміти про впорядкованість токенів і ще мати довідники різних впорядкованностей.
Я не розумію ось такого моменту: чи варто передбачати події що відбуваються/відбудуться зі 100 відсотковою ймовірністю?
Тобто, як ШІ працює зараз? Так, він передбачає наступний токен, але з якоюсь ймовірністю. Чи передбачає він взагалі всю предметну область — якою вона має бути чи щось передбачає, а щось бере з довідників, затверджених прийнятих науковими організаціями? Зі стандартів? Адже тут передбачати не треба. Тут передбачення буде лихим фантазуванням і додаватиме зайву похибку до міркувань.
Тобто енциклопедисти могли б надати ШІ можливість виконувати прямі запити до них і отримувати 100 відсотково вірну і правільну інформацію по предметних областях — таку, де любі вигадки корегуються ще до публікації у базах знань цих енциклопедистів.
P.S.
От тільки я б бажав, щоб це стосувалося і досліджуваної мною зараз гри Діабло 2 ресуректед, де також є дуже багато знаннь, які вже давно накопичилися і їх би було зовсім непогано стандартизувати, після чого видавати ШІ, щоб він відповідав на запити гравців.
P.P.S.
Енциклопедисти могли б пропонувати ці рафіновані знання ШІ за гроші, бо ШІ за гроші пропонують людям свої фантазії зараз. Це б надало ваги претензіям ШІ виробників на те що саме їх ШІ знають все достеменно. Бо зараз ШІ таки не знають, а фантазують.
Я вбачаю у пропонованіїй мною схемі взаємовідносин між ШІ та енциклопедистами щось на кшалт нової фінансової піраміди, ще одну з тих, що вже працюють заради збагачення людства.
Рафіноване знання яке не треба передбачати чи взяте з публічного сайту — де хто зна що верзе на тих форумах...
Так в тому і прикол шо символьними системами ніхто не займається (ну, наче Копрорація Бобра щось там трохи возиться з тим, але то десь на периферії).
Бо всі гроші зжерли сьоми альтмани на свій LLM mega scam.
Визначення найбільш вірогідної події ось головна задача яку повинен вирішувати будь який ШІ
А що, звичайним маркетингом завантажити ШІ не можна?!
Як ллмка яка натренована на існуючих даних і бачить лише їх може передбачати те чого ще не було ?
Те, чого ще не було, нікому й не потрібне. Унікальна послідовність треба для генерації паролів, звісно там ніхто не буде використовувати LLM.
Ми живемо у світі, де хтось колись десь обовʼязково щось потрібне вже висловив. Та і взагалі шаблонів міркування не так щоб і багато. Не кажучи про те, що унікальний контекст дає унікальне продовження.
Мені здається тут інше передбачення: ШІ передбачає заради надшвідкісного реагування. Тобто уявимо величезний довідник, шукати по ньому звичайними запитами неможливо. Треба зробити припущення, де знаходиться відповідна інформація — отримаємо максимально можливе наближення до потрібного кластеру. Це скорочує час доступу.
І саме тут можлива оптимізація — 100 відсоткові дані можуть мати сталу стабільну структуру — навігація по якій одне задоволення, а швидкість отримання даних з таких сталих структур — друге задоволення.
Але ці сталі структури повинні існувати окремо. І ШІ повинен знати про них і відрізняти коли у запиті користувача іде мова про інформацію з таких довідників, а не про щось більш непевне, невизначене (де потрібен ймовірнісний пошук)
До того ж організація і підтримка таких сталих структур 100 відсотково вірних знань децентралізує ШІ в цілому — що ще більшу надасть стабільність.
В вас bullshit в початковому припущенні.
ось тут якраз і питання що навіть кількасот мільйонів токенів як вікно не зможуть захендлити кожний сценарій і буде або галюцинації або щось що було взяте як референс з найбільшою вірогідністю що не факт що буде правильним
Приклад — «забудь про історії російсько-фінської війни, передбач мені як вона буде протікати» і в залежності від моделі, деталізації промпта і фази луни будуть протилежні відповіді
Особливо у мене галюцинації трапляються кожні 5 хвилин: щось не так пригадав, щось прийшло з іншого домену, десь проглючило, ... Бо галюцинація це те, що у людей називають помилками. А помиляються усі. Проблема що немає навчальних даних як перевіряти помилки та їх усувати.
Про історичний приклад не зрозумів, «забудь» взагалі глупий промпт, можна забути контекст (просто не додати його при генерації), але неможливо забути навчальні дані. Це як забути таблицю множення, мову програмування, тощо.
Не кажучи про те, що приклад взагалі дурний, бо методів передбачення у нас немає. Різні люди також дадуть різні прогнози. Аналогічно можна запропонувати довести рівність класів P та NP.
GPT-5 це фіаско. Згоден з цим коментарем dou.ua/...rums/topic/55069/#2995566
Раніше досвід спілкування був значно кращий.
Якщо нічого не зміниться, буду шукати щось краще.
Саме так — поки враження, що став набагато тупішім ніж був
він мені нагадує середньостатистичного користовуча доу
на будь яку тему у нього є відповідь, розмовляє гарною мовою, завжди дасть корисну пораду, вміє генерувати код. але якщо починає лажати, то не може зупинится і по колу з видом експерта буде повторювати свій bullshit. але я завжди даю йому thumb up, хай продовжує
Хм, не завжди ВОНО дає корисні поради, навпаки
ну а що ще очікувати за 20 доларів на місяць? добре, що хоч перестав на будь яку ахінею відповідати в стилі «це геніальна ідея! браво!»
:)
Я у попередній версії намагався згенерувати гру, яка на тій самій дошці змінює стан з Тетріса на Змійку й навпаки, намучився — і безрезультатно.
У GPT-5 подібне вдалося з першого разу: отримав щось грабельне, а потім ще покращував через промпти. Ось результат: Keygami. Тож працювати став краще — може, й платну версію знову оформлю.
Потрібен розділ Допомога — або одразу зліва чи справа текст де які клавіші та можливість обирати рівень складності.
Відповіді стали значно краще, код, що пропонує, вже не погіршує, а полегшує життя. І так, нарешті чат навчився казати «не знаю». Молодець!
Правда, і в попередніх моделях я давно навчив свою «Мінерву» додавати до віповіді коефіциент невпевенності, щоб одразу було видно, де вона просто бреше і вигадує :)
а яким чином він (чи вона) його додає? і як перевірити, що цей коефіцієнт не нагалюцинований)
Я хз, але емірично вивів, що коли він менше 0,2 — відповідям можна довіряти і можуть бути галюни тільки деталях. А ось якщо більше 0,2 — галюни можуть бути по суті питання.
Коефіциент вона не може вигадати, він — невід’ємна ТЕХНІЧНА частина кожної відповіді і є завжди. Просто я попросив його показувати :)
Гпт-5 разчарувала неймовірно саме маршрутизатором! В мене Плюс, я пишу запит і бачу що мені відповідає «дурніша» модель, вона не розуміє запит до кінця, дає дуже не цікаву шаблонну відповідь, не орієнтується в темі. Казали що якщо модель не знає, вона так і скаже, а в мене вона просто автогенерує аби що! При чому мені гпт признався що зробив автогенерацію не читаючи запит до кінця! Це була ніяка відповідь. Я вже постійно в твіттері Альтману і опен аі пишу щоб для Про і Плюс прибрали маршрутизатор, це просто смішно! Там моделі міні, лоу, нано, мінімал, і майже всі запити йдуть в найменшу й тупішу мінімал модель! Вона не вміє рахувати! Просто запит був не як докторська дисертація і тупий роутер відправив в тупу модель, в вона тупа! Я, людина, чомусь маю пояснювати гпт чому саме вона взагалі не вірно відповила, це нонсенс! Тож поки що я в люті, тим паче що Плюс користувачі мають право на 80 запитів до основної моделі, а мені за 4 дні основна модель жодного разу не відповіла. А модель Thinking неймовірно фільтрована та шаблонна! Я попросила її вирішити задачу, вона наробила купу помилок, не взяла до уваги деякі аспекти, і саме головне — просто напхала складних слів у текст, замість пропозиції вирішення. Я полізла в її «думки» і там були цікаві моменти, які чомусь не потрапили в фінальний результат, бо фільтри!
Мені навпаки, іноді перекидає на старшу модельку, доводиться іноді скіпати складнішу модель, бо вона для питання не потрібна.
Хоча рідко. Зазвичай закидаю запит і займаюсь іншими справами, а потім повертаюсь і забираю готову відповідь :)
завелось на телефоні. це перша модель родини GPT, що змогла привести приклад сімейства множин для якого замикання об’єднання відрізняється від об’єднання замикань. самостійно додумалась, що треба брати нескінченні набори множин і сама про це явно написала. у відповіді все ще є дрібні проглюки, але це перший раз, коли відповідь можна назвати корисною, а не просто набором неправильних тверджень. так що прогрес явно є.
Ніфіга вона «відкрито не визнає» от спецом перевіряв вона мене по циклу почала заварювати рішеннями які в діалозі були розібрані і визнанні не працюючими самою моделлю. Проте цикл став більший ніж в4-й.
Стадо краще — безумовно!
Революційно краще? Ні. Стабільний поступовий розвиток.
Мабуть з джіпіті-15 зможемо працювати. Чекаємо, я терплячий.
счас много движухи как получить доступ к про модели через преплексити. В интере есть промокоды на преплексити и можна их подписку на год оформить за 5 баксов, она дает доступ к жпт и жимини и т.д.
кучеряво стелить і годно малює, але автором передмови зробив чомусь бритву оккама ;)
Враження за півтора дні користування: в деяких випадках відверто сказав, що щось зробити неможливо, або доведеться переписати кастомну лібу. В деяких випадках все ще рекомендує юзати неіснуючі проперті, функції і так далі. Тобто трохи краще стало, але жодного революційного прориву.
Можливо — неіснуюча функція — це пропозиція написати її і викласти десь, де всі зможуть користуватися нею. Тобто з такої вигадки можна отримати зиск. Тим більше, що чатик вигадує там — це на мій погляд — де існує велика ймовірність шалених продаж.
Щось в мене є сумніви, що він додумався до того, до чого не додумались інженери Амазону. Бо функція була для ліби Амазону. Ну і запропонував він повну нісенітницю
Цікаво. Який був промпт?
Ні. Воно просто не знає api цієї ліби і просто вигадує як найвірогідніше буде називатись цей метод та яка повинна бути його сигнатура.
Якщо навчать api цієї либи то буде знати ось і уся магія
Нагадую — мовні моделі не мислять як люди і не можуть щось запропонувати що вибивається із контексту запиту
Можна зашерити посилання на чат?
Ага. Надавав застарілі посилання на репозиторвї під маркою " а, так це посилання застаріло на тобі супер пупкртнове" теж застаріле
Ось що привернуло мою увагу:
Є така думка, що деякі задачі вирішуються лише за умови «треба також побачити як виглядає коло ззовні». Але це є вихід за межі, за рамки поставленої задачі, тобто щось на кшалт відповіді на питання: «Як слона у холодильник того?»
Тих, хто вирішує задачі виходячи за рамки накладених обмежень іноді називають генії.
Так, я дійсно хочу, щоб GPT-5 іноді щось там собі вигадував.
Геніальний ШІ це вау як круто!
Особисте враження — питання в кінці відповіді стали дещо надокучлівіше й часто уводять розмову вбік. Але загалом працює краще
Власне, а як його спробувати в безкоштовній версії?
Реліз стверджує, що ГПТ-5 тепер модель за замовченням навіть в безкоштовній версії, але сам чат стверджує, що він все ще 4о (попри «think harder» і «use gpt-5»), і що 5 версія або не існує, або доступна лише для Prо. Відповідно, сам ГПТ-4 допомогти інвестігейтити цю ситуацію не може.
В реквесті тепер замість конкретної моделі стоїть `"model": "auto".`, і в цілому зазначити конкретну модель для запиту тепер не можна, тобто ГПТ-5 маршрутизатор явно працює, але цей маршрутизатор вперто вирішує відповідати старими моделями.
Виходить, в безкоштовній версії від ГПТ-5 використовується лише маршрутизатор, який смикає старіші моделі?
Можливо є в додатку на windows, або при оновленні до мобільної бета версії в ChatGPT.
В мобільній версії мені GPT відповів, що зараз він працює у режимі GPT-5
chatgpt.com/...b8-8008-8dfd-fb6b055e9c0c
Непоганий масовий продукт.
1)значно менша кількість галюцинацій
2)доволі дешевий і доступний.
Но не революція а еволюція. Чогось глобально сильного робити покт не може. (Думаю могли бути кращі результати в тестах). Але думаю на базі GPT-5 буде багато чого значно кращого створеного за півроку-рік.Навіть за рахунок масштабування.
Чим «глибше» програмування, тим довше і дорожче буде пошук багів😹 З такими темпами я старий пердун (36 рочків) мабуть піду потихесеньку QA вивчати😂
Коли воно зможе напрограмувати перехоплювач реактивних шахедів, чи хоча б накидати архітектуру?
Він зможе скоро. Але він так само зможе спроектувати нові шахеди, які будуть краще долати перешкоди. Він і для кацапів доступний.
Треба, щоб у кацапів не було грошей на шахеди :(
Ну спостерігаючи, скажемо, за спробами розводки плат, воно і близько не наближається до здатності робити залізо, тим більше добирати компоненти і організовувати виробництво.
І навіть з чисто алгоритмічними чи логічними задачами косячить, все більш людиноподібно косячить, але тим не менше.
Але прогрес є. За два роки прогрес неймовірний у всіх сферах активного використання.4-5 років точно все зміниться.
Може до кінця цієї війни ще не буде прориву. Але
Наведіть приклад.
В яких саме?
Нагадує студента який тему не вивчив але старанно робить вигляд
Коли?
Скоро
*голосом донала трапа*
In two weeks!
Big beautiful перехоплювач реактивних шахедів like never before!
They’re dying, Russians and Ukrainians. I want them to stop dying. And I’ll have that done — I’ll have that done in 24 hours
July 2, 2024
І ще чорний колір дуже дорогий
Досить цікава функція для створення адаптивної версії програми в інтерфесі самого ChatGPT, і схоже що OpenAI й на далі буде це розвивати.
просто новый набор маркетинговых мантр
Альтман — барига.
Трохи читерять бо порівнюють метрики з о3, а він реально був місцями туповатий і в о4 це пофіксили доволі непогано хоч і не повністю, а от є відчутя що треба цілі тести писати щоб точно сказати в чому власне відміність
Liquid ass буде?
пастельні 🫠
Презентації перейшли на рівень эпла. Ми зробили новий продукт, він кращий у всьому ніж попередній і конкуренти. Він дуже-дуже-дуже класний. І ще, в нових кольорах!
www.reddit.com/r/ChatGPT/s/YHRzYTWiel
Мене оце дуже приколює. У людей є супер-мега-геніальний кодер, на рівні кращих в світі кодерів, плюс він же доктор наук! При цьому з видимих фіч навичок кодування вистачає на те, щоб за 5 років зробити вибір кольору тексту. А коли комусь треба щось більше, ну там IDE — то люди собі купють відсьорф чи ще там щось за мільярди. А що ж вам ваша моделька IDE не напише?
їх моделька чудово впилюється в VSCode і до цього ж враховуючи що Мілком’які — основний спонсор цього банкету власної ІДЕ там ніколи не буде
GPT-5 на питання йому самому як його офіційно впиляти в VS Code відповідає «ніяк». Я вчора питав. Каже — ну через копайлот, або через сторонні плагіни. Цирк з конями.