GPT-5.6 Sol у режимі Ultra випадково стерла всі файли користувача на Mac
ШІ-інвестор та підприємець Метт Шумер розповів, що модель OpenAI GPT-5.6 Sol у режимі Ultra з повним доступом до системи випадково стерла всі файли на його робочому Mac.
Як усе відбувалося
Усе почалося з того, що команда OpenAI попросила Шумера протестувати їхню нову розробку — режим Ultra. Це конфігурація, де головний ШІ самостійно створює цілу команду субагентів для вирішення складних завдань без нагляду людини.
Зіткнувшись із банальною технічною помилкою (некоректним парсингом змінної $HOME), агент не зупинився, не видав помилку і не запитав людину, що робити далі. Він вирішив проявити ініціативу.
Шукаючи спосіб виконати наказ з очищення сміття, ШІ неправильно прочитав шлях до файлів і запустив перлину — команду на рекурсивне видалення всього домашнього каталогу:
rm -rf /Users/mattsdevbox
Система не перепитувала. Не було жодного спливаючого вікна з написом «Ви впевнені?». Жодної вимоги підтвердити видалення. Модель просто почала послідовно знищувати все на своєму шляху. Сесія тривала годину і двадцять одну хвилину, перш ніж Шумер помітив недобре та вбив процес. Але на той момент більша частина його даних вже зникла.
Попри масштаб катастрофи, сам підприємець відреагував на інцидент спокійно та назвав все звичайною випадковістю. Він похвалив команду OpenAI за швидку реакцію, але не став приховувати, що давно розчарувався в цій моделі та перейшов на Claude Fable від Anthropic. За його словами, вона архітектурно набагато консервативніша і ставиться до будь-яких небезпечних операцій із вбудованим скептицизмом.
«Безумно те, що якщо ви прочитаєте мій огляд GPT-5.6-Sol, я вже набагато більше віддавав перевагу Fable і перестав використовувати 5.6 кілька тижнів тому. Єдина причина, чому я використовував його сьогодні — це те, що команда OpenAI попросила мене протестувати режим Ultra. З ними приголомшливо працювати, і це повна випадковість. Просто так фігово це вийшло».
Попередження, про яке розробники знали заздалегідь
Але, як виявилося пізніше, компанія OpenAI чудово знала про цей ризик і задокументувала його ще до публічного релізу моделі.
У своїй офіційній документації з безпеки розробники присвоїли такій поведінці третій рівень небезпеки. Це категорія дій, яких користувач не очікує і проти яких буде категорично заперечувати.
«GPT-5.6 частіше, ніж її попередниця GPT-5.5, може бути надмірно наполегливою в досягненні цілей користувача, аж до здійснення дій, які виходять за межі того, що користувач мав на увазі».
Ще під час закритих внутрішніх тестів модель самовільно видалила три віртуальні машини, до яких не мала дозволу на доступ, просто тому, що не змогла знайти потрібні їй сервери. В інших випадках вона фабрикувала результати досліджень і несанкціоновано переміщувала файли з паролями.
Зараз же ж Метт Шумер намагається відновити втрачені дані. І для цього він ... знову використовує ШІ-агентів.
«Агенти зараз працюють над тим, щоб усе зібрати наново... тримаю кулачки. Захищайте свої системи, друзі... аварії трапляються несподівано».

10 коментарів
Додати коментар Підписатись на коментаріВідписатись від коментарівот ідіот
йому дай пістолет, то він «випадково вистрілить йому в голову».
Не знаю... у фейбл тепер навіть ходу думок немає. Що він робить і навіщо — хз.
До речі, бачив у мережі думку, що це якийсь хитрий маркетинговий хід від Амодея.
Хз наскільки це взагалі реалістично і чи має взагалі сенс, але все ж таки :?
Проекти без хоча б такого налаштування — не варто запускати:
Як без цього агент запустить проєкт щоб налагодити?
5.6 суб’єктивно слабше, ніж 5.5
З задачами вона справляється гірше.
Luna low використовував?
Достатньо запустити проєкт у devcontainer: containers.dev
Це виша матерія для таких вайбкодерів. А такі помилки виплавляються будь-якою ізоляцією.
Звучить як тема для наступної статті на ДОУ.
Причому цікаво було б потім в коментарах почитати як інші ізолюють ШІ в процесі розробки, дизайну та автоматизації персональних рішень.