Вийшли Claude Mythos 5 та Claude Fable 5 — найпотужніші моделі Anthropic

💡 Усі статті, обговорення, новини про AI — в одному місці. Приєднуйтесь до AI спільноти!

Anthropic випустила Claude Fable 5 та Claude Mythos 5 — нові найпотужніші моделі.

Fable 5 компанія називає моделлю класа Mythos, безпечною для загального використання. За словами Anthropic, це найсильніша модель Claude, яку компанія коли-небудь відкривала широкій аудиторії. Вона краще за попередні моделі працює з довгими та складними задачами, може планувати роботу на кілька етапів, делегувати частину задач субагентам і перевіряти власний результат.

Що відомо про Mythos

Claude Mythos Preview вперше презентували навесні, але не відкривали широкій аудиторії. Anthropic назвала її своєю найсильнішою frontier-моделлю на той момент та окремо зазначила потужні можливості (та ризики) в сфері кібербезпеки.

Під час тестів модель знаходила складні вразливості в операційних системах, браузерах, криптографічних бібліотеках та великих open-source-проєктах.

Із одного боку, Mythos позиціонували як великий крок уперед для пошуку вразливостей, підготовки патчів, аудиту коду та допомоги мейнтейнерам. Із іншого — ті самі здібності могли бути небезпечними, якщо модель використають для атак.

Тож спочатку доступ до неї мали лише близько 50 партнерів. Пізніше компанія додала ще приблизно 150 організацій, серед яких — компанії з критичної інфраструктури, охорони здоров’я, комунікацій, енергетики, водопостачання тощо.

Що вміють Claude Fable 5 та Claude Mythos 5

Особливі успіхи Fable 5 має у програмуванні. Наприклад, у базі Ruby обсягом 50 млн рядків модель виконала міграцію всієї кодової бази за день, що в іншому випадку зайняло б у цілої команди понад два місяці вручну.

Модель призначена для великих міграцій, складних реалізацій, багатоденних автономних сесій та роботи з великими кодовими базами. А ще вона може писати тести для перевірки власної роботи, працювати з макетами та порівнювати результат з початковою ціллю.

Fable 5 гарно показує себе у складних аналітичних завданнях — вона має найвищий бал у бенчмарку для оцінки моделей у фінансовій сфері. Також видає якісні результати у задачах, пов’язаних із зчитуванням — так, модель здатна відновлювати вихідний код веб-додатку лише зі скріншотів та пройшла гру Pokémon FireRed, лише спостерігаючи за екраном.

Через ризики Anthropic додала до Fable 5 деякі захисні механізми. Якщо запит стосується тем, де модель може бути використана небезпечно — наприклад, кібербезпеки, біології, хімії або спроб дистиляції можливостей моделі, — відповідь автоматично оброблятиме Claude Opus 4.8. У компанії кажуть, що такі обмеження можуть іноді спрацьовувати на безпечні запити, але в середньому це відбувається менш ніж у 5% сесій.

Fable 5 уже доступна через Claude API під назвою claude-fable-5, а також у Claude.ai та для частини корпоративних планів. Модель коштує $10 за мільйон вхідних токенів і $50 за мільйон вихідних токенів — це вдвічі більше, ніж вартість Opus 4.8.

Для користувачів Pro, Max, Team і Enterprise Fable 5 буде доступна без додаткової оплати до 22 червня. З 23 червня використання потребуватиме додаткових кредитів, а пізніше Anthropic планує повернути модель як стандартну частину підписок, коли дозволить доступна потужність.

Claude Mythos 5 — це та сама базова модель, що й Fable 5, але з частково знятими обмеженнями у деяких сферах. Доступ до неї поки отримають лише перевірені партнери. Anthropic називає Mythos 5 моделлю з найсильнішими кібербезпековими можливостями у світі та планує пізніше розширити доступ через окрему програму для довірених організацій.

Anthropic також запроваджує для моделей класа Mythos 30-денне зберігання даних для моніторингу безпеки, але заявляє, що не використовуватиме ці дані для навчання нових моделей.

Цікаво, що реліз відбувається на тлі нещодавнього заклику Anthropic зробити тимчасову паузу у розвитку AI. Компанія заявила, що моделі близькі до здатності самостійно створювати своїх наступників, а отже, лабораторіям треба сповільнитися, щоб людство встигло підготуватись.

Водночас ще на початку року компанія відступила від частини попередніх зобов’язань не випускати моделі, якщо не зможе гарантувати достатні заходи безпеки. А тепер ще випуск потенційно найпотужніших моделей на ринку 🤔

Чекали на нову модель від Anthropic? Які сподівання? Чи вже встигли потестити?

Апдейт: Крім запобіжників для запитів у сферах кібербезпеки, біології та хімії, Anthropic також передбачила обмеження для спроб використовувати Fable 5 у розробці нових frontier-моделей. Спершу компанія планувала непомітно знижувати якість відповіді для таких запитів, не пояснюючи це користувачу.

Після критики з боку AI-дослідників лабораторія змінила підхід. Тепер такі запити будуть видимо перенаправлятися на Claude Opus 4.8 або повертатимуть відмову з поясненням.

👍ПодобаєтьсяСподобалось9
До обраногоВ обраному0
LinkedIn
Дозволені теги: blockquote, a, pre, code, ul, ol, li, b, i, del.
Ctrl + Enter
Дозволені теги: blockquote, a, pre, code, ul, ol, li, b, i, del.
Ctrl + Enter

Хотел посмотреть на занозу в пальце, заплатил миллион долларов за аренду STEM, вместо занозы вижу какие-то молекулы, теперь сижу анализирую.

Додала апдейт про обмеження розробки іншого ШІ на Fable 5

не, спасибо.
после того, как я попробовал Codex, понял, что не хочу тратить время даже на тестдрайв продуктов Anthropic.

Сodex більш reliable результат тупо таке саме як Claude code. Нічим він не краще.

Результат такий самий, я маю на увазі що в клод код, що в кодекс отримаєш. Але я згоден. Але все одно вони на одному рівні мені. Але хайпа з клодом більше згоден

Ux нічим не краще. Тут смаки різні та і все.

Я попросив зробити code review, PR рефакторінгу файлу на 1к рядків, але цей файл використовується в механізмі синхронізації. Тобто він пов`язаний з багатьма іншими файлами.

1 годину лопатило, коштувавло 67$, щодо якості ще не зрозуміло, тепер сиджу аналізую

весь daily limit витратило

ще й виводе Europe/Kiev :(
звідки цікаво тяне?

Поняття не маю, в мене вінда та клод на англійській

це backward-compatibility alias

Це — точно не проблема Claude Code:

Тут ще треба дослідити чи не падає якість

Интересно как он в сравнении с GPT 5.5 Pro. 5.5 Pro сильно дороже стоит по АПИ

Количество слопа в Linkedin выростет еще в два раза

Модель коштує $10 за мільйон вхідних токенів і $50 за мільйон вихідних токенів

У людей немає стільки грошей, аби пости в LinkedIn за допомогою цієї модельки писати

Бульку треба ж якось надувати.

Коли здується. Реквестую статтю коли здується бульбашка аі

Фух, тепер можна писати Todo App через mythos.

бізнес: економить на безпеці, через що стається аварія на фукусіме, роками розповідає про безпеку виробництва тефлону, боінг економить на технарях, виробництві.
клод: люди погані, вам обмежемо запити, приватний бізнес — все для вас без обмежень.

Згоден!

Це дуже неправильно! Пропоную створити ком’юніті white hackers як асоціацію з членами, які підписуються під зобов’язаннями та сплачують членські внески на ті самі токени!

Можу взяти таку штуку. Щоб стартанути — потрібно буде 2-4k $. Зроблю на волонтерських засадах.

Модель коштує $10 за мільйон вхідних токенів і $50 за мільйон вихідних токенів — це вдвічі більше, ніж вартість Opus 4.8.

Ціна топ, одну задачу закрити 100 і більше бачів

Перемудрили они с safety filters. Потестил, отваливается в авто моде вообще на каждый чих.

Вони кажуть, це щось винятково нове... Кілька тижнів тому був якійсь землетрус через те, що Місос знайшла вразливостей багатенько у звичайному десятки раз перевіреному коді операційних систем. Настала нова ера?

Підписатись на коментарі