Claude Opus 4.1 та Sonnet 4 з 1 млн токенів контексту
За хайпом навколо GPT-5, який виявився не те, щоб дуже виправданим, трошки загубилися оновлення моделей Claude. Почнемо з насвіжішого — Sonnet 4:
Відтепер Claude може «з’їдати» цілі програмні проєкти за один прохід: у Sonnet 4 з’явилося 1M токенів контексту (публічна бета в API), і Anthropic прямо пише про «цілі кодові бази з 75k+ рядків коду в одному запиті». Якщо вам потрібно «завантажити» весь репозиторій разом із тестами й доками, тепер це можливо. Про це оголосили 12 серпня.
А от Opus 4.1 вийшов тижнем раніше — 5 числа.
Що змінилося:
- Сильніше «розуміє» великі кодові бази і точніше вносить правки між файлами: GitHub, Rakuten та Windsurf відзначають кращу продуктивність у рефакторингу коду, який охоплює кілька файлів, і точність фіксів без зайвих змін. На бенчмарку SWE-bench Verified — 74,5%.
- Фокус на глибокому різонінгу, 200k контекст і можливість extended thinking (для API), плюс публічні цінники: від $15/МTok (in) і $75/МTok (out).
- У зв’язці з Claude Code модель отримує «агентне» розуміння проєкту: індексує весь репозиторій, робить координовані зміни в кількох файлах, працює з терміналом та IDE, не змінюючи файлів без вашого дозволу.

Вже працювали з новинками, які ваші враження?
GPT-5, до речі, обговорюємо в сусідньому топіку.
2 коментарі
Додати коментар Підписатись на коментаріВідписатись від коментарівНа початку вражає можливостями особливо в режимі агенту до інструментів з підтримкою mcp — а потім розумієш що без кропіткого супервайзингу він просто знищить роботу над проектом особливо якщо його дати в руки недосвідчених вайбкодерів, згівняє все. Так саме і з серверами де є доступ до mcp — треба було зробити аудит на швидку місяця роботи над рішенням з доступом до git.через mcp і беклогу.. і оцінити якість рішеннь і відсоток згенереного написанного коду, так от claude той сами заливав про супер досвідчену роботу, а як тільки його ткнеш у те, що в рішеннях дитячі помилки системного дизайну, то він змінює свої заключення на діаметрально протилежні — короче довіряти йому не можна без розуміння нормального над речами в яких він тобі асистує. Як productivity tool для рутини — ok.
Так, використовую для середнього розміру проектів.
Я задоволений.