Claude Opus 4.1 та Sonnet 4 з 1 млн токенів контексту

💡 Усі статті, обговорення, новини про AI — в одному місці. Приєднуйтесь до AI спільноти!

За хайпом навколо GPT-5, який виявився не те, щоб дуже виправданим, трошки загубилися оновлення моделей Claude. Почнемо з насвіжішого — Sonnet 4:

Відтепер Claude може «з’їдати» цілі програмні проєкти за один прохід: у Sonnet 4 з’явилося 1M токенів контексту (публічна бета в API), і Anthropic прямо пише про «цілі кодові бази з 75k+ рядків коду в одному запиті». Якщо вам потрібно «завантажити» весь репозиторій разом із тестами й доками, тепер це можливо. Про це оголосили 12 серпня.

А от Opus 4.1 вийшов тижнем раніше — 5 числа.

Що змінилося:

  • Сильніше «розуміє» великі кодові бази і точніше вносить правки між файлами: GitHub, Rakuten та Windsurf відзначають кращу продуктивність у рефакторингу коду, який охоплює кілька файлів, і точність фіксів без зайвих змін. На бенчмарку SWE-bench Verified — 74,5%.
  • Фокус на глибокому різонінгу, 200k контекст і можливість extended thinking (для API), плюс публічні цінники: від $15/МTok (in) і $75/МTok (out).
  • У зв’язці з Claude Code модель отримує «агентне» розуміння проєкту: індексує весь репозиторій, робить координовані зміни в кількох файлах, працює з терміналом та IDE, не змінюючи файлів без вашого дозволу.

Вже працювали з новинками, які ваші враження?

GPT-5, до речі, обговорюємо в сусідньому топіку.

👍ПодобаєтьсяСподобалось0
До обраногоВ обраному0
LinkedIn
Дозволені теги: blockquote, a, pre, code, ul, ol, li, b, i, del.
Ctrl + Enter
Дозволені теги: blockquote, a, pre, code, ul, ol, li, b, i, del.
Ctrl + Enter

На початку вражає можливостями особливо в режимі агенту до інструментів з підтримкою mcp — а потім розумієш що без кропіткого супервайзингу він просто знищить роботу над проектом особливо якщо його дати в руки недосвідчених вайбкодерів, згівняє все. Так саме і з серверами де є доступ до mcp — треба було зробити аудит на швидку місяця роботи над рішенням з доступом до git.через mcp і беклогу.. і оцінити якість рішеннь і відсоток згенереного написанного коду, так от claude той сами заливав про супер досвідчену роботу, а як тільки його ткнеш у те, що в рішеннях дитячі помилки системного дизайну, то він змінює свої заключення на діаметрально протилежні — короче довіряти йому не можна без розуміння нормального над речами в яких він тобі асистує. Як productivity tool для рутини — ok.

Так, використовую для середнього розміру проектів.
Я задоволений.

Підписатись на коментарі