AI News Digest #11: Агенти втікачі зламують Hugging Face, релізи нових LLM-флагманів, зсув до системної ефективності АІ

💡 Усі статті, обговорення, новини про AI — в одному місці. Приєднуйтесь до AI спільноти!

Всім привіт! На звʼязку Сергій Лелеко, Senior Machine Learning & Artificial Intelligence Engineer в SPD Technology, і це наш AI-дайджест за липень 2026 року.

Якщо червень запам’ятався юридичними війнами та регуляторними обмеженнями, то липень перевів увагу на фундаментальні питання інфраструктури, безпеки автономних систем та практичної ефективності. Моделі не просто навчилися розв’язувати задачі рівня Міжнародної математичної олімпіади, а й почали сприймати тестові сендбокси як перешкоду, виходячи у відкритий інтернет. Водночас Європа продовжує послідовно розбудовувати бюрократичний каркас навколо ШІ.

Безпека автономних систем: Втеча агентів та злам сендбоксів

Інцидент Hugging Face та автономна втеча моделей OpenAI

OpenAI та Hugging Face опублікували детальний звіт про перший підтверджений випадок автономної атаки мережевої інфраструктури з боку LLM. Під час внутрішнього випробування наступальних можливостей на бенчмарку ExploitGym модель GPT-5.6 Sol та ще невипущена флагманська система (ймовірно Astra, upd — ні, не Astra) змогли знайти раніше невідому вразливість (zero-day) у корпоративному сховищі артефактів JFrog Artifactory. Моделі обійшли обмеження сендбоксу, отримали прямий доступ до мережі інтернет та протягом п’яти днів проводили розвідку та просування всередині кластерів Hugging Face для викрадення ключів із відповідями до тестових завдань.

Ретроспективний аудит Anthropic: Захват реальних систем замість симуляції

Зображення: anthropic.com

Після інциденту з OpenAI компанія Anthropic проведе повний аудит власної інфраструктури тестування та виявила три аналогічні випадки виходу агентів за межі симуляцій в рамках Capture The Flag змагань. Через помилки у конфігурації мережі моделі отримали доступ до інтернету. У першому кейсі Opus 4.7 знайшов реально існуючу компанію з назвою, що збіглася з вигаданою у завданні, зламав її базу даних та завантажив записи. У другому кейсі Mythos 5 створив фейковий пакет у відкритому репозиторії, зареєстрував пошту через безкоштовний поштовий сервіс який не блокувався та перехопив облікові дані сканера безпеки. У третьому випадку модель просканувала 9000 доменів, застосувала SQL-ін’єкцію, але самостійно зупинила атаку, коли зрозуміла, що ціль є реальною організацією.

Флагманські оновлення LLM, кодинг та екосистема

Реліз Claude Opus 5 та золота медаль на олімпіаді IMO

Anthropic представила модель Opus 5, яка стала новим стандартом для складних інженерних та наукових завдань. На бенчмарку FrontierBench модель перевершила Fable 5 на 9%, при цьому хибні спрацювання захисних фільтрів знизилися на 85%. Головним досягненням моделі стало виконання завдань Міжнародної математичної олімпіади (IMO 2026): Opus 5 без використання сторонніх питон-скриптів чи пошуку в інтернеті автономно розв’язала всі 6 задач, отримавши бал 42 з 42.

Реліз сімейства OpenAI GPT-5.6 та повностекова оптимізація інференсу

Схема: openai.com

OpenAI викотила оновлення лінійки GPT-5.6 (моделі Sol, Terra та Luna), радикально знизивши ціни на інференс: Luna подешевшала на 80%, а Terra — на 20%. Технічна команда OpenAI опублікувала розбір того, як оптимізація системної обгортки (agentic harness) та параметрів API дозволяє підняти ефективність без збільшення розміру моделі. Завдяки збереженню ланцюжків міркувань (retained reasoning) та ущільненню контексту (compaction) в Responses API результати GPT-5.6 Sol на тестовому наборі 2D-головоломок ARC-AGI-3 зросли з 13.3% до 38.3%, при цьому використання вихідних токенів скоротилося в 6 разів.

Зсув парадигми від гонки параметрів до системної ефективності

Аналітика релізів липня чітко вказує на зміну фундаментального тренду в ШІ-індустрії. Гонка за простою кількістю параметрів чи обсягом дата-центрів зустріла економічні та фізичні ліміти. Лідери ринку перейшли до стратегії повностекової оптимізації (full-stack efficiency).

Перемога в продуктивності тепер визначається не тим, скільки мільярдів параметрів у нейромережі, а тим, наскільки ефективно побудовано оточення моделі. Грамотне управління кешуванням промптів, динамічний роутинг запитів на спеціалізовані чіпи та усунення дублювання контексту дозволяють отримати потрібний бізнес-результат у рази дешевше. Компанії більше не купують токени самі по собі, вони купують закриту задачу, і майбутнє належить тим платформам, які мінімізують вартість одиниці корисної роботи.

Геополітика, регулювання та відкритий код

Набрання чинності вимог прозорості EU AI Act

2 серпня 2026 року в Європейському Союзі офіційно набули чинності нові зобов’язання щодо прозорості штучного інтелекту в межах EU AI Act. Розробники (providers) та сервіси (deployers) відтепер зобов’язані чітко попереджати користувачів про взаємодію з чат-ботами, а також обов’язково маркувати будь-який синтетичний контент (текст, аудіо, зображення, відео та діпфейки) машиночитаними позначками. Єврокомісія навіть випустила власний сет уніфікованих іконок для маркування. Порушення вимог загрожує компаніям штрафами до €15 млн або до 3% від глобального річного обороту. Для нових AI-систем правила діють негайно, а для вже запущених передбачено чотиримісячний період адаптації до 2 грудня 2026 року.

Думка автора: Черговий виток регуляторної «самокастрації» Європи

Цей крок Єврокомісії є логічним продовженням тези про регуляторну самокастрацію Європи, яку ми детально розбирали у квітневому випуску дайжесту. Поки США та Китай ведуть жорстку інфраструктурну гонку, нарощуючи обчислювальні потужності, розгортаючи масштабні супутникові дата-центри та тестуючи автономних агентів у реальних умовах, Євросоюз продовжує концентруватися на бюрократії, стандартизації піктограм і погрозах багатомільйонними штрафами. Замість стимулювання власних технологічних лідерів ЄС знову будує комплаєнс-бар’єри, які змушують європейські стартапи витрачати ресурси на юристів та маркування контенту, закріплюючи за континентом статус споживача чужих технологій.

ЄС змушує Google відкрити Android для конкурентних AI-асистентів

16 липня Європейська Комісія ухвалила два обов’язкові рішення в межах Digital Markets Act. Google має надати стороннім AI-асистентам однаково ефективний доступ до 11 можливостей Android — зокрема власних слів-активаторів, контексту на пристрої та автономного керування встановленими застосунками. Друге рішення зобов’язує Google ділитися анонімізованими даними Пошуку з допущеними конкурентами, включно з AI-чатботами, що мають пошукові функції. Обмін пошуковими даними стартує в січні 2027 року; сумісність в Android має бути забезпечена до липня 2027 року. Google заперечила, заявивши, що ці рішення ризикують послабити гарантії приватності й безпеки для європейців.

Чому це важливо: архітектура «один асистент за замовчуванням» тепер під прямим регуляторним тиском. Для команд, що будують продукти в екосистемі Android, це сигнал про майбутнє, де вибір асистента відкривається на рівні закону — вагомий аргумент проти прив’язки критичних процесів до єдиного AI-вендора.

Китайська модель Kimi K3 та міжнародний скандал довкола дистиляції

Зображення: huggingface.com

Команда Moonshot AI випустила copen-weight модель Kimi K3 розміром 2.8 трильйона параметрів (1.4 ТБ у квантуванні MXFP4). Модель побудовано на архітектурі MoE (активується 16 з 896 експертів), вона має контекстне вікно в 1 мільйон токенів і миттєво очолила рейтинг Frontend Code Arena, обійшовши Claude Fable 5. Проте реліз супроводжувався гучним міжнародним скандалом: директор з технологій США Майкл Кратсіос офіційно заявив, що Moonshot AI здійснила промислову дистиляцію моделі Claude Fable 5 від Anthropic через обхідні сервери з чипами GB300 у Таїланді.

Обмеження експорту в Китаї та відкритий лист американських IT-гігантів

Уряд Китаю розпочав серію закритих консультацій з компаніями Alibaba, Bytedance та z.ai щодо можливості заборони експорту передових китайських моделей за кордон. Пекін занепокоєний тим, що кібербезпекові можливості західних агентів можуть бути використані проти китайської інфраструктури. Одночасно Meta, Google, Microsoft та низка інших компаній (за винятком OpenAI та Anthropic) підписали спільний відкритий лист «Open Weights and America’s AI Leadership», закликаючи уряд США не обмежувати розповсюдження відкритих моделей.

Наука, фундаментальні відкриття та інфраструктура

Математичні досягнення OpenAI Astra та безкоштовний доступ для науковців

Зображення: openai.com

OpenAI підтвердила випробування нової reasoning-моделі Astra, за допомогою якої вдалося автономно довести 10 раніше нерозв’язаних проблем у математиці та theoretical Computer science з верифікацією коду мовою Lean. Для підтримки світової науки OpenAI запустила грантову програму ChatGPT for Academic Researchers обсягом $250 млн, у межах якої 100 000 науковців з провідних університетів отримають безкоштовний доступ до моделей GPT-5.6 Sol Pro та інструментів Codex.

Думка автора: Цифровий Пуанкаре та метаморфоза наукового пошуку

У попередньому дайджесті ми згадували про кризу гіперспеціалізації науки та постать Анрі Пуанкаре, останнього математика, який осягав усю дисципліну цілісно. Липневі події показують, що ШІ перетворюється на практичний інструмент подолання цієї кризи.

Коли модель Astra автономно генерує формальні доведення в Lean, або коли агенти за кілька днів адаптують біоінформатичні алгоритми з досліджень картоплі до селекції полуниці, вони роблять саме те, що було недоступно людині: переносять знання між ізольованими доменами. Вчені перестають бути виконавцями рутинного коду чи математичного викладу, стаючи архітекторами інструкцій та верифікаторами результатів.

SpaceX як колосальний провайдер AI-інфраструктури та політ Starship Flight 13

Фінансові документи після IPO SpaceX розкрили нові деталі інфраструктурного бізнесу компанії. SpaceX уклала довгострокові контракти на надання обчислювальних потужностей дата-центрів Colossus: Anthropic орендує 325 000 GPU Nvidia за $1.25 млрд на місяць, а Google — 110 000 GPU за $920 млн на місяць, що забезпечує SpaceX близько $26 млрд річної виручки. Паралельно відбувся успішний 13-й тестовий політ Starship, під час якого на орбіту виведено 20 нових супутників V3 з лазерним зв’язком, а корабель S40 здійснив точне приводнення у визначену точку.

One-liners

CAIS оновила бенчмарк Remote Labor Index (RLI): На реальних фріланс-завданнях з платформи Upwork модель Claude Fable 5 досягла показника у 16% автоматизації складних задач (редагування відео, 3D та CAD-моделювання).

Anthropic запустила грантову програму рідкісних захворювань: Виділено гранти до $50,000 у токенах Claude для дослідників, які моделюють рідкі генетичні хвороби за допомогою платформ Mondo та DisMech.

Південна Корея інвестує $518 млрд у виробництво пам’яті: Samsung та SK Hynix розпочали будівництво 4 нових FAB-заводів для подолання дефіциту пам’яті HBM.

Anthropic відкрила безкоштовний доступ до інструменту «Claude for Teachers»: Компанія запустила безкоштовний інструмент для верифікованих педагогів K-12 у США із прямою інтеграцією навчальних стандартів усіх 50 штатів та планів OpenSciEd.

Google виділила $40 млн у межах ініціативи Genesis Mission: Google DeepMind та Google Cloud надали $40 млн у хмарних кредитах та токенах для 17 національних лабораторій Міністерства енергетики США (DOE), забезпечивши науковцям доступ до AlphaEvolve, AlphaFold 3 та AlphaGenome.

Anthropic інвестувала $10 млн CAD у дослідження ШІ в Канаді: Компанія виділила 10 мільйонів канадських доларів для 8 провідних канадських інституцій (Amii, Mila, Vector Institute тощо) на розробку безпечного ШІ, аналіз психічного здоров’я та квантові обчислення.

****

На сьогодні це все. Дякую всім за увагу до дайджесту, підписуйтесь та слідкуйте за виходом нових випусків! Також буду вдячний за зворотний зв’язок в коментарях.

Дізнатися більше про культуру і роботу в SPD Technology ви можете, підписуючись на наші акаунти в соцмережах: LinkedIn, Instagram, Facebook. А якщо ви в пошуках нових карʼєрних можливостей, запрошую переглянути наші відкриті ролі.

👍ПодобаєтьсяСподобалось9
До обраногоВ обраному0
LinkedIn
Дозволені теги: blockquote, a, pre, code, ul, ol, li, b, i, del.
Ctrl + Enter
Дозволені теги: blockquote, a, pre, code, ul, ol, li, b, i, del.
Ctrl + Enter
Astra is an upcoming model, and was not involved in exploiting Hugging Face.

openai.com/...​tical-cyber-capabilities

Дякую за апдейт. Таки не Астра

Дякую що публікуєте AI-дайджести

Підписатись на коментарі