AI Digest #2. Сімейство моделей Microsoft AI, Foundry IQ у GA та GitHub Copilot SDK у GA
Привіт усім та ласкаво просимо до щомісячного огляду новин у сфері штучного інтелекту за червень 2026 року. Якщо у вас є новини, які ви хотіли б запропонувати чи обговорити, будь ласка, приєднуйтеся до нашого Telegram-каналу за посиланням.
Очевидно, що нещодавно пройшла конференція Microsoft Build, де було представлено величезну кількість анонсів. Раніше ми вже випустили детальний огляд Build. Тому в цьому щомісячному дайджесті ми згадаємо лише найважливіші моменти з конференції та зосередимося на інших значущих новинах місяця.
Оновлення на рівні моделей (Model Side)
Моделі Anthropic Claude на Azure
Моделі Claude від компанії Anthropic тепер доступні для запуску безпосередньо в інфраструктурі Azure. Фактичний інференс виконується на кластерах Azure з можливістю вибору локації даних: глобальної зони або зони США. Це дозволяє зберігати всі взаємодії та дані в межах контурів безпеки та корпоративного управління Microsoft.
Відтепер, якщо модель доступна як на базі Azure, так і на базі власної інфраструктури Anthropic (що регулювалося попередньою угодою про субобробку даних, яка залишається чинною), варіант «Hosted on Azure» буде встановлено як стандартний (за замовчуванням). Якщо ви відкриєте панель швидких фактів у картці моделі, ви побачите, що використовується хостинг на Azure, а також посилання на випадок, якщо ви захочете переключитися на хостинг від Anthropic.
Anthropic Claude Fable 5 (Claude Mythos)
Представлено Claude Fable 5 — це модель нового класу Mythos, що стоїть рівнем вище за Opus. Вона доступна для завдань, не пов’язаних із кібербезпекою, і створена спеціально для тривалих багатокрокових робочих процесів. Модель підтримує:
- Розробку складного коду в різних системах;
- Дослідження та синтез інформації з багатьох документів;
- Аналіз таблиць, графіків, чартів та діаграм.
Вона розроблена для найскладніших завдань у сфері інтелектуальної праці та програмування. Модель самостійно планує свій підхід до вирішення завдання, перевіряє прогрес на кожному етапі та коригує свою роботу в процесі.
Важлива примітка щодо безпеки: Відповідно до політики Anthropic, модель має
Існують обмеження на використання моделі в певних сферах. Очевидно, що для завдань із кібербезпеки призначена спеціальна версія Mythos 5, але обмеження також стосуються біології та хімії. Оскільки модель має надзвичайно потужні знання в цих науках, існує ризик її використання зі зловмисною метою. Також заборонено дистиляцію (використання моделі для навчання інших моделей). При доступі через платформу Foundry додаються власні функції безпеки та захисні бар’єри (guardrails) Foundry.
Як уже згадувалося, модель Mythos 5 у межах існуючого проекту Project Glasswing (доступ до якого суворо обмежений) тепер доступна для сценаріїв кібербезпеки. Спочатку її реліз було відкликано, але зараз вона знову повернулася. Крім того, вона стала доступною в M365 Copilot та GitHub Copilot.
Також стала доступною модель Claude Sonnet 5, яка є оптимальним рішенням для вимог середнього рівня.
Сімейство моделей Microsoft AI (MAI)
Microsoft випустила власну серію моделей під назвою MAI:
- MAI thinking 1: Середня за вагою та розміром велика мовна модель (LLM) для чатів та міркувань. Вона побудована за архітектурою Mixture of Experts (суміш експертів) і має 35 мільярдів активних параметрів із 1 трильйона загальних. Модель навчалася на чистих ліцензованих даних без використання дистиляції або контенту, створеного іншим ШІ.

- MAI image 2.5: Оновлений генератор зображень, який тепер підтримує редагування за принципом «зображення в зображення» (image-to-image). Також доступна її надефективна та швидка версія Flash.
- MAI transcribe 1.5: Модель для перетворення мовлення в текст. Вона підтримує діаризацію спікерів (розпізнавання, хто саме говорить), контекстне тарування (content biasing) і демонструє передову точність, працюючи в 5 разів швидше за моделі конкурентів.

- MAI voice 2: Багатомовна модель для перетворення тексту в мовлення з функцією клонування голосу. Для неї також передбачено ультраефективну версію Flash з нижчою вартістю.
- MAI code 1 flash: Інтегрована в GitHub Copilot агентна модель для кодування з 5 мільярдами активних параметрів, яка працює надзвичайно ефективно.

Наявність таких токен-ефективних моделей є критично важливою в умовах нової «економіки токенів». Це дозволяє оптимізувати використання та вартість токенів залежно від необхідного результату. Тепер більше не підходимо до завдань із думкою про використання однієї універсальної моделі для всього; замість цього ми обираємо правильну модель під конкретні вимоги.
Моделі Aion 1.0
Анонсовано серію моделей Aion 1.0, призначених для локального інференсу безпосередньо на пристроях користувачів:
- Aion 1.0 instruct: Мала мовна модель для текстових завдань, таких як створення підсумків (сумаризація), переписування тексту та забезпечення спеціальних можливостей (accessibility).
- Aion 1.0 plan: Більша модель для міркувань на 14 мільярдів параметрів із контекстним вікном 32 000 токенів та підтримкою виклику інструментів (tool calling) для складної багатокрокової роботи ШІ-агентів.
MDASH (Multi-model Agentic Scanning Harness)
Оскільки Mythos має чудові можливості кодування, вона чудово знаходить уразливості, але доступ до неї суворо обмежений проектом Glasswing.
Як альтернативу Microsoft представила MDASH — багатомодельну агентну систему сканування. Вона використовує понад 100 спеціалізованих ШІ-агентів для виявлення, обговорення, доведення та подальшого усунення експлуатованих багів від початку до кінця. За своєю ефективністю вона фактично перевершує Mythos. Ви просто створюєте клон свого Git-репозиторію, спрямовуєте на нього інструмент, і він знаходить та вирішує проблеми. Тепер MDASH також інтегрується з Defender та GitHub Code Security.
Frontier Tuning
Нова послуга, що надається спільно з групою інженерів швидкого розгортання Microsoft (FD group). Вона дозволяє оптимізувати та налаштувати одну або кілька моделей MAI відповідно до унікальних інтелектуальних потреб вашої організації, при цьому ваша компанія зберігає повний контроль над процесом та результатом.

Платформа Foundry та екосистема IQ
Foundry IQ (Загальна доступність — GA)
Сервіс Foundry IQ перейшов у статус загальної доступності. Він призначений для надання доступу до модерованого набору інституційних знань компанії (контракти, політики тощо). Користувач створює бази знань, які за лаштунками працюють на базі Azure AI Search.
Ці бази знань складаються з різних джерел. Відтепер підтримується додавання каталогів Fabric OneLake — необроблених даних для індексації. Це можуть бути як неструктуровані дані (наприклад, PDF-файли), так і напівструктуровані (JSON або XML). Також підтримується повна інтеграція з Fabric IQ, що включає семантичні моделі та онтології — корпоративні сутності, які зводяться у структуровані дані всередині OneLake (таблиці, часові ряди). Додатково додано підтримку Azure SQL та серверів MCP (Model Context Protocol), за допомогою яких можна підтягувати знання практично з будь-яких систем, як-от Salesforce, ServiceNow тощо.
Work IQ (Загальна доступність — GA)
Work IQ — це інтелект робочих процесів («how we work intelligence»). Він формує семантичний індекс не лише для документів, транскриптів зустрічей, чатів чи електронної пошти, але й аналізує взаємозв’язки, робочі ритми та ваш індивідуальний стиль спілкування, забезпечуючи повну персоналізацію.
Великий акцент зараз робиться на тому, що Work IQ використовується не лише в продуктах Microsoft Copilot — тепер завдяки Work IQ API його може викликати будь-який сторонній ШІ-агент.
- Використання API зовнішніми агентами оплачується через списання кредитів Copilot (тоді як у стандартних пропозиціях Copilot ця функція вже включена у вартість).
- Існують різні способи взаємодії з Work IQ API: Chat (надає відповідь природною мовою із посиланнями на джерела), Context (повертає лише чисті дані з наміром користувача для подальшого інференсу локальним ШІ), Tools (надає агентам можливість взаємодіяти з поштою чи календарем) та Workspaces (для збереження стану даних під час виконання завдань).
- Вартість запитів до Work IQ API варіюється залежно від інтенсивності роботи. Легкий запит може коштувати близько
20–40 центів, середній — трохи дорожче, а важкий запит із великим обсягом обчислень може досягати 1,50 долара.
Web IQ
До сімейства продуктів Microsoft IQ (Work IQ, Foundry IQ, Fabric IQ), які фокусувалися на внутрішніх знаннях організацій, приєднався новий інструмент — Web IQ. Він відповідає за контент із глобальної мережі.
Якщо пошуковик Bing оптимізований для сприйняття інформації людиною, то Web IQ побудований на базі глобального індексу Bing, але спроектований спеціально під те, як здійснюють пошук ШІ-агенти та яка саме інформація їм потрібна. З метою оптимізації кількості токенів та обсягу контексту система повертає лише найрелевантніші фрагменти (пасажі) з веб-сторінки чи документа, які безпосередньо відповідають на запит, уникаючи роздування контексту та зайвих витрат.
ШІ-агенти часто працюють ітераційно, надсилаючи послідовні запити для уточнення інформації. Тому Web IQ має наднизьку затримку (latency) та оптимізований для надшвидких відповідей, розподіляючи запити внутрішньо по всіх своїх розділах (partitions). У поєднанні з Foundry IQ, Fabric IQ та Work IQ платформа надає штучному інтелекту повний корпоративний та інтернет-контекст.

Foundry Agents
Платформа підтримує створення агентів як на основі промптів (без коду — no code), так і хостингові варіанти на базі наданих вами контейнерів або коду, з якого система сама згенерує образ контейнера. Реалізовано підтримку взаємодії A to A (Agent-to-Agent) для легкої кооперації між різними агентами. Вони автоматично масштабуються за потреби, а Foundry виступає як середовище виконання (runtime) для агентів.
Створених агентів (наприклад, за допомогою GitHub Copilot) тепер можна легко публікувати в Copilot або Microsoft Teams, що значно спрощує їх розповсюдження та доступність для кінцевих користувачів. Також став доступним Windows 365 для агентів, що дозволяє запускати агентів у повноцінному середовищі з можливістю взаємодії з інтерфейсом комп’ютера (computer use).

Оцінювання, моніторинг та безпека (Evaluations & Guardrails)
Генеративний ШІ неможливо протестувати традиційними методами (коли є фіксовані вхідні дані і ми очікуємо на конкретний детермінований результат), адже ШІ є креативним за своєю природою. Тому оцінювання відбувається за принципом відповідності цільовому призначенню, де як суддя часто виступає інша велика мовна модель.
- Guided Guardrails: Новий функціонал, де розробники проходять спеціальне опитування, після чого система рекомендує конкретні заходи контролю безпеки на основі вимог агента, його доступу до даних та особливостей використання.
- Керовані віртуальні мережі (Managed VNETs): Foundry тепер підтримує Managed VNETs для проведення оцінювань, що дозволяє тестувати ШІ-додатки та моделі, які знаходяться за приватними кінцевими точками (private endpoints).
- Multi-turn Evaluations: Розширено можливості оцінювання багатокрокових взаємодій. Використовується симуляція багатодіалогових сценаріїв для перевірки поведінки агентів, а також покращені функції трасування (tracing) та відтворення (replay) для детального аналізу логіки відповідей ШІ.
- Foundry Optimization: Інструмент для безперервного вдосконалення додатків шляхом регулярного запуску оцінювань та реагування на їх результати.

- ROI для агентів (Private Preview): Нова функція оцінки повернення інвестицій (Return on Investment) у закритому прев’ю. Оскільки взаємодія з ШІ коштує грошей через токени, бізнесу важливо розуміти реальний ефект. Інструмент допомагає оцінити заощаджений час, фінансові витрати та загальну ефективність.
Панелі інструментів та пам’ять (Foundry Toolboxes & Memories)
- Foundry Toolboxes: Надають єдину кінцеву точку для клієнтів MCP (Model Context Protocol). Вони відкривають доступ до сервера MCP, і клієнт підключається до сконфігурованого набору інструментів (сервери MCP, навички/skills, сервіси OpenAI, плагіни A2A). Також з’явився пошук по інструментах (tool search), щоб не перевантажувати контекст моделі надмірною кількістю функцій — модель може просто запитати, чи є інструмент для певного завдання. Toolbox бере на себе аутентифікацію, життєвий цикл та корпоративне управління, усуваючи складність і плутанину в підключеннях між ШІ-додатком та інструментами.

- Foundry Memory: Сервіс пам’яті було розширено до трьох типів:
- User memory — для вивчення та збереження персоналізації користувача;
- Session memory — для ведення поточної нитки розмови;
- Procedural memory — для запам’ятовування алгоритмів виконання певної роботи. Модель зберігання отримала оновлення: додано функцію TTL (time to live) для запобігання зміщенню пам’яті (memory drift), семантичну дедуплікацію та покращений моніторинг.

Ліцензування безпеки
Частина функцій безпеки Foundry для агентів, які раніше ліцензувалися в межах Defender for Cloud, переходять у ліцензію Microsoft Agent 365. Захист забезпечуватиметься через журнали моніторингу та карту агентів Agent 365. Сюди відносяться такі можливості, як виявлення агентів (agent discovery), оцінка стану безпеки (posture), виявлення загроз, захист у середовищі виконання (runtime protection) та розширений пошук загроз (advanced hunting).
Copilot Studio та Microsoft 365 Copilot
Оновлення Copilot Studio
- Computer Using Agents (Загальна доступність — GA): Агенти, що здатні взаємодіяти з настільним середовищем користувача (веб-сайти, десктопні додатки через користувацький інтерфейс). Це незамінно у випадках, коли у цільової програми немає API або інтерфейсу командного рядка (CLI). Тепер цих агентів можна додавати у складні багатокрокові робочі процеси.
- Новий інтерфейс проектування робочих процесів (Workflow Experience): Єдиний візуальний конструктор, що містить вузли агентів (agent nodes). Розробники можуть поєднувати детерміновану логіку класичних робочих процесів із міркуваннями ШІ на одному полотні від початку до кінця, а також легко інтегрувати вже існуючих агентів.
- Оновлений шар оркестрації (Orchestration Layer): Керує всім потоком роботи ШІ-додатків та агентів. Новий оркестратор отримав оновлений ШІ-стек, що підвищило надійність роботи і одночасно знизило використання токенів приблизно на 50%. Наразі функція розгортається у режимі раннього доступу.
Microsoft 365 Copilot
- Copilot Co-work (Загальна доступність — GA): Режим, у якому користувач просто визначає бажаний кінцевий результат, і ШІ самостійно виконує завдання з мінімальним залученням людини (задаючи лише кілька уточнюючих питань). Він використовує моделі глибокого міркування (deep reasoning) та тарифікується за фактом використання (usage-based billing). В додатку M365 Copilot з’явився чіткий перемикач між режимами Chat (оплата за робоче місце / per seat) та Co-work (оплата за фактом використання), що робить процес контролю витрат прозорим.
- Microsoft Scout (Прев’ю): Перший завжди увімкнений автопілот (always-on autopilot). Він постійно працює як ваш персональний автономний агент. Побудований на технологіях Open core, він функціонує в межах вашої корпоративної системи безпеки, взаємодіючи з M365, Work IQ та додатковими API. Він має власну ідентичність (identity). Ви ставите перед Scout цілі, і він автономно працює від вашого імені, вивчаючи ваші звички. Він може керувати поштою, календарем, а зранку ви можете виявити, що він уже самостійно знайшов усі чеки і оформив звіт про витрати або переніс накладки у зустрічах вашого календаря.
GitHub Copilot
- GitHub Copilot Desktop App (Загальна доступність — GA): Єдиний десктопний додаток, що супроводжує розробника від зародження ідеї до безпосереднього створення Pull Request. Підтримується ведення кількох сесій одночасно, де кожна сесія відповідає окремому робочому завданню.
- GitHub Copilot Sandbox (Прев’ю): Дозволяє запускати інструменти виконання Copilot, команди та модифікацію файлів в ізольованому середовищі («пісочниці») — локально або в хмарі. Активується командою {slash} sandbox enable всередині сесії. Локальна пісочниця базується на технології Microsoft MXC (анонсованій на Build) та підтримує різні рівні ізоляції на Windows, Linux тощо. Хмарний варіант запускається через параметр Copilot {dash} {dash} cloud на базі Linux; він дозволяє зберігати сесію між різними пристроями та не навантажує локальні ресурси комп’ютера.

- GitHub Copilot SDK (Загальна доступність — GA): Надає можливість розробникам інтегрувати те саме агентне ядро GitHub Copilot у свої власні додатки.

Це всі ключові оновлення ШІ за цей місяць. Сподіваємося, що цей матеріал був для вас корисним.
Немає коментарів
Додати коментар Підписатись на коментаріВідписатись від коментарів