Azure & AI digest #1: Claude Opus 4.8, Foundry Local, GitHub Copilot App
Ласкаво просимо до огляду новин у сфері штучного інтелекту (ШІ) та Azure.
Якщо у вас є новини, які ви хотіли б запропонувати чи обговорити, будь ласка, приєднуйтеся до нашого Telegram-каналу за посиланням.
Що нового: Категорія моделей
1. Claude Opus 4.8
Ця модель тепер доступна в Microsoft Foundry, Copilot, Co-work та GitHub Copilot.
- Призначення: Створена для складних багатоетапних завдань із написання коду та довгострокової агентної роботи.
- Переваги: Може працювати потенційно кілька днів, не збиваючись зі шляху. Має покращений вибір інструментів, точніше дотримання ваших інструкцій та краще виконання багатоетапних робочих процесів. У 4 рази менша ймовірність (порівняно з версією 4.7) того, що модель пропустить помилки у власному коді.
- Динамічні робочі процеси: Здатна планувати та запускати сотні паралельних субагентів (наприклад, для масштабної міграції величезних баз коду).
- Головна ідея: Це найсучасніша агентна модель для кодування, яку ви можете використовувати у своїх звичних інструментах із необхідним корпоративним управлінням (enterprise governance). Однак пам’ятайте: не варто завжди обирати найбільшу модель для всього. Обирайте правильну модель для конкретного завдання, щоб оптимізувати обчислення і, відповідно, витрати.
2. GPT 5.5 Instant,GPT Chat Latest та GPT 5.5 Thinking
Ці моделі доступні у Foundry та M365 Copilot Chat.
- Instant орієнтована на низьку затримку та швидкі відповіді для рутинної роботи, багатоетапної допомоги, інтерактивного досвіду та додатків на базі RAG.
- Thinking призначена для глибшого міркування, аналізу та вирішення складніших завдань. Ви можете вибирати між ними, наприклад, у Copilot Chat, адаптуючи вибір під свої поточні потреби.
3. Моделі GPT Realtime (Realtime 2, Translate та Whisper)
Три нові моделі реального часу від OpenAI, доступні у Foundry за глобальними стандартами:
- GPT Realtime 2: Чудові можливості розпізнавання та генерації мовлення (speech-to-speech) із функціями внутрішнього міркування.
- GPT Realtime Translate: Безперервний голосовий переклад у реальному часі.
- GPT Realtime Whisper: Потокова транскрипція з низькою затримкою.
- Де використовувати: Агенти підтримки клієнтів, служби перекладу та будь-які ситуації, де потрібна взаємодія та міркування в реальному часі.
4. XAI Grok 43
Тепер доступна у Foundry. Ця модель отримала покращення у виклику інструментів (tool calling), дотриманні інструкцій та зниженні рівня галюцинацій. Це ще один передовий варіант у повністю керованому каталозі.
5. Deepseek V4, V4 Pro та Kimi 2.6
Доступні у Foundry через Fireworks.
- V4 Pro: Для завдань високої точності, що вимагають глибокого міркування та розуміння довгих документів.
- V4 Flash: Для сценаріїв із низькою затримкою та високою пропускною здатністю.
- Kimi 2.6: Модель для міркувань від Moonshot, створена для робочих процесів із великим контекстом.
- Головна ідея: Це моделі з високими можливостями, але за потенційно нижчою ціною. Вони ідеальні для завдань, чутливих до витрат (наприклад, масова сумаризація або класифікація), дозволяючи залишатися в межах управління Azure.
6. Cohere Command A+ та нові моделі зображень
- Cohere Command A+: Корпоративна RAG-агентна модель.
- Моделі зображень: Z-Image Turbo, Flux.1 та SDXL 1.0. Вони дозволяють створювати мультимодальні додатки з пошуком зображень, використовуючи хостинг моделей від перших осіб, при цьому дані залишаються всередині вашого тенанта Azure.
7. MAI Image 2 Efficient
Доступна у Foundry Labs (експериментальному майданчику Microsoft для ранніх ШІ-розробок).
- Переваги: На 22% швидша і в 4 рази ефективніша, ніж попередньо випущена MAI Image 2. В середньому випереджає інші провідні моделі на 40%. Це дешевша та швидша генерація зображень, що знизить витрати на додавання візуальних ефектів у ваші додатки.
Нові функції у Foundry
- Оцінювання на основі трасування (Trace-based evaluation): Оцінювання є критично важливим для генеративного ШІ, оскільки традиційні методи тестування тут не працюють через недетермінованість моделей. Тепер ви можете використовувати оцінювання на основі реальних користувацьких взаємодій (трасувань) через App Insights. Агент може знаходитися будь-де (Foundry, GCP, AWS). Це дозволяє вимірювати та покращувати якість агента в продакшені без необхідності створювати спеціальні тестові набори даних.
- GPT-5 Reinforcement Fine-Tuning (GA з обмеженим доступом): Дозволяє покращувати моделі міркування шляхом навчання на основі винагород, а не маркованих даних. Ви можете спеціалізувати передову модель для своєї галузі, отримавши вищу точність у пропрієтарних робочих процесах (це ефективніше, ніж просто системні підказки чи few-shot приклади).
- Керовані віртуальні мережі, атрибуція витрат та розуміння контенту (GA):
- Керовані віртуальні мережі гарантують, що трафік залишається у вашому мережевому периметрі без виходу на публічні кінцеві точки.

- Атрибуція витрат дозволяє відстежувати фінанси на рівні проектів.
- Розуміння контенту (аналізатори читання та макетів) допомагає організаціям краще контролювати всі процеси.

- Керовані віртуальні мережі гарантують, що трафік залишається у вашому мережевому периметрі без виходу на публічні кінцеві точки.
- Відкритий стек агентів від Microsoft Research: Використовує MagenticLight (рівень додатку), MagenticBrain (оркестратор на 14 млрд параметрів, доналаштований на базі
8-мільярдної моделі Qwen 3 для планування та делегування) та комп’ютерні моделі (версії на 4 млрд, 9 млрд та 27 млрд параметрів). Версія на 9 млрд вважається найсучаснішою серед малих моделей. Це прозорий фундамент для створення автономних агентів, який можна розгорнути самостійно (self-hostable), що дає повний контроль і переваги у витратах порівняно із закритими агентами типу «чорної скриньки». - Foundry Local (версії 1.1 та 1.2) та Azure AI Projects 2.2.0: Локальний запуск моделей на периферії (edge). Оновлення включають живу транскрипцію аудіо, вбудовування тексту (text embeddings), Qwen 3.5 Vision, багатомовне розпізнавання мовлення (ASR), платформу для Linux ARM 64, можливість скасування завантажень моделей, ONNX runtime 1.26 та оновлення SDK. Це ідеально для гібридних підходів, офлайн-роботи, забезпечення конфіденційності або сценаріїв із низькою затримкою.
- Foundry IQ: Кирована база знань, яка використовує різні джерела і може самостійно обирати найбільш релевантні з них. Вона налаштовує запити для отримання найкращих даних і може повертати як згенеровану відповідь, так і «сирі» дані. Мета — надавати агентам лише ту інформацію, яка дійсно потрібна, що економить ваші кошти на токенах, не витрачаючи їх на зайвий контекст.
Оновлення у Studio
- Агенти, що використовують комп’ютер (Computer-using agents): Якщо раніше агенти взаємодіяли переважно через API, MCP-сервери або командні рядки, то тепер вони можуть використовувати користувацькі інтерфейси звичайних додатків чи вебсайтів. Це дозволяє залучати їх у багатоетапні робочі процеси там, де немає API.
- Новий досвід робочих процесів (Workflow experience): У середовищах раннього доступу з’явився повністю перероблений, більш інтуїтивний інтерфейс. Ви можете створювати робочі процеси (workflows) від початку до кінця на єдиному полотні. Тепер ви можете вбудовувати агентів безпосередньо у детерміновані робочі процеси: система слідуватиме чітким правилам, а коли знадобиться креативність або судження ШІ, вона викличе агента, отримає рішення і продовжить роботу.

Оновлення M365 Copilot
M365 Copilot отримав повний редизайн:
- Він краще розуміє завдання, в якому ви зараз перебуваєте.
- Має поле вводу (prompt box), що розширюється.
- Автоматично працює з Work IQ та обирає правильну модель.
- Усе це забезпечує набагато кращий користувацький досвід, усуває плутанину і, як результат, підвищує продуктивність та рентабельність інвестицій (ROI) у використання Copilot.
- Неявна прив’язка до Outlook (Implicit Outlook grounding): Тепер він автоматично використовує релевантний вміст вашої пошти.
- Додано можливість аналізу та міркування над PDF-файлами безпосередньо у Copilot Chat.
Оновлення GitHub Copilot
Цей розділ отримав дуже багато оновлень:
- Нові моделі: Тепер доступні Opus 4.8, Gemini 3.5 GA та GBC 5.3 Codex. Вони пропонують різні рівні можливостей для кодування. Система автоматично вибирає, яку модель використати, а ви можете навести курсор на відповідь, щоб побачити, яка саме модель була застосована.
- Додаток GitHub Copilot App (Technical Preview): Тепер ви можете керувати «сесіями». Кожна сесія може мати власну гілку (branch), свої файли, окрему розмову та стан. Ви можете легко перемикатися між ними, розділяючи різні робочі завдання.

- Copilot CLI Remote Control (GA): Ви можете розпочати роботу в терміналі (наприклад, у VS Code або JetBrains), увімкнути віддалене керування, і сесія буде транслюватися. Ви можете продовжувати роботу через мобільний додаток GitHub або вебверсію, не зупиняючи процес.
- Організаційні правила для моделей (у режимі попереднього перегляду): На рівні підприємства тепер можна встановлювати більш тонкі налаштування: які моделі доступні, які з них є обов’язковими чи опціональними для різних підрозділів вашої організації.
Ось і весь короткий підсумок усіх оновлень у сфері ШІ за цей місяць. Сподіваюся, ця інформація була для вас корисною.
1 коментар
Додати коментар Підписатись на коментаріВідписатись від коментаріввсе прикольно — окрім посилань на кацапську тарабарщину