Типи користувачів ШІ
Вітаю читаче.
Аналізуючи свої попередні статті про ШІ — і там де я хвалю, і там де лаю, я зрозумів тенденцію: є декілька типів користувачів ШІ, які одне одного взагалі не розуміють. Саме цей різний досвід я й хочу класифікувати й розглянути. Почнімо.
Усе написане далі є особистою думкою й підлягає обговоренню.
Класично існує два табори — ШІ оптимісти, й ШІ песимісти, але ми вже в тому етапі, коли накопичено достатньо досвіду, щоб ця класифікація втратила актуальність.
Почнемо з агентів. Що взагалі таке агенти?
От припустимо ШІ написав код. Після рев’ю, я маю його запустити і перевірити чи він працює. LLM в чаті не може запустити код, але компілятор може. Я створюю між ними зв’язок і LLM сам зможе запускати компілятор і читати помилки компілятора.
У цьому випадку, підключений до LLM компілятор — називатиметься інструментом.
Далі я навчу цю LLM інтерпретувати результати і робити ітераційно спроби, із донавчанням між ітераціями, поки не буде досягнута певна мета. Це називається агент. Тобто агент у цьому випадку — це інструмент + обв’язка яка потрібна для такого використання.
Зазвичай вони інкапсульовані, і існує LLM верхнього рівня, яка взаємодіє з агентом. Агент отримує мету, робить свої ітерації з інструментом, і віддає уже результат. Тобто оті ітерації повторень і проміжні оцінки результата які ви бачите в чаті LLM — це зазвичай LLM агента пише, а не LLM верхнього рівня.
Не обов’язвково це працюватиме один в один саме там. Наприклад, це може бути агент який повертає поточну дату, і там просто немає місця ітераціям, бо немає місця ітераційні помилці. Принаймні, якщо ви не почнете якось це ускладнювати. Або там декілька інструментів. Або взагалі немає інструментів, а тільки специфічна LLM.
Агентна архітектура не нова, вона існувала фактично завжди. Всі відомі чат боти на сьогодні — мають прихованих агентів. Наприклад блок цензури. Різниця в тому, що це поширилось за межі внутрощів бота. Тепер до LLM можна підключити фактично майже що завгодно, використовуючи стандартизовані засоби.
Тут виникає агент-табір — ті хто користується агентами і часто фанатично вірить у те що «до ШІ можна підключити що завгодно» і він, методом повторення спроб, врешті решт зробить те що треба.
Це правда, проте часто такі користувачі забувають що кожна спроба має ціну.
Кожна операція з агентами має реальну вартість у вигляді:
- гроші (токени)
- час
- іноді ресурси зовнішніх сервісів (наприклад виготовлення чогось на верстатах)
- іноді ризики пов’язані з реальною дією
Під дуже велику кількість задач не існує готових агентів. Бо по факту, більшість агентів це ті ж самі LLM із специфічним промтом, з вже існуючим або простим у створені інструментом, бо таких агентів просто і дешево зробити.
Дуже погана ідея, наприклад, в агента включити інструмент для прямого керування системами АЕС чи, наприклад, вирізати апендикс, надавши пряме керування роботизованим хірургом (пацієнту точно не сподобається). Треба більш складний інструмент, якого може просто не існувати готового чи бути ще якась складність.
Коли простого варіанта не існує — люди яким це треба, часто отримують біль замість результату. Ті ж хто з цим не зіткається — часто кажуть щось штибу «та візьми й просто зроби потрібний агент/інструмент...», взагалі ігноруючи реальну складність задачі, бо занадто вже звикли що ШІ це щось — раз, два і «щось» є. Назвемо це семплифікацією (спрощення складного).
Але залишається фактом — досвід користувачів із агентами (існуючими або легко створюваними), та без — кардинально різняться. Тому у подальшому я буду використовувати це як один із ключових роздільників користувачів ШІ.
Карта «Де ОК / Де не ОК»
Зважаючи на свій досвід і розуміння, я спробував розділити користувачів за доменом задач. Тут я вважатиму що вони всі користуються агентами де це має сенс і ігноруватиму вартість процесу, орієнтуючись лише на результат.
Вартість я розгляну у іншому розділі.
Важливо, я не кожен день користуюсь всім що знаю, не є експертом у всьому на світі і не маю можливості перевірити або освіжити геть усе з чим працював у притомний термін. Десь можу помилятись, зважайте на це, але ось що в мене вийшло:
|
Домен |
Як працює? |
Чому? |
|
Типові веб застосунки (React, Node, Python, TypeScript, тощо поширене) |
Добре, інколи дуже добре якщо мова тільки про код, без проблем невстигання рев’ю за кодом. Як мінімум, типові речі, якість на рівні джуна — він точно дає. |
Домінує в тренувальних даних |
|
Boilerplate і шаблонний код |
Відмінно |
Типові патерни, мільйони прикладів |
|
Документація |
Нормально |
Багато прецедентів |
|
Ультракороткий ізольований код (тести наприклад) |
Добре |
Простий код ревью |
|
Рефакторинг у типових кодових базах середнього розміру |
Добре при правильному контексті і усвідомленому оновленю правил людиною. |
Cursor, Copilot, Claude Code — багато прецедентів як за, так і проти, але це точно не повністю автоматичний процес |
|
Пошук, переклад, структурування думок, чатинг в межах контексту |
Дуже добре |
Рідна стихія LLM |
|
Генерація відео/фото/аудіо/3d |
Від добре до погано |
Все залежить від того наскільки строге й точне у вас тз. Отримати щось приблизно схоже — просто, отримати точний результат — вже набагато складніше. |
|
Архітектура великих систем, велика, пов’язана кодова база |
Погано |
Контекст губиться, немає розуміння системи в цілому |
|
Legacy-код |
Нестабільний результат |
Там і розробники не завжди повністю розуміють як воно працює. ШІ легко ламає такий код, не маючи достатнього рівня обережності й інтуїції. |
|
Gamedev |
Погано (із слів колег) |
Тренувальні дані сильно засмічені, немає різноманіття агентів (із слів колег). |
|
Embedded / hardware |
Переважно погано |
Добре працює лише в обмежених випадках. Складність інтеграції з залізом. Мала кількість і погана якість тренувальних даних. Проблеми із новими чипами й свіжими SDK |
|
Регульовані галузі (охорона здоров’я, фінанси, оборона) |
Недостатньо надійно |
Відповідність, конфіденційність, відповідальність |
|
Внутрішні корпоративні системи |
По різному |
Публічних знань немає, кастомізація інколи коштує досить дорого, довго, часто несе додаткові ризики |
В більшості інших відомих мені випадків — це працює погано або немає простих рішень.
За сфери з котрими я не мав справу, або не мав справу використовуючи ШІ — нічого не можу сказати.
Не забувайте що також існують сфери куди «професійне ШІ ще не дібралось». Там проблема не в тому що «ШІ поганий для цієї задачі». Проблема там в тому що ШІ навчений переважно на тому що є у відкритому доступі — а у відкритому доступі домінує веб. Для багатьох сфер необхідні свідомі сфокусовані зусилля для формування спеціалізованих датасетів.
Рівні доступу
Наступним, я б хотів розділити користувачів за рівнем доступу до інструментів та рівнем їх використання, бо очевидно що ступінь залучення ШІ до роботи відрізняється від користувача до користувача.
Ось що в мене вийшло:
|
Рівень |
Хто |
Особливості |
Переважаюча думка (на особисту думку автора) |
|
0 — Вайб кодер |
Не розробник |
Результат без коду |
Живуть в окремому всесвіті, в рамках статті туди лізти немає сенсу. |
|
1 — Безкоштовна підписка або казуальний користувач |
Більшість |
Обрізана версія, моделі минулих поколінь, переважно лише вбудовані агенти |
«ШІ переоцінений» |
|
2 — Базова підписка ($20-60) |
Активні розробники |
Агенти, передові моделі |
«Є сенс для рутини» |
|
3 — Дорога особиста підписка ($100-200) |
Нечисленна «еліта» |
Теж саме що і 2, але із значно більшим обсягом залучення агентів |
«Революція!» |
|
4 — Ентерпрайз |
Великі й середні компанії |
Прецеденти примусу до використання. Не відчувають вартість. |
дуже по різному. |
Ключова ідея тут в тому, що всі вони говорять про ШІ, але їх повсякденний досвід роботи із ШІ дуже відрізняється. Кожен із них правий, але кожен із них насправді говорить про «різний ШІ».
Класифікація, за тим «хто платить»
Тут я свідомо роглядаю тільки бізнес. Індивідуальна мотивація людини, на мою думку, має дуже значну емоційну складову, тому у цьому розділі я свідомо групую лише бізнес. Всі дані лише особиста думка автора.
|
Група |
Походження коштів |
Відповідальність |
Мотивація |
Голос у дискусії |
|
Власний продукт |
Із власних коштів |
Переважно прозора |
Реальний результат |
Обережний, зважує ризики |
|
Fixed price підряд |
Замовник, фіксована сума |
Часткова |
Маржа на швидкості — єдине де стимули збігаються з замовником |
Прагматичний |
|
Продавець лопат (аутсорс і подібні) |
Замовник, білінг годин |
Суперечлива |
Декларує ефективність але не зацікавлений у білінгу |
Голосно про впровадження, тихо про ROI |
|
Корпоративний хаос |
Бюджет без власника |
Нульова |
Отримати премію |
Найгучніший |
|
Ентузіаст |
Неважливо |
Не думає |
«Бо це ж ШІ! » |
Найемоційніший |
Наступним я спробував звести це у вектори дискусій.
Вектори викривлення публічного дискусу
Вектор 1, тарифний. Більшість формує думку на free/$20. Але найпотужніша інтеграція можливостей — це від $100-200/міс.
Вектор 2, доменний: Навіть $200/міс не вирішує проблему датасетів і спеціалізованих рішень.
Вектор 3, мотиваційний: Люди що говорять голосніше за всіх — зазвичай не мають фінансового обтяження (або платять не самі, або для них не це має значення, або взагалі премію за це отримують). Але вони часто формують наратив для індустрії.
Вектор 4, вартісний: «Я використовую агенти» — однаково кажуть і розробник на $20, і розробник за котрого платить компанія. Різниця в досвіді колосальна, у дискусії — невидима.
Вектор 5, емоційний: ентузіасти, перше використання й подібні випадки. їх голос стабільно позитивний або негативний, незалежно від об’єктивних факторів.
Сподіваюсь я не сильно загалом об’єктивно помилився, бо це все, нагадаю — моя особиста думка.
Пам’ятайте у дискусіях про ШІ, що ви всі можете говорити про ШІ, але мати на увазі дуже різний досвід із ШІ.
А до яких груп, належите ви?
4 коментарі
Додати коментар Підписатись на коментаріВідписатись від коментарівстатя написана ші ? :-)
А він вміє писати в такому стилі?
Якщо це узагальнення якогось дослідження, то надайте вихідні дані. З мого досвіду (я розумію, що це може залежати від конкретних умов, і не узагальнюю), в обох випадках зараз працює добре. Добре в цьому випадку — дає суттєвер пришвидшення:
- умовно 1+ день роботи без ШІ перетворюється в
0.5-4 години роботи з ШІ - ШІ знаходить неочевидні проблеми та описує карйові умови
- дозволяє чи не миттєво закрити «нудні» моменти та концентруватися на складних
Враховуючи вашу попередню статтю дуже складається враження, що ви описуєте стан справ річної+ давнини.Тут ще смішніше, бо в медицині ШІ часто використовувати ще до ЛЛМ, особливо для роботи зі знімками. Розмовляв з кількома лікарями, що його використовують для діагностування (щоправда там спеціалізовані рішення), з їх слів «точність краща ніж у посереднього лікаря».
Тут важливо розуміти, що в формулюваннях «Недостатньо надійно» то і лікарі мають десь такий самий результат :)
П.С. Стаття по структурі дуже схожа на видачу «напиши мені науково-популярну статтю»
Таке відчуття що ви не читали.