🤖 Для яких задач я використовую AI Coding Agents
Вже більше ніж три місяці я постійно використовую AI в розробці як на фулл тайм роботі так і для особистих проектів. Особисто мені найбільше сподобався Claude Code і весь цей час я використовую саме його.

Виділив для себе список задач, які він добре вирішує:
1. Генерація юніт тестів — це та задача, заради якої я хотів спробувати Coding Agents. Як результат, економія часу близько 80%. Потрібно лише показати йому один раз як правильно писати юніт тести і після цього він буде їх генерувати достатньо добре і швидко.
2. Генерація назв коммітів та опису для Pull Requests — маленька задачка, але економить мені приблизно
3. Рефакторинги малого і середнього розміру — достатньо добре справляється із рутинним рефакторингом, по типу посортувати файли, добавити domain шар, розділити data шар, переписати з Java на Kotlin та з RxJava на Kotlin Coroutines. Але великі рефакторинги я йому не даю робити, так як ціна помилки може бути велика і з таким він вже не справляється.
4. Code review і потенційні покращення — коли роблю code review або просто переглядаю код, полюбляю деколи просто запитати AI — «Що тут можна покращити?» І він зазвичай мені дає хороші поради як якийсь код можна спростити, або покращити.
5. Аналіз кодової бази — коли мені потрібно розібратись в якійсь частині проекту, яку я ніколи не бачив (а таке часто буває на середніх або великих проектах), я прошу AI щоб він проаналізував всі файли і видав мені короткий підсумок що там відбувається. Це економить достатньо багато часу і після цього стає в рази легше розбиратись в коді.
6. Генерація JavaDoc та KotlinDoc — деколи потрібно згенерувати документацію до конкретного класу або методу і AI це робить дійсно добре. Хоть і рідко така задача виникає, але часу економить це не мало.
💭 Чи використовуєте Coding Agents ви?
🔗 Більше — в Телеграм каналі IT & Android
53 коментарі
Додати коментар Підписатись на коментаріВідписатись від коментарівПрикрутіть claude code review bot, неймовірно корисна штука.
Видає код ревю не гірше за людину
Не совсем он может быть обучен на предыдущих версиях вашего языка программирования.
Хлопцы, скажите кто уже так делал? Слив кодовой базы на ПК, документирование т.е. ИИ разбирает чужой код и предлагает что лучшее, переписывание проблемных участков кода с помощью ИИ. Первое что приходит в голову это лама, хлопцы говорили что без проблем ставиться локально. И еще вопрос для решения подобного класса задач, какой тарифный план выбрать, безоплатный я так понимаю уже подойдет?
Повністю так само. Пишу тести, бо раніше на них не було часу, а тепер є.
e2e пишит гарноПолная автономия пока сложна, но80-90% задач уже можно автоматизировать с помощью ИИ.
ИИ генерирует базовые тесты
Человек их проверяет и корректирует
Self-healing система поддерживает актуальность
ИИ-аналитика оптимизирует покрытие
Используем Playwright + ChatGPT для генерации тестов. Далее создаем систему с GPT-4 API для полной автономии. Что скажите? Вот код:
# docker-compose.yml для ИИ-тестирования services: ai-test-runner: image: playwright:latest environment: - OPENAI_API_KEY=${OPENAI_API_KEY} volumes: - ./tests:/tests - ./reports:/reports command: python ai_test_orchestrator.py visual-ai: image: applitools/eyes-selenium test-analytics: image: custom/ai-analytics ports: - "3000:3000"Порадьте будь ласка — що можна подивитись (відео або канали) або почитати доку, щоб побачити як з цим конкретно працювати, на якихось реальних прикладах. Наприклад цікавить створити прототип desktop or web app для особистих потреб.
Для рівня початківця.
Скажу чесно, ніколи не дивився гайди, але якщо для desktop або web app то можу порекомендувати Cursor.
Ось в цьому відео достатньо добре і детально пояснюється для початківців як ним користуватись:
youtube.com/watch?v=...5cHWQ?si=iEvLIzT3dJlljo8V
Дякую! Мабуть те що треба мені.
З юніт тестами в нас був прикол — АІ нагенерував купу тестів з коментарями, все пркрив, виглядало — супер. А потім, при прискіпливому аналізі, виявилося, що майже все — шлак, і відсотків 60 треба викинути, а інше оптимізувати. Інакше тести будуть займати разів в 10 більше часу ніж потрібно.
І ще водному місці АІ вперся в помилку імплементації і не дивлячись на чіткі інструкції як саме писати тест в цьому випадку намагався писати криво, не справлявся і страждав. Через годину вмовляння зрозуміли, що простіше самим виправити і додати те чого не вистачає :)
Думаю, що проблема була в промпті, або в широкому завданні і не в чітких рамках (модель почала фантазувати). Та і від моделі залежить...
дададад, точно
вайбкодєнк — воно взагалі як комунізм: на практиці завжди геноцид і концтабори, але ж «вони все робили непоравільно! от зара ми візьмемся strong азазаз!»
мне ваши речи и отношение к вайбкодингу напоминают движение луддитов
по-перше, на русскам за парєбріком хрюкають
кастрюля не жмет?
В тебе воші під кокошніком завелись)
От тільки різниця у тому що ефорти на те щоб написати (типу) правильний промпт майже тотожні з тим щоб написати все самому от і питання — нахіба мені ця прокладка посередині
є таке, тут згоден. поки що ллм-ки не ідеальні щодо цього.
але вже пішов тренд (з останніх новин), щоб не наймати (або звільняти) тих хто не користується нейромережами...
Я більше бачу тренд що «AI bubble» вже здувається і спеціалісти які можуть провалідувати те що генерить ллмка без роботи не залишаться
З юніт тестами я би в будь якому разі спочатку хоча б пару тестів написав самостійно, щоб потім йому дати як приклад правильно написаних тестів. Після цього в мене був менший шанс що він буде генерувати якийсь треш.
ті в кого «шанси» швидко вилітають на мороз після епічного факапу який ставе замовника на гроші
подальших успіхів в гемблінгу
Та щось поки замовники навпаки самі заохочують AI використовувати. Вони бачать результати по швидкості доставки і раді що їх фічі швидше до юзерів доходять :)
Які ще «замовники» в «продуктовій компанії» та ще й вузької направленості?
Ви точно не забрехалися зараз?
факап будет, когда конкуренты, использующие LLM для кодинга, твоего «замовника» оставят с носом, пока он будет ждать когда кодер выспится, соберется с мыслью и силами, и сделает все как надо ручками.
Доброго дня! Цікавить ваш більш детальний досвід з пунктом 4. Code review і потенційні покращення. Ми тестували MR reviewer Gitlab Duo це просто треш 3/10 , банальщина , яка забирає ще більше часу ніж додає якоїсь ефективності.
Доброго дня! Я працюю з Claude Code і відповідно в нього моделі тільки від Anthropic.
Я перемикаюсь на бренч, для якого роблю code review і задаю йому промпт по типу «Analyze file X and generate a list of improvements taking into account all best practices».
Після цього він мені видає список з покращенням і я йому відповідаю — «Apply 1st, 3th, and 5th improvements, other — skip».
Він сам вносить зміни і я комічу код. Або якщо я роблю code review іншій людині, то пишу їй коммент відносно цих пропозицій від AI.
Пробував інші моделі, справлялись гірше. Сприводу Gitlab Duo нічого не можу сказати, бо не знаю яка там модель під капотом і не було досвіду.
Gitlab duo використовує : LLM: Anthropic Claude 4.0 Sonnet виглядає, що ми використовуємо однакові моделі.
ми дуже довго гралися з
Customize instructions for GitLab Duo Code Review
docs.gitlab.com/...ts/duo_in_merge_requests
але результат ніякий. Ми пробували описат, які речі довзолені на проекті і щоб їх не чіпав, але зі збільшенням промту він стає як лінтер , тупий і прямий.
Не пишу код руками вже більше року. Спочатку генерував скриптом необхідну для завдання кодову базу і закидував в чат, потім копіпастив з чату назад. Потім коли почали з"являтися агенти що самі аналізують і збирають необхідний код (перший це був Claude Code, зараз їх багато), то перейшов на них. Наразі використовую в порядку використання:
1. Claude Code
2. Codex CLI
3. Qwen Coder
4. Gemini CLI
Вважаю, що в програмуванні — це революція. Так само як в малюванні, медицині, музиці і т.д.
Погоджуюсь з вами! В мене був подібний шлях, тільки я зупинився на Claude Code. Не памʼятаю дня коли я його не використовував за останні місяці.
В цьому відео детально розповідається чому краще використовувати декілька моделей для їх перехресної перевірки
и что, в продакшн идет то, что ИИ «накодил» без правок? либо вам плевать на продакшн, либо у вас только POC.
я разве говорил что без правок? конечно проверяется, притом другими моделями. указывается в промпте что не так. на финальной стадии просматривается мной. у меня опыта уже 15 лет, поэтому с проверкой проблем нет :)
ну правки — это таки руками имхо. тут вопрос в терминологии, что считать «писать руками» :)
ну я это и имел в виду :)
А вообще, про продакшн есть хорошее видео от Anthropic «Vibe coding in prod | Code w/ Claude». В целом там идея, что у не CORE кода не нужно проверять каждую строчку. Человек выступает как бутылочное горлышко в таком случае. С кодом работают как с черным ящиком, контролируя входы и выходы с помощью тестов и других инструментов. Кто не научится так делать тот проиграет, я считаю.
в теории да.
но подход к блек-боксу и контролю на входе и выходе закрывает часть функциональную.
А вот секьюрити внутри остается непокрытой зоной при этом. И смотреть туда все-равно надо.
а з тривалою підтримкою-фічами — як процес? це ж треба увесь чорний ящик скормлювати
тести наше все :)
А потім воно десь тормозить і виявляється що той блек бокс генерить одиничні select запити у циклі межі якого контролюються вхідними параметрами, плавали знаємо 🤦♂️
тестувати треба щільніше
Не на кожному проекті є performance тести, для багатьох проектів це розкіш а звичайні юніти і інтеграційні це не виловлять у тестовому середовищі
тебе звільнять
і скоріше ніж ти думаєш
аргументи?
Ну... у мене більше функціональні тести, в принципі він згенерував один коли я робив контрибуцію в проєкт, але довелося правити. Тому нічого не можу сказати
Ну... Є питання, але простіше написати що тебе не влаштовує, ніж самому страждати як це сказати. Але.. rebase робить дуже погано, тому треба роботи самостійно, а потім вже просити його.
Ну... не дуже добре, ми мое я прискіпливий? Перфекціоніст, постійно зупиняю та кажу як треба.
Інколи запитую, тестую... але в принципі в пет-проєктах є моя точка зору, а є неправильна. Не памʼятаю, щоб він казав щось що я не знаю, та щоб не погодився. Він часто хоче банальності, які я не хочу додавати.
Так, трохи є.
Ну... на пет проєктах я не дуже переймаюся таким
N+1. Мотиватор: пропонує дурню, відразу хочеться йому це довести та реалізувати як треба. Та і в принципі цікавіше, не хочеш щось робити — просиш агента, він тупить, ти називаєш його ідіотом, дурнем, ...
N+2. Розбиратися з новими матеріаламі, триндіти вміє. Копіюєш текст, запитуюєш чи правильно розібрався, ... Просто потриндіти про щось...
Дякую що поділились! В цілому ці всі use cases залежать ще від проекту, технологій і персональних переваг кожного розробника.
Будьте обережними з делегуванням тестів. У мене був випадок, коли просто, щоб тест проходив (результат — створення файлу), клод «спростив» функцію просто до створення файла (перевірити файл автоматично неможливо, якщо що, це wav).
Ви праві! Але так як я Android розробник, зазвичай unit testʼи у нас ніяких файлів не створюють, хіба читають.
Але я в будь якому разі переглядаю згенерований код щоб там не було чогось підозрілого.
На основі чого?
На основі вже існуючих юніт тестів і відповідно класу для якого я хочу написати ці юніт тести.
тобто ви не розумієте що таке юніт тести
я так і думав
а потім черговий вайбкод-дурачок пише черговий пост «и, воно мені написало тести які завжди проходять»
а на основі чого пишуть тести в TDD?
от ето поворот... то ви шо, навіть в чат жопа ти не запитали?!
чи воно сказало «не знаю»?
ЗІ на основі специфікацій іх пишуть
TDD or whatnot
код має тому відповідати, а не навпаки
сіньйори ви б***ь скороспілі
Я до того і запитав, що тести пишуться не просто так. Звісно, що ти пишеш як має бути чи щось таке, пропонуєш написати тести для цього і зробити цикл TDD і потім рефакториш.
Судячи з практики автора, він просто намагається покрити вже існуючий код юніт-тестами і його логіка (що покривати та як) досить робоча.
По юніт тестам взагалі до LLM немає питань, тому що моделі це роблять дуже ефективно.
скажіть, у вас проблеми з читанням як таким, чи з розумінням прочитаного?
яку саме частину чат жопа ті не зміг для вас підсумувати?