OpenAI’s GPT-Mini, Column-R & U, Google’s Eureka : FULLY TESTED (Secret LLMs on LMSYS Arena)
Теж вирішив у своєму проєкті вибрати GGUF файл щоб на етапі розробки не сильно заморочуватись з тонкими налаштуваннями LLM.
Але потроху приглядаюсь до Safetensor, щоб краще контролювати свій ШІ.
Спробуйте і Ви, взятись за простенький проєкт, де поєднується все, що Вас цікавить.
Я, поки проходжу курси по Data Science на Python, паралельно для практики в програмуванні публікую періодично свої pet-проєкти на GitHub.
Потенційно — кожен з них, це точка входу в комерційний проєкт.
Керуюсь такою логікою. Але теж у LinkedIn вже 3 місяці статус «Open to work» і не густо по оферам, навіть по співбесідах.
Що ж, системна робота завжди приносить результати, треба лиш зачекати.
Я, коли почав ліцензувати свої вихідні коди, вибрав ліцензію MIT, тому що вона сама проста і зрозуміла. Продовжую використовувати її і далі.
А за статтю — дуже дякую. Нарешті я знаю як можна використовувати проєкти з іншими ліцензіями.
Гарна стаття. Дякую.
Хороше питання, про це думаю деякий час... Я поки що RAG не тягну, але попрацював з розробкою чат ботів на базі LLM.
Можна взяти велику мовну модель, і завантажити в її контекст кодову базу, зараз є LLM з розміром контексту у 128к токенів(наприклад Qwen2 або DeepSeek V2) , це солідна кодова база 128 тисяч слів...
LAMA3, навіть 70B, ніколи не дотягне до Claude або ChatGPT, банально — за нестачі параметрів
Якщо я пишу код використовуючи моментами ШІ, де самостійно складно, то де межа комерціалізації коду який виходить? 30/70%, де я пишу 70 а ШІ 30 відсотків, чи можне 95 на 5?
Коли треба щось запрограмувати, то постійно тупить генеруючи код.
Цей Mistral як локальна LLM такий багатослівний, втомлююсь читати і чекати, поки він нагенерить кілька абзаців тексту, де достатньо кілька речень.
Якщо по крутому — Розробка програмного-апаратного комплексу вимірювальної системи, по простому — багатоканальний вольтметр з логуванням показників на ПК.
Другий дипломний проєкт був простіший — Розробка плати керування реле з провідними і безпровідними інтерфейсами, якщо простіше — інтернет реле(по ідеї це аналог Sonoff).
Ось питання, чи правильна відповідь є — грає в шахи з третьою? Може правильна є — загадала цю загадку?
Так, можна дивитись на це з різних сторін, проте мова не про це.
Ахаха
Мені подобається Mistral AI 7B, правда коли я її запускаю локально, в LLM Studio то трохи довго генерує відповіді, проте контекстне вікно 32к — куди цікавіше 8к які в LLAMA3 7B.
Я вже добрався до LLM Studio, де гнучкіше можна задавати параметри і взагалі більше можливостей.
Але це вже не гра
Ось і я підтягуюсь до теми AI, хочу зробити щоб мій чат бот заговорив
Як мінімум Claude.