Користуєтеся китайськими моделями? Чому?
Подумалося, що зараз набирають популярності китайські моделі на кшталт DeepSeek, Qwen, Kimi чи GLM. Причому не тільки для якихось опенсорсних задач, а ще й як повноцінні продукти з платними підписками.
Тож цікаво було дізнатися, чи є тут ті, хто щупав комуністичні китайські модельки, і як вони вам у порівнянні із західними, американськими моделями?
Або ж, якщо тут є гурмани, то як щодо європейських моделей? Чи є серед них щось, що реально може конкурувати з ChatGPT, Claude, Gemini та іншими популярними штуками?
19 коментарів
Додати коментар Підписатись на коментаріВідписатись від коментарівЯ використовую як правило gemma4, оскільки мене більше цікавлять різні слоп історії і українська мова. Qwen як і claude, стає максимальною нємощью як тільки тобі треба щось інше крім пайтон скрипта. В agentic всі лайно, хоча gemma на практиці краще, бо виявляється, треба бути гуманітарієм щоб розуміти що хоче від тебе користувач, а китайцю треба все обсмоктувати. І gemma4 значно менше цензурована у всіх сферах
Більше великими моделями не користуюся, вони все одно не можуть виконати сильно краще те що мені треба + конфіденційність
DeepSeek, наприклад, на відміну від флагманів, дозволяє робити речі на грані. І це нерозлочений, звичайний офіційний. Якщо ж брати розлочені моделі, то відповідь очевидна — для хакінгу, реверсінжинірінгу та подібних речей без unrestricted моделів просто не обійтись.
В качестве ассистента мне Kimi даже бесплатный больше нравится, чем платный ChatGPT. Думаю, дело не в модели, а в том, как долго модель может анализировать информацию и предоставлять в удобном виде самое важное.
Якщо чисто практично, то Deepseek V4 flash latest десь на рівні Gemini 3.7 flash чи Sonnet 4.6. Десь там і Qwen 3.8. Звичайно це все суб’єктивно на моєму колі задач. І знову ж таки суб’єктивно ось у даний конкретний момент часу ChatGPT моделі поза конкуренцією практично за всіма параметрами (окрім ціни звісно).
все, що Gemini — це автоматично десь на дні рейтингу
Одна контора — тіко американське, бо секюріті. Друга — все одно, лише б дешевше.
Можу порівняти: GLM 5.3 все ще не рівня опусу.
А самий потужний варіант — дві різні моделі попросити скласти план, а потім давати ті плани на ревью опоненту.
глм5.3флеш это сонет 4.5. буквально. он себя таким считает и считает что хостится на claude.ai/new а не там где я его потыкал. за 18 долларов они предлагают 300м токенов в неделю ну и скидка до 12 долларов есть. думаю они скоро «украдут» и опус. с такими расценками антропик выглядит совсем плохо
Я твоя, твоя, твоя модель...
перефразовуючи джобса, модел із е фіче, нот а продакт
цікаво потестити Ollama із китайцськими моделями. З того, що я розумію, то можна запускати їх навіть у claude code harness, тільки через прослойку. Все ніяк руки не доходять затестити, але звучить як значне здешевлення, хоча не дуже зручно, якщо компанія юзає інфраструктуру одного провайдера(той самий клод).
Недавно прочитал, что z.ai стали работать на китайских чипах, т.е. полностью убрали зависимость от CША
У меня знакомый пользуется, тоже планирую попробовать
18$ це або 20$ в міс Cursor. Таке. Для естетів китайських моделей
Пробував раз Якийсь невдалий клон chatgpt який мені зовсім показався топорним
Китай на стадії побудови такої ж інфраструктури у 10 разів дешевше. Захід пішов не туди і гірко за це поплатиться.
І хто ж буде настільки наївним нею користуватись?
Дармяо сир-хуа ли-ше в паст-цзі — древньокитайська мудрість
да все подряд, дешево же и результат тот же, а охранять свой сгенерированный этой же моделью говнокод от нее же — это новый уровень безумия
Нормально . Дешево . Робив сайд прожект витратив аж 14$ за 510млн токенів. Головне мати детальні специфікації
і як багато за ними треба правити, в порівнянні з умовними claude/gpt?
Нічого руками не правив — була openspec документація — по неї даже kimi нормально працює. По китайським моделям Єдине що трохи повільно та в документацію вони не дуже. Доречі в Deepseek є дешеві години. Це набагато краще чем ці умовно безкоштовні варіанти — open-router, free tier Gemini...