Gemini 2.5 одразу після релізу вийшла у топ
Google несподівано зробили реліз моделі Gemini 2.5. Вона одразу показала себе відмінно на цілому ряді бенчмарків, та що цікавіше, посіла топ у LMArena, отримавши фавор в очах «юзерів»:

Із доступних ітерацій поки що тільки Gemini 2.5 Pro Experimental. Інші моделі на кшталт Flash вийдуть у реліз пізніше.
Нею вже можна скористуватися, без підписки та обмежень щодо регіонів, як це зазвичай буває із найпередовішими розробками. Головне не забути перемкнутися на правильну модель у налаштуваннях.

На багатьох бенчмарках вона також показала себе гарно. Але, наприклад, вона просіла на тестах з генерації коду. Вона стала краща порівняно із версією Gemini 2.0, але все ще не найкраща у категорії.
У тесті із науки GPQA нова модель Google іде із мізерним відставанням від Claude та Grok, але і тут є нюанс:
Без методів тестового часу, які збільшують вартість, таких як голосування більшості, 2.5 Pro лідирує в бенчмарках математики та науки, таких як GPQA та AIME 2025, — зазначають у Google.

Як більшість сучасних розробок, це «думаюча» модель, спеціалізована для виконання складних задач:
«Протягом тривалого часу ми досліджували способи зробити ШІ розумнішим і більш здатним до міркування за допомогою таких технік, як навчання з підкріпленням і підказки „ланцюжок думок“. На основі цього ми нещодавно представили нашу першу модель мислення, Gemini 2.0 Flash Thinking», — йдеться у релізі.
Як зазначають у Google, їм вдалося поєднати значно покращену базову модель та посилене пост-навчання нейромережі. Остання деталь: Pro має вікно контексту в 1 мільйон токенів — незабаром воно буде збільшене до 2 мільйонів токенів.
Скористуватися новою розробкою можна на gemini.google.com. Пізніше вона буде доступна на Vertex AI.
Читайте: Google випустили найпотужнішу модель для одного GPU
Немає коментарів
Додати коментар Підписатись на коментаріВідписатись від коментарів