Компанія Google анонсувала нову модель штучного інтелекту Gemma 4 12B, яка здатна працювати з текстовою інформацією, зображеннями та звуком. Вона може бути запущена локально на ноутбуках з 16 ГБ оперативної пам’яті.
Основні характеристики нової моделі
Gemma 4 12B є частиною сімейства відкритих моделей Google і займає проміжне положення між компактною Gemma E4B та більш потужною моделлю Gemma 26B. Відзначається, що продуктивність новинки наближається до показників моделі 26B, проте вона вимагає менше ніж половину її пам’яті.
Інновації в Gemma 4 12B
- Gemma 4 12B стала першою моделлю середнього розміру в лінійці, яка отримала нативну підтримку аудіо.
- Google відмовилася від окремого аудіоенкодера, інтегруючи обробку аудіосигналу у спільний простір з текстовими токенами.
- Для обробки зображень був замінений окремий візуальний енкодер на спрощений модуль вбудовування даних, що дозволяє основній мовній моделі обробляти навантаження.
Призначення та можливості
Gemma 4 12B розрахована на виконання складних багатокрокових завдань і підтримує технологію Multi-Token Prediction (MTP), що зменшує затримки під час генерації відповідей.
“Gemma — це сімейство відкритих моделей ШІ, які вже перевищили 150 млн завантажень та застосовуються у різних проєктах, від робототехніки до систем кібербезпеки.”
Взаємодія з українськими ініціативами
В Україні у листопаді 2025 року було започатковано спільну ініціативу з компанією NVIDIA для створення суверенного штучного інтелекту та розвитку державної ШІ-інфраструктури. Проєкт є продовженням платформи AI Factory, що сприятиме технологічній незалежності країни та захисту даних.
1 грудня стало відомо, що Міністерство цифрової трансформації обрало Gemma 3 від Google як базову модель для національної української великої мовної моделі (LLM), а бета-тестування української мовної моделі планується на весну 2026 року.
Залишити відповідь