Національна велика мовна модель України буде тренуватися на основі Gemma-3, розробленої компанією Google. Цю інформацію оприлюднило Міністерство цифрової трансформації України, уточнюючи важливість даного кроку для розвитку штучного інтелекту в країні.
Спільно з оператором мобільного зв’язку «Київстар», Міністерство обрало Gemma-3 завдяки її видатним характеристикам. Ця модель не лише оптимально поєднує ресурси та продуктивність, але й є однією з кращих серед доступних моделей з точки зору співвідношення розміру та якості. Важливою перевагою є також багатомовність Gemma-3, яка вже підтримує українську мову і може легко адаптуватися до специфіки україномовних текстів завдяки донавчанню.
Gemma-3 демонструє мультимодальність, що дозволяє аналізувати не тільки текст, а й зображення. Користувачів також порадує розширений токенайзер, який забезпечує довге контекстне вікно, що надає змогу обробляти значні обсяги інформації — до 128 тисяч токенів.
Для покращення роботи цієї моделі з українською мовою Міністерство планує вдосконалити токенайзер, донавчити модель на основі унікальних україномовних текстів, а також створити тести для точнішого налаштування в майбутньому. Це покращить якість генерованих україномовних текстів і зменшить можливі помилки.
Крім того, Мінцифри вже анонсувало запуск AI Factory — інфраструктури, призначеної для роботи державних сервісів в галузі штучного інтелекту. Ця ініціатива сприятиме розвитку та інтеграції нових технологій у суспільство, роблячи їх доступнішими для українців.