Великі мовні моделі (LLM) неанглійськими мовами цьогоріч зрівнялися за рівнем роботи з англомовним оригіналом. Це дає значний імпульс зростання національним економікам, які, скориставшись моментом, розпочали активне використання AI. Україна має шанс отримати одну з найкращих мовних моделей в світі.
Світ переживає вибухове зростання використання AI. Найуспішнішим регіоном стала Азія: 12 із 15 найшвидше зростаючих за цим параметром економік перебувають в Азії. У кожній із них кількість користувачів штучного інтелекту щонайменше на 25% більша, ніж у червні 2025 року. Докладніше про це можна прочитати в матеріалі CNA.
Одним із ключових чинників спалаху стало посилення підтримки локальних мов у ШІ, зазначають експерти Microsoft у своєму дослідженні «Microsoft, «Global AI Diffusion Q1 2026 Trends and Insights».
У 2026 році, за даними дослідників, інструменти ШІ локальними мовами вперше зрівнялися за рівнем з англомовними у здатності обробляти багатомовні завдання.
Головний висновок з цього – мова запиту до ШІ стає набагато менш важливою. Якщо у 2023–2024 роках багато фахівців радили: «Для кращої відповіді ставте запитання англійською», – то на сьогодні ця рекомендація майже втратила сенс: найкращі моделі дають практично однакову якість англійською та більшістю великих мов.
Два роки тому різниця між англійською та іншими мовами становила близько 9%, а до травня 2026 року вона знизилася майже до нуля.
Рівень роботи LLM англійською у порівнянні з іншими мовами. Результати у бенчмарках MMLU та MMMLU (14 мов)
Дані було отримано за допомогою тестів MMLU та MMMLU, які оцінюють розв’язання завдань різними ШІ на 14 мовах. (Йдеться про групу мов, які охоплює оцінка MMMLU: арабська, бенгальська, німецька, іспанська, французька, гінді, індонезійська, італійська, японська, корейська, португальська, суахілі, йоруба та китайська).
MMLU (Massive Multitask Language Understanding) — один із найвідоміших тестів на знання та міркування для LLM. Він містить питання з математики, історії, фізики, права, медицини та багатьох інших дисциплін.
MMMLU (Multilingual MMLU) — багатомовна версія того ж тесту, де питання подано різними мовами.
Це разом із широким поширенням смартфонів і високим рівнем цифрової активності сприяє швидкому зростанню ефективності використання ШІ в різних країнах, де основною мовою не є англійська. Для України це особливо актуально в контексті запуску україномовної LLM.
У минулому році Україна розпочала розробку національної LLM. У травні 2025 Михайло Федоров, на той час міністр цифрової трансформації анонсував запуск першої україномовної LLM.
На думку міністра проєкт відкриває можливості для створення тисяч українських ШІ-продуктів, таких як віртуальні помічники (аналог ChatGPT), генератори тексту (Notion AI) чи інструменти програмування (Copilot).
Проєкт розглядають як базову інфраструктуру для розвитку штучного інтелекту в Україні.
Розробники заявляють, що LLM допомагатиме українцям у державних сервісах, бізнесі, науці, освіті, обороні та інших сферах.
Власна велика мовна модель посилить національну безпеку України у зв'язку з локальною обробкою даних, що особливо важливо у сфері оборони, уряді, медицині та фінансах.
У березні 2026 модель отримала власну назву «Сяйво».
Вона буде тренуватися на українських даних, враховуватиме український контекст, діалекти й терміни. Також модель має допомогти бізнесу та державі швидше й дешевше створювати локалізовані ШІ-інструменти, наприклад, чат-боти, голосові асистенти чи консультантів для магазинів.
Українська мова зараз виглядає виграшно на тлі багатьох інших. Завдяки колосальним обсягам перекладів, новин, офіційних документів і цифрового контенту, що з'явилися після 2022 року, частка української в даних, які використовуються для навчання ШІ відчутно зросла. Відтак розрив між англійською та українською зазвичай менший, аніж між англійською та більшістю мов зі схожою кількістю носіїв.
Тому Україна має шанс отримати одну з найкращих мовних моделей в світі.
Дані: Microsoft, «Global AI Diffusion Q1 2026 Trends and Insights»
Текст та інфографіка: CNA