Перейти до основного вмісту
Рубрики
Штучний інтелект
Технології

Запускаємо перший національний рейтинг ШІ-моделей за рівнем володіння українською мовою

Автори
Прес-офіс Міністерства
Дата та час публікації:
Час читання:
3 хв
Зображення новини Запускаємо перший національний рейтинг ШІ-моделей за рівнем володіння українською мовою

Чи траплялося вам отримувати від штучного інтелекту відповіді з російськими кальками, перекрученими відмінками чи навіть фейками про Україну? До сьогодні розробники обирали нейромережі наосліп, просто довіряючи маркетинговим презентаціям глобальних корпорацій. Щоб змінити це, ми запускаємо Ukrainian LLM Leaderboard — національний рейтинг, який об’єктивно вимірює, наскільки якісно та чи інша модель насправді володіє українською мовою.

Центр компетенцій WINWIN AI при Мінцифрі разом з Українським католицьким університетом (УКУ) та ініціативою lang-uk створив відкриту платформу. Вона оцінює здатність великих мовних моделей працювати з різними завданнями українською.

Об’єктивні дані замість маркетингових обіцянок

Штучний інтелект уже працює в десятках щоденних сервісів: від державних застосунків до банкінгу. Раніше світові рейтинги тестували ШІ переважно англійською, а українську перевіряли через машинний переклад, приховуючи реальні помилки. Тепер лідерборд замінює сліпу віру на точні вимірювання якості. Держава отримує надійну базу для вибору технологічних рішень, бізнес об’єктивно оцінює рентабельність інтеграцій, а дослідники мають єдину систему координат.

Після появи великих мовних моделей було незрозуміло, як добре вони працюють для української мови: які їхні сильні та слабкі сторони, для яких завдань які моделі краще підходять, де досі є прогалини в якості роботи з українською. Метою створення українського лідерборду було дати відповідь на ці питання, зібравши наявні бенчмарки від спільноти українського NLP та створивши нові. Сподіваюся наша ініціатива допоможе як бізнесу у виборі найкращих моделей, так і дослідникам у їхній роботі

Юрій Паніваспірант УКУ, керівник розробки мовної моделі для української мови Lapa

Як тестують нейромережі

Експерти перевіряють алгоритми на завданнях, які максимально відтворюють реальні умови. ШІ повинен:

  • перекладати, переказувати та стисло викладати великі тексти;
  • шукати відповіді в документах та розв’язувати логічні задачі;
  • складати тести зі шкільної програми на рівні ЗНО;
  • виконувати математичні обчислення та складні інструкції.

Усі результати, код і дані ми відкрили для громадськості на платформі HuggingFace. Кожен користувач може вільно порівнювати моделі та перевіряти методологію.

Синергія науки та держави

Правила, за якими рейтинг оцінює штучний інтелект, розробили експерти з Українського католицького університету та спільноти lang-uk (Юрій Панів і Дмитро Чаплінський). Ця команда понад 10 років учить нейромережі розуміти українську мову. Вони збирають масиви текстів та створюють інструменти, з якими потім працюють розробники по всій країні. Підхід до тестування абсолютно надійний: його вже успішно застосували, коли навчали українську ШІ-модель Lapa LLM, та презентували на міжнародних наукових конференціях.

Неможливо керувати процесами, які ти не вимірюєш. Ми вбудовуємо штучний інтелект у сервіси для мільйонів людей — і маємо ухвалювати рішення виключно на основі доказів, а не обіцянок. Лідерборд робить якість української мови в моделях публічним і доведеним фактом

Роман КислийChief AI Officer у WINWIN AI Center of Excellence

Що далі

Команда планує постійно розширювати платформу. Згодом ми додамо перевірку роботи із зображеннями, оцінку етичності та аналіз вартості використання ШІ українською. Окремий фокус спрямуємо на потреби держсектору: як моделі опрацьовують адміністративні процедури, нормативні тексти та чи безпечно вони працюють із персональними даними.

Переглядайте рейтинг та тестуйте моделі за посиланням.

WINWIN AI Center of Excellence — це центр компетенцій при Мінцифрі, який відповідає за розбудову державної AI-інфраструктури та портфель AI-продуктів.