← Усі статті

Ukrainian LLM Leaderboard: рейтинг моделей українською

Мінцифри, УКУ та lang-uk відкрили на Hugging Face відкритий рейтинг LLM українською: переклад, переказ, пошук, логіка, ЗНО.

Ukrainian LLM Leaderboard: рейтинг моделей українською
Зміст

Коротко

В Україні запустили Ukrainian LLM Leaderboard — відкриту платформу порівняння великих мовних моделей за якістю роботи з українською мовою. Про це повідомили в Мінцифри; результати, код і дані виклали на Hugging Face. DOU передає деталі ініціативи Центру компетенцій WINWIN AI, УКУ та lang-uk.

Що сталося

Досі команди спиралися на міжнародні еталонні тести та заяви виробників. Українську в таких тестах часто оцінювали через машинний переклад — реальні помилки моделей лишалися непомітними.

Новий рейтинг ганяє моделі на завданнях ближче до практики: переклад, переказ і стислий виклад, пошук у документах, логіка, математика та тести рівня ЗНО. Таблиця показує не один «загальний бал», а розбивку за тестами: модель може добре відповідати українською й просідати в перекладі.

Керівник розробки моделі Lapa, аспірант УКУ Юрій Панів, формулює проблему так: після появи великих LLM було незрозуміло, де сильні й слабкі сторони саме для української і яку модель брати під яке завдання.

Далі планують додати роботу із зображеннями, оцінку етичності, вартість використання українською, а також сценарії з адміністративними процедурами, нормативними текстами та персональними даними.

Чому це важливо

Для продукту українською «топ у MMLU» майже нічого не каже. Потрібні відтворювані заміри рідною мовою: інакше вибір моделі — лотерея за маркетинговими слайдами.

Відкритість на Hugging Face знижує бар’єр: можна звірити методологію, а не лише читати пресреліз. Для команд в Україні й для продуктів з українським інтерфейсом і підтримкою це практичний орієнтир при виборі API чи локальної моделі.

На практиці

  1. Перед вибором моделі для українського продукту відкрийте таблицю на Hugging Face і дивіться профіль за завданнями, а не один рядок рейтингу.
  2. Звірте свій сценарій (переклад, пошук у документах або діалог) з відповідним тестом рейтингу.
  3. Не покладайтеся лише на англомовні еталонні тести — для української вони систематично завищують очікування.
  4. Стежте за оновленнями: зображення, етика й адмін-тексти ще в планах — зараз фокус на тексті.
  5. Збережіть посилання на методологію: у суперечці «яка модель краща» аргумент із цифрами сильніший за думку з чату.

Підсумок

Ukrainian LLM Leaderboard — рідкісний випадок, коли держ- і академічна ініціатива дає розробникам вимірний орієнтир українською, а не черговий слоган. Має сенс закласти перевірку за цією таблицею в процес вибору LLM.