Login

Мінцифри і «Київстар» обрали AI-модель, на якій працюватиме національна LLM

Мінцифри та «Київстар» визначили базову архітектуру, на якій будуватимуть українську велику мовну модель. Для національної LLM обрали Gemma 3 — відкриту модель Google, яку адаптуватимуть під українську мову та локальні завдання.

Про це DOU повідомили в Мінцифри.

Проєкт курує WINWIN AI Center of Excellence. Його керівник Данило Цьвок каже, що вибір робили з огляду на якість роботи Gemma з українськими текстами, можливість контрольованого навчання та мінімізацію лінгвістичних ризиків.

Директор з розробки диджитал-продуктів «Київстар» Михайло Нестор додав, що модель також обрали через баланс продуктивності та вимог до інфраструктури.

«Модель підтримує понад 140 мов, включно з українською, має до 128 тисяч токенів, мультимодальні можливості (робота із зображеннями) та гнучку архітектуру, що дозволяє адаптувати її під різні завдання», — каже Нестор.

Також модель має декілька розмірностей, що дозволяє легше адаптувати її під різні сфери застосування.

Тепер розробники адаптуватимуть під українську мову. Зокрема:

  • покращать токенайзер, щоб оптимізувати обчислювальні витрати і зробити національну LLM більш точною з українськими текстами;
  • додадуть великий корпус україномовних текстів, над якими працюють спеціалісти;
  • створять власні бенчмарки, щоб перевіряти точність.

Зазначимо, що модель Gemma вже використовують україномовні LLM — MamayLM та Lapa LLM.

Похожие статьи:
У рамках Kyiv International Cyber Resilience Forum 11-12 березня компанія Cyber Unit Technologies разом з Державним оператором тилу проведе Bug Bash DOT-Chain. ІТ-фахівців...
1000 українців та українок, які постраждали від війни або є ветеранами, зможуть отримати стипендії на платні ІТ-курси від освітньої...
Євген Сиваченко — CTO компанії Oko Camera. Вона виготовляє тепловізійні модулі для БпЛА і нещодавно перемогла на Defense Stage на IT Arena Lviv 2024....
На своїй щорічній конференції Think компанія IBM презентувала Watsonx — нову платформу, яка надає інструменти для створення моделей...
Цієї осені готуйтесь почути історію успіху людини, яка згуртувала 105 тисяч ІТ-шників з усієї України в одному місці — Макса...
Switch to Desktop Version