Національна велика мовна модель "Сяйво". Фотоколаж Мінцифри
"Це данина моді"
Україна запускає власну велику мовну модель "Сяйво". Чому вона потрібна?
Це більше данина моді. Саме державні структури цим займаються, хоча має займатися приватний бізнес. Щоб розвинути добре велику мовну модель, вона має бути дійсно великою. OpenAI вклали більше 100 млрд доларів, вони наразі є лідерами, виробляють ChatGPT. Хоча зараз уже підтягнулися і інші мовні моделі. Але навіть 5 млн доларів на розвиток національної великої мовної моделі (раніше оцінювалася вартість реалізації цього проєкту в суму від 1,5 до 2 мільйонів доларів – ред) – це крапля в морі, піщинка у порівнянні із OpenАІ. До лідерів, як до неба. І називати це великою мовною моделлю буде перебільшенням. Я доволі скептично ставлюся до таких ідей, особливо коли мова йде про наші з вами гроші платників податків.
"Розвитком технологій мусить займатися лише приватний сектор"
Ваша думка – чому в нас вирішили, що цим буде займатися держава?
У нас парадоксальна ситуація склалася. Такого немає ніде в іншій країні. І Україна в цьому сенсі унікальна. У нас держава очолила цифровізацію і вона використовує інструмент примусу. Так не може бути. Будь-який юрист-початківець скаже, що це передусім інститут примусу. А ось якимись інтелектуальними розробками, проривами, розвитком технологій мусить займатися лише приватний сектор. Це не функція держави.
Наша країна опинилася з 2019 року в абсолютно унікальній парадигмі, нечуваній раніше. І навряд чи яка буде колись повторена. "Дія" у тому вигляді, як вона існує в Україні, її немає ані в Німеччині, ані в Японії, ані в Сполучених Штатах, ані в Британії. І вони не поспішають переймати цей досвід. Хоча Естонії пропонувалося кілька років тому передати вихідний код додатку "Дії" безкоштовно. Вони відмовилися і пішли зовсім іншим шляхом.
Штучний інтелект – це модно, сучасно, в це можна вкладати гроші й звітувати по них дуже легко. Складно оцінити результати і досягнення. Немає чітких критеріїв оцінки результативності. Тому скільки б воно там не було вкладено, надзвичайно складно оцінити.
.jpg)
Костянтин Корсун. Фото: facebook
"Непогана назва. Це єдине, що я можу позитивного сказати"
"Сяйво" – як вам така назва?
Непогана назва. Це єдине, що я можу позитивного сказати. Як вона буде працювати і чи буде працювати? Вже більше року цей напрям працює. Влітку минулого року кілька журналістів тестували те, що було у вільному доступі, вони жахнулися.
Усі ШІ галюцинують без винятку, питання в тому, хто більше, хто менше. Але і таку оцінку провести надзвичайно складно, враховуючи колосальні обсяги даних. Тисячі петабайтів на колосальних серверах розміром (дата-центри) із невеликим містом. 10 на 20 км – немає таких обчислювальних можливостей, щоб порахувати усі запити усіх мовних моделей. Менше галюцинують ті мовні моделі, які почали раніше розвиватися. Хто раніше почав, більше натренував, вклав грошей, купив серверів, найняв інженерів, програмістів у навчання алгоритмам мовних моделей, ті мовні моделі менше галюцинують.
"Як комерційний проєкт – це абсолютний тупик"
Коли ми говоримо про адаптацію до українського та національного контексту. Що мається на увазі, як саме відбувалася адаптація?
Це те, що я називаю тупиковим напрямком розвитку, тому що великі мовні моделі у всьому світі, якщо хочуть монетизуватися і заробити гроші – витратити 100 млрд, а заробити 200 – треба продавати платну підписку. А ти не заробиш стільки, якщо будеш продавати лише в одній країні. Комерційні дійсно справжні великі мовні моделі націлені на продажі і по всьому світі. В одній бідній Україні з мінусовим бюджетом вже багато років і у війні – тут нічого не заробиш, тільки втратиш. Тому напрямок локалізації лише в межах однієї країни, нації чи мови – це більше політичний популізм. Сфокусовані на розумінні українського контексту, приказок, звичаїв, культури особливостей великі мовні моделі можуть про це набагато гірше знати, тому що їх не тренують саме в цьому вузькому напрямку. Якщо зосередитися у поясненні штучним алгоритмам, так званого штучного інтелекту, що саме означає якась приказка українська, то він буде більше це розуміти, якщо саме сконцентруватися на цьому напрямку. Це певним чином позитивно для української культури, мови, літератури. Але як комерційний проєкт – це абсолютний тупик. В якому напрямку розвиватися – незрозуміло, тому що той самий OpenAI ставить своїм напрямкам розширення із метою заробляння грошей. І для подальшого розширення і ще більшого заробляння грошей. Вони вже давно багатомільярдна компанія. А які напрямки у української великої мовної моделі? Я не знаю. Можливо, вони якось позначили, чого прагнуть цією мовною моделлю. Не зовсім зрозуміло. Якісь позитивні моменти будуть, але як їх використовувати в практичному житті – не дуже ясно поки.
Очевидно, самим процесом розробки дуже захоплена команда Мінцифри. Вони за це отримують пристойні зарплати. Це дуже захопливий, вигідний і цікавий процес. Це їм подобається. Але стратегічне бачення, якесь візіонерство не дуже притаманно українським чиновникам.
"Результатом має бути публічно доступна модель або через веб-інтерфейс, або через додаток"
Коли український штучний інтелект вже стане доступний користувачам?
Мені важко прогнозувати, тому що з усіх боків я бачу тут більше недоліків, ніж переваг. Минулого літа була відкрита демоверсія для загальнопублічного доступу. Чому вона досі недоступна? Або вона настільки галюцинує, що більше галюцинує, ніж каже правду, або не готова до масового використання. Якщо ми з вами за це заплатили, то хоча б через якийсь час маємо повне право вимагати, давати щось навзаєм. Ми вам дали гроші, ви щось робили, працювали – покажіть результати?! А результатом має бути публічно доступна модель або через веб-інтерфейс, або через додаток. Поки цього не має.
КОНТЕКСТ
"Сяйво" – це перспективна розробка у сфері штучного інтелекту, створена українськими розробниками. Цей проєкт є частиною ширшого руху за цифрову незалежність України та розвиток україномовних великих мовних моделей (LLM). LLM (англ. Large Language Model, Велика Мовна Модель) – різновид штучного інтелекту, навчений розуміти, генерувати людську мову. Якщо, наприклад, звичайна клавіатура у смартфоні вгадує наступне слово, то LLM може "вгадати" цілу статтю, програмний код або вірш, ґрунтуючись на контексті.
Понад 136 тисяч українців долучились до голосування стосовно назви національної LLM та обрали переможця – "Сяйво". Про це повідомила 30 березня Мінцифра.
Мінцифра зазначила: "Сяйво" – перша національна велика мовна модель, яку створюють Мінцифра разом із "Київстар". "Сяйво" працюватиме в держсервісах, бізнесі, освіті та обороні, допомагатиме швидше обробляти дані, автоматизовувати процеси й стане основою для нових цифрових продуктів.
До фіналу вийшли 10 назв, які ми ретельно відбирали. Головною умовою відбору була унікальність: ідеї мали бути оригінальними, без плагіату та порушень чужих прав. І саме "Сяйво" набрало найбільше голосів – 22 601".
Мінцифра подякувала кожному, хто долучився до голосування. "Ви – частина створення українського ШІ. Слідкуйте за новинами – попереду ще більше цифрових запусків", – наголосила Мінцифра.
Як заявляв рік тому тодішній віцепрем’єр-міністр із цифрової трансформації України Михайло Федоров, національну велику мовну модель реалізують за підтримки бізнес-партнерів, без залучення бюджетних коштів.
НАГАДУЄМО, ЩО УКРАЇНСЬКЕ РАДІО ― ВІДКРИТИЙ МАЙДАНЧИК ДЛЯ ДИСКУСІЙ. ПРЕДСТАВНИКИ МІНІСТЕРСТВА ЦИФРОВОЇ ТРАНСФОРМАЦІЇ УКРАЇНИ ТАК САМО, ЯК І ЕКСПЕРТ КОСТЯНТИН КОРСУН МАЮТЬ ЗМОГУ ВИСЛОВИТИ В ЕФІРІ СВОЮ ДУМКУ СТОСОВНО ЗАПУСКУ В УКРАЇНІ ВЛАСНОЇ ВЕЛИКОЇ МОВНОЇ МОДЕЛІ "СЯЙВО" І ЩОДО ТОГО, ЩО РОЗВИТКОМ ТЕХНОЛОГІЙ НІБИТО МОЖЕ ЗАЙМАТИСЯ ЛИШЕ ПРИВАТНИЙ БІЗНЕС.