Український ШІ «Сяйво» вчитиме історію: Укрдержархів передав моделі 10 терабайтів даних
зображення: Gabriele Malaspina
зображення: Gabriele Malaspina
Національна нейромережа «Сяйво» отримала великий масив знань — понад 10 терабайтів архівних документів, рукописів та наукових текстів. Це обсяг, що дорівнює приблизно 70 тисячам книжок.
Навіщо?
Більшість відомих чат-ботів (як ChatGPT чи Claude) спочатку «думають» англійською, а потім просто перекладають відповідь. Через це вони часто плутають український контекст або історичні деталі. «Сяйво» ж тренують безпосередньо на наших першоджерелах: від законів та судових рішень до давніх словників.
Що кажуть експерти?
Голова Укрдержархіву Анатолій Хромов наголошує, що для відомства це перший подібний досвід передачі даних для цифрових сервісів:
«До кінця 2026 року ми плануємо збільшити кількість цифрових копій з 150 до 200 мільйонів. Це один із найвищих темпів оцифрування архівів у світі. Ми маємо дані різних епох, і тепер вони допоможуть ШІ розуміти нашу історію».
Олександр Борняков (т. в. о. Міністра цифрової трансформації) додав, що зараз дані для моделі збирають «усім світом» — уже залучено понад 50 партнерів: медіа, університети та бібліотеки.
Про головне:
Мета: Побудова «ШІ-суверенітету», щоб технологія розуміла українців без посередництва перекладу.
Долучились понад 50 інституцій.
Як допомогти: якщо ви маєте якісні масиви даних (тексти, словники, архіви), можна заповнити форму або написати команді на ai@thedigital.gov.ua
