Национален план за възстановяване и устойчивост

Инфраструктура за фина настройка на предварително обучени големи езикови модели

В изпълнение (от дата на стартиране)ИСУН

Основна информация

Регистрационен номер
BG-RRP-2.017-0030
Източник на финансиране
МВУ
Начало
12/12/2024
Край
30/05/2026
Решение за финансиране

Описание

Големите езикови модели (модели с изкуствен интелект) вече се използват широко за предлагане и приложение на интелигентни решения в различни области. Обикновено те са претренирани основно за английски език и е необходима допълнителна фина настройка на български език с показатели за качество (смислова и граматическа правилност, разбиране на контекста, фактическа точност), съотносими с тези за английски.
От друга страна, тъй като компаниите се опитват да използват по максимално подходящ и сигурен начин технологиите с изкуствен интелект, фината настройка с данни на конкретна компания или индустрия, както. и за решаване на конкретни задачи е ключова за постигането на адекватни резултати.
Проектът предлага създаването на инфраструктура oт алгоритми и софтуер (със свободен достъп) за подбор и предварителна обработка на големи данни за български, както и на специфични за дадена компания или индустрия данни и фина настройка на подходящи свободно достъпни големи езикови модели за решаване на конкретни задачи. Инфраструктурата ще съдържа и протокол за оценка (автоматична и човешка) на фината настройка на големи езикови модели.
Работата на Инфраструктура за фина настройка на предварително обучени големи езикови модели ще бъде демонстрирана с фина настройка на български на голям езиков модел, както и решаване на конкретни задачи в дадена тематична област. Оценката на фината настройка за български език на предварително тренирани големи езикови модели ще бъде направена чрез сравнение с експерименти за оценка на английски и български език. Инфраструктураta за фина настройка на предварително обучени големи езикови модели ще интегрира свободни, надеждни и преизползваеми ресурси и технологии и ще позволи на компаниите да адаптират съществуващи големи езикови модели с изкуствен интелект към своите уникални цели и приложения сигурно и безопасно на български език.

Договори по проекта

0

В публичния набор няма свързани договори за този проект.

Изпълнителят се свързва чрез официалното поле EntityId от договора към секцията Entities. Когато един официален номер съдържа няколко договорни реда, всеки ред се запазва отделно.

Финансиране

Обща стойност223 662,79 EUR
Собствено финансиранеНе е посочена
Реално изплатеноНе е посочена

Бенефициент

ИНСТИТУТ ЗА БЪЛГАРСКИ ЕЗИК "ПРОФ. ЛЮБОМИР АНДРЕЙЧИН"

ЕИК 000665498
гр.София, Столична, София-Град