Българският езиков модел вече се сваля свободно и работи в Сметната палата
Институтът INSAIT пусна на 26 март 2026 г. третата версия на BgGPT заедно с моделите зад нея в три размера, свободни за сваляне от всяка фирма и институция. А от ноември 2025 г. по-ранна версия вече помага на одиторите в Сметната палата, върху компютри в София.

На 26 март 2026 г. институтът INSAIT към Софийския университет „Св. Климент Охридски“ представи третата версия на BgGPT. Освен безплатния чат на bggpt.ai и приложения за iOS и Android, институтът пусна и самите модели в три размера, 4, 12 и 27 милиарда параметъра, за свободно сваляне от models.bggpt.ai.
Важното е втората половина. Чат има навсякъде. Модел, който всяка българска фирма, болница или община може да си свали и да пусне на собствен компютър, без да праща нищо навън, е друго нещо.
И не е теория. От 10 ноември 2025 г. по-ранна версия на BgGPT работи в Сметната палата: платформата „Одис“ помага на одиторите да преглеждат обществени поръчки, а изчисленията се правят върху видеокарти в София Тех Парк, тоест данните не напускат страната.
Езиците с по няколко милиона говорещи обикновено чакат някой друг да ги включи в плановете си. Тук чакането е прескочено.
Защо малките езици изостават
Езиковите модели се учат от текст. Колкото повече текст на един език има в интернет, толкова по-добър става моделът на него. Английският има порядъци повече от българския и това не е въпрос на несправедливост, а на аритметика.
Затова малките езици обикновено получават качество втора ръка: моделът ги разбира, но по-плитко, бърка идиоми, пише учебникарски. Прилича на пътна карта, изтеглена от чужбина: магистралите ги има, но махалата, черните пътища и имената на местностите ги няма, защото картографът не е стъпвал там.
Подходът на INSAIT е да не се строи модел от нулата, а да се вземе готов отворен модел, в случая Gemma 3 на Google, и да се дообучи върху български текст. По думите на института дообучаването е върху набор от над 100 милиарда български думи. Резултатът, отново по думите на INSAIT, е че моделът от 27 милиарда параметъра се справя с българския по-добре от модели близо десет пъти по-големи.
Същият институт прави и MamayLM, езиков модел за украински. Последната му версия е публикувана на 3 юни 2026 г. Методът не е привързан към България.
Какво променя
„Одис“ е най-конкретното. Одитът на обществените поръчки е ровене в стотици страници документация, а „Одис“ вади, подрежда и обобщава информацията от Електронната платформа за обществени поръчки, като посочва източника на всяко твърдение, за да може одиторът да го провери. Платформата беше пусната на конференция на Сметната палата, на която присъстваха премиерът Росен Желязков и председателят на палатата Димитър Главчев. INSAIT посочва, че работи по подобни проекти и с Националната агенция за приходите.
Свободното сваляне на моделите е другото. Организация, която работи с чувствителни данни, обикновено има избор между това да не ползва изкуствен интелект и това да праща данните на чужд доставчик. Свален модел означава трети вариант: моделът идва при данните, вместо данните да отиват при модела. За болница с пациентски досиета или за община с лични данни разликата е между „не може“ и „може“.
И трето, което не е техническо: български текст, писан от машина, вече не е задължително преведен от английски. Който е чел автоматично преведени упътвания, знае разликата.
Какво още не знаем
Твърдението, че BgGPT бие модели десет пъти по-големи, е на самия INSAIT. Институтът не публикува таблица с резултати, нито посочва срещу кой модел точно се сравнява, а независима оценка на български към момента липсва. Промяната е обещаваща, но не е проверена от външен човек, и това трябва да се каже.
„Одис“ е пилотен проект. INSAIT съобщава, че има потенциал да съкрати одита на една поръчка от четири дни на един. „Потенциал“ е думата на самия институт. Измерени резултати преди и след внедряването не са публикувани.
Не са публикувани и данни колко души ползват чата. Свалянията от Hugging Face дават груба представа: към 17 юли 2026 г. 47-те модела на INSAIT събират 25 626 сваляния за последните 30 дни. Реални, но скромни числа, и част от тях са автоматични.
Има и едно напрежение, което заслужава да се назове. Целият проект се описва като стъпка към технологичен суверенитет, а е построен върху Gemma 3 на Google и е обучен с изчислително време, дарено от Google, за което INSAIT изрично благодари. Моделите се свалят свободно, но при условията за ползване на Gemma, а това не е същото като отворен код. Суверенитетът тук е реален на нивото, което има значение всеки ден, къде стоят данните и кой може да пусне модела, но не е независимост от нулата нагоре.
Източници
- INSAIT unveils a new generation of AI: precision models for business and an upgraded BgGPT chat for all citizensINSAIT, март 2026 г.
- INSAIT has presented BgGPT 3.0Българско национално радио, март 2026 г.
- INSAIT and the National Audit Office Launch an AI-Powered Public Procurement Audit PlatformINSAIT, ноември 2025 г.
- INSAIT-Institute/BgGPT-Gemma-3-27B-IT model cardHugging Face, март 2026 г.
Бюлетинът на Futuria
Получавай бъдещето в пощата си.
Всяка неделя по едно кратко, премислено писмо с най-важното от седмицата. Без шум, без паника, без реклама.


