Големите езикови модели (LLM) и развитието на изкуствения интелект (АІ) са в тесния фокус на бизнеса в последните гoдини, а технологичните компании са в центъра на световния фондов пазар. Според доклад на Bloomberg Intelligence от юни се очаква пазарът на генеративен изкуствен интелект да достигне 2,3 трилиона долара до 2032 г. и да представлява 22% от разходите в технологичния сектор.
Ако темата за АІ е водеща в сферата на технологиите и пазарите, то тя има своето място и в сферата на лингвистиката. Пресечна точка е науката компютърна лингвистика, която се занимава с изследвания в областта на компютърната обработка на естествените езици. Миналата седмица в София се проведе Седмата международна конференция „Компютърната лингвистика в България“ (CLIB 2026), чийто фокус бяха големите езикови модели, изкуственият интелект, обработката и оценяването на езикови данни, езиковите ресурси и разработването на технологии за езици с ограничени ресурси, какъвто е и българският. Участниците включваха български и международни учени.
Един от водещите лектори беше проф. Руслан Митков от Университета на Ланкастър и Университета на Аликанте. Той е автор на над 240 реферирани статии в областта, като основните му приноси обхващат разрешаването на анафората и автоматичното генериране на тестове. Той е и сред първите учени, разработили система за компютърна лингвистика в помощ на хора с аутизъм.
Като водещ лектор в конференцията той проследи революцията в полето на езиковите технологии и технологиите за превод. Според изследванията му към момента методите за дълбоко обучение се правят по-добре с анализа на информация от големите езикови модели.
Сред темите, които засегна, бяха недостатъците на големите езикови модели, когато трябва да превеждат фразеологизми или да работят с по-непознати езици. Все пак не бяха подминати рисковете пред работата на преводачите, които могат да бъдат сведени в бъдеще специалисти по създаване на AI промптове за превод. Същевременно Митков очерта и недостатъците на моделите, които лесно се поддават на натиск и убеждаване от страна на потребителя.
Подчертавайки, че човекът не може да предсказва бъдещето, Митков се опита и да допусне кога изкуственият интелект може да достигне естествения и показа две графики – една, в която е предвиждал да се пресекат в далечното бъдеще и една, в която допуска, че това може да се случи до 2050 г.
След лекцията имахме възможност и за кратък разговор, в който проф. Митков отбеляза къде се провалят големите езикови модели. Засега.
Проф. Митков, по какъв начин работата с големите езикови модели променя естествения език?
– Има термини, които възникват, свързани с тези модели, и те са навлезли вече в естествения език. Например терминът „халюцинирам“. Той означава да генерираш невярна информация, а не както се използва досега в медицината. Създават се нови технически жаргони.
Освен това, понеже сканират страшно много информация, са добри в писането. Chat GPT пише много добре на английски. От гледна точка на това, те помагат на хората да научат някакъв нов език и да пишат по-добре на него. Те (езиковите модели, бел. авт.) са много добри преводачи, в езика могат да помагат много.
Доколко е застрашена работата на преводачите в такъв случай?
– Има хора, които предпочитат да работят с хора преводачи. Освен това тези езикови модели все още не са добри, когато превеждат литературен текст. Там човешката креативност печели. Един човешки преводач ще преведе много по-добре литературно произведение, макар че сега много издатели превеждат книга с изкуствен интелект и плащат на преводач да я провери и подобри. Какво се получава? Макар да не се използва изцяло изкуственият интелект, го използват за по-евтин труд. Много по-евтино е да пратят на някого текст да го редактира само, отколкото да го преведе.
Извън използването на езиковите модели за търсене на информация, какво е най-голямото им приложение?
– Те могат да разсъждават, може да им поставите задача и те да мислят по нея и да ви дадат информация. Аз например сега трябва да си правя данъчен отчет в Англия и съм задал един алгоритъм да се търсят определени знаци и да се събират числата, да се направи един подреден екселски файл. Правят го много добре. Могат да правят програми. Казвате им: „Напишете ми програма“, и те го правят.
Макар че казват, че не са лекари и трябва да се посъветвате и с лекар, дават съвет при симптоми. Сега търся да си купя кола и те ми дават информация. Например днес попитах: „Какво ще кажете за една Mazda, която е 141 коня. Аз имам BMW 170 коня, ще се чувства ли по-малко мощна колата“. Той (езиковият модел, бел. авт.) ми отговаря – не съвсем, защото има по-високи обороти на двигателя. Те разбират тези неща, понеже копират информация с всички обяснения. За нула време сканират и използват огромна информация.
Кое, според Вас, е най-интересното, което трябва да се следи в момента в областта на изкуствения интелект?
– Аз лично гледам кои модели са най-добрите, кои са най-мощните – следя последните модели да видя дали работят по-добре от предишните, какви са ограниченията им и каква е границата на техните възможности.
Какво не достига на изкуствения интелект, за да достигне естествения? Неспособността да разбира абстрактно мислене или липсата на достатъчно информация, с която да сравнява?
– Има области, в които не работи много добре. Не работи добре с културните специфики и там, където се изисква емоционална интелигентност. Не работи много добре и при неща, свързани с високото човешко абстрактно и духовно мислене.
Те все още остават недостъпни?
– Все още, но не знам докога.


Спор за минималната заплата през 2027 г.: Бизнесът предлага 660 евро, синдикатите искат 692
Кичка Бодурова катастрофира по пътя Варна-Бургас
Черно море отговори на феновете: На този етап не е моментът за промени в отбора
Портних: С идването на Коцевата администрация обновяването на район "Аспарухово" рязко спря
Трите зодии, които обожават есента
Доходност от 5% по облигациите на САЩ създава нови рискове за пазарите
Уорш върви към сблъсък с Тръмп заради предстоящото повишение на лихвите
Тръмп настоя Украйна да спре ударите по рафинерии в Русия
Акциите поевтиняват заради опасения за забавяне в сферата на AI
Цената на петрола скочи в очакване на по-дълбока енергийна криза
Британец си купи Ferrari F40 вместо къща, за да прекара 22 години в приключения
18-годишно Audi RS 4 беше продадено по-скъпо от ново
Пет процедури по колата, които всеки шофьор може да извърши сам
Jeep изтегля над 200 000 коли заради софтуерна грешка
Volkswagen представя свръхефективен автомобил
Веселин Топалов победи Гари Каспаров в Мача на легендите
Адвокат Рангелов: Помилването от страна на Йотова не е гаф
4-5 дни преди взрива в “ЕМКО” е имало проверка
Заради напрежението със САЩ: Канада обмисля статут на "асоцииран член“ към ЕС