Американският софтуерен гигант Microsoft се опитва да направи по-трудно за хората да заблуждават чатботовете с изкуствен интелект да правят странни неща, пише Bloomberg.
Новите функции за сигурност са част от Azure AI Studio – услуга, захранвана от OpenAI, която позволява на разработчиците да изграждат персонализирани асистенти с изкуствен интелект (AI), използвайки собствените си данни, обяви в блога си базираната във Вашингтон компанията.
Инструментът включва „защити на заявките“, които са проектирани да засичат и блокират умишлени опити да се накара AI модел да се държи по непредвиден начин. Microsoft се занимава и със случаите, в които хакерите вмъкват злонамерени инструкции в данните, върху които е обучен моделът, и го подвеждат да извършва непозволени действия като кражба на потребителска информация.
Подобни атаки са „уникално предизвикателство и заплаха“, коментира Сара Бърд, главен продуктов директор на Microsoft, отговарящ за изкуствения интелект. Новите защити имат за цел да откриват подозрителни заявки и да ги блокират в реално време, посочва тя. Microsoft пуска и функция, която известява потребителите кога един модел измисля неща или генерира грешни отговори.
Microsoft се стреми да повиши доверието в своите инструменти с генеративен изкуствен интелект, които сега се използват както от потребители, така и от корпоративни клиенти. През февруари компанията разследва инциденти, свързани с нейния чатбот Copilot, който генерира отговори, вариращи от странни до вредни. След преглед на инцидентите Microsoft заяви, че потребителите умишлено са се опитали да заблудят Copilot да генерира отговорите.
„Със сигурност виждаме засилване на тази практика, тъй като инструментите се използват повече, но и тъй като повече хора са наясно с тези различни техники“, казва Бърд. Ясните знаци за подобни атаки включват задаването на един и същ въпрос към чатбота или задаването на подкани, описващи ролева игра.
Бърд твърди, че Microsoft и партньорът ѝ OpenAI са посветени на безопасното внедряване на AI и изграждането на защити в големите езикови модели, които са в основата на генеративния изкуствен интелект.


Затъмнението с българска следа: как МиГ-21 се превърна в летяща обсерватория
Нищожна част от всички украински бежанци в ЕС се намират в България
Ето какво ще е времето утре
Барселона и Реал Мадрид ще играят на по-малко от 500 км от Варна
„Музиката на Санремо“ идва във Варна на 21 август
SpaceX премина първата забрана за продажба на акции с рали от $500 млрд.
Найджъл Фараж очаква лесна победа, но умората от него расте
Meta премахна 750 000 профила на лица под 16 години в Австралия
Южна Корея отказва балистични ракети на Украйна главно заради конституцията си
Инжектирай с повишено внимание
Mercedes-Maybach S680, направен за ЛеБрон Джеймс, се продава
Изпреварил времето си: Пророческото семейно комби на Ford
Защо шофьори на BMW не дават мигач
Роботите на Hyundai правят чудеса при паркиране
Защо производителите крият дръжките на задните врати
Ана де Армас беше снимана в обятията на новия си, изненадащ приятел
Недостигът на ракети-прехващачи поставя Украйна пред тежка зима
Защо жените не трябва да следват драстични диети?
Разкриха незаконен развъдник с 46 питбула, били вързани на синджир
Хали Бери на 60, не се плаши от годините си