Американският софтуерен гигант Microsoft се опитва да направи по-трудно за хората да заблуждават чатботовете с изкуствен интелект да правят странни неща, пише Bloomberg.
Новите функции за сигурност са част от Azure AI Studio – услуга, захранвана от OpenAI, която позволява на разработчиците да изграждат персонализирани асистенти с изкуствен интелект (AI), използвайки собствените си данни, обяви в блога си базираната във Вашингтон компанията.
Инструментът включва „защити на заявките“, които са проектирани да засичат и блокират умишлени опити да се накара AI модел да се държи по непредвиден начин. Microsoft се занимава и със случаите, в които хакерите вмъкват злонамерени инструкции в данните, върху които е обучен моделът, и го подвеждат да извършва непозволени действия като кражба на потребителска информация.
Подобни атаки са „уникално предизвикателство и заплаха“, коментира Сара Бърд, главен продуктов директор на Microsoft, отговарящ за изкуствения интелект. Новите защити имат за цел да откриват подозрителни заявки и да ги блокират в реално време, посочва тя. Microsoft пуска и функция, която известява потребителите кога един модел измисля неща или генерира грешни отговори.
Microsoft се стреми да повиши доверието в своите инструменти с генеративен изкуствен интелект, които сега се използват както от потребители, така и от корпоративни клиенти. През февруари компанията разследва инциденти, свързани с нейния чатбот Copilot, който генерира отговори, вариращи от странни до вредни. След преглед на инцидентите Microsoft заяви, че потребителите умишлено са се опитали да заблудят Copilot да генерира отговорите.
„Със сигурност виждаме засилване на тази практика, тъй като инструментите се използват повече, но и тъй като повече хора са наясно с тези различни техники“, казва Бърд. Ясните знаци за подобни атаки включват задаването на един и същ въпрос към чатбота или задаването на подкани, описващи ролева игра.
Бърд твърди, че Microsoft и партньорът ѝ OpenAI са посветени на безопасното внедряване на AI и изграждането на защити в големите езикови модели, които са в основата на генеративния изкуствен интелект.


Изтича срокът за подаване на заявления за школите на Общински детски комплекс – Варна
Задържаха нагли крадци във Варна и Девня
Възрастен мъж мина стотици километри с влака, само за да бъде 2 часа на плажа във Варна
Зевс - кенгуруто, което живее във Варна ВИДЕО
Свободен вход за Аладжа манастир на 15 август за Деня на Варна
Големите банки събраха левовете на българите, малките отвръщат с по-високи лихви
Български автономни роботи ще съчетават физическия и дигиталния свят
В икономиката на суперзвездите всички трябва да сме готови за нова кариера
Петролът леко поевтиня, като фокусът е върху безизходицата в Ормузкия проток
Путин не може да разбие вратата на НАТО. Затова опитва през прозореца
Porsche напуска Volkswagen заради китайски производител
Най-търсеният автомобил на старо е до 5 години
Mercedes подготвя нов хибрид за C-Class, GLC и GLE
Четири скрити функции на автомобила
Шест проблема при Honda CR-V на старо
Климатолог за Дунав: Безпрецедентно е, всеки ден имаме спад по 2-3 см
Бургас финтира София и ще бъде домакин на "Евровизия" 2027
Костадин Костадинов: България навлиза в колапс
Край на любовта между Никола Цолов и Крисия?
Мъж подаде сигнал за неправилно паркиране, който завърши със заплахи