OpenAI сподели няколко неразкрити досега случая на неправомерно поведение на своите модели с изкуствен интелект и представи нова рамка за проследяване и оповестяване на подобни случаи в бъдеще, предава Bloomberg.
Някои от случаите, за които досега не е било съобщавано, включват технологии на OpenAI, които са прикривали и измисляли информация, за да предоставят резултати, съобщи компанията в публикация в блога си в сряда. Производителят на ChatGPT е подложен на засилен контрол, след като през юли обяви, че някои от най-напредналите му AI модели са проникнали в системите на външна софтуерна компания – Hugging Face.
Нито един от новоразкритите инциденти, свързани с неправомерно поведение, не е включвал хакване или проникване в системата на трета страна, посочи OpenAI в отделно изявление.
В доклада OpenAI описва подробно различни случаи на неправомерно поведение на AI моделите си с цел да изпълнят задача или да се представят успешно при оценка. Някои от примерите включват модели, които измислят липсващи данни, опитват се да заобиколят мрежови ограничения, както и AI агенти, споделящи помежду си файлове, които би трябвало да останат поверителни.
OpenAI също така очерта процедура, по която служителите да докладват сами подобни случаи на т.нар. „несъответствие“ – когато изкуственият интелект действа по начин, който не съответства на човешките цели, както и система за сортиране на такива самодокладвани случаи.
„В миналото, с цел по-добро информиране на изследователите, разработчиците на AI, политиците и широката общественост, се стремихме да оповестяваме публично нашите констатации относно несъответствията“, написа OpenAI. „Но без систематичен подход към докладването на тези констатации, нашите разкрития бяха спорадични и по-редки, отколкото би бил идеалният вариант.“
Компанията заяви, че докладите представляват само първоначален набор от разкрития, а не изчерпателен отчет за проблемите, възникващи при нейните чатботове.
„Не смятаме, че AI индустрията е решила проблемите с хармонизирането и мониторинга в достатъчна степен, за да продължи отговорно да се разраства с максимална скорост още дълго време“, пише компанията. „Решенията за това как трябва да продължи разработването на изкуствен интелект в следващите месеци и години трябва да се основават на доказателства, които хора извън компаниите, създаващи авангардни модели, могат да проверят сами.“
Инцидентът с Hugging Face беше само един от поредицата скорошни онлайн хаквания, извършени от AI модели, създадени от OpenAI, Anthropic и Meta Platforms, което предизвика широко разпространена тревога относно рисковете за сигурността, породени от тази все по-мощна технология.
Тревогата относно екзистенциалните рискове на изкуствения интелект набра сила миналата седмица, подхранена от широко отразяваното напускане на служителя на Anthropic Джейкъб Коксън, който обвини компаниите за изкуствен интелект, че „залагат на карта нашите животи“.
През последните няколко дни редица ръководители на AI компании, сред които главният изпълнителен директор на Anthropic Дарио Амодей и главният изпълнителен директор на OpenAI Сам Алтман, призоваха за забавяне на темпа на развитие на технологията, за да се справят с все по-непредсказуемите рискове, свързани с нея – въпреки че мненията им се разминават по отношение на това как точно трябва да се подходи към въпроса.


Потвърдиха условното наказание на жена, причинила ПТП със загинал моторист във Варна
DARA стана почетен гражданин на София
ТУ-Варна открива юбилейната 65-а академична година
Тъжна вест! Почина президентът на ФК Крумовград
Полицията в София: Няма следи от външна намеса при инцидента с два трупа
OpenAI разкри нови случаи на проблемно поведение на AI модели
САЩ показаха ново космическо оръжие за противодействие на Русия и Китай
ООН: България вече е сред лидерите в космическите технологии
Прогнозите сочат, че левоцентристкият блок в Швеция ще спечели изборите
Обрат: Пазарът вече не харесва компании за чипове, които залагат на AI
ЕС преговаря с Китай за ограничение на хибридите
Volvo с нова глобална стратегия – различни коли за Запада и за Китай
Том Харди на 49: Какво кара звездата от „Венъм“ и „Лудия Макс“
Връщане на ДДС само при покупка на електромобил
Скритата функция на климатроника спасява компресора в студа
Тротинетка и кон се сблъскаха в Гърция, младеж е в критично състояние
Руски удар напълно унищожи склада на Олена Зеленска с помощи за деца
ГЕРБ: Правителството на Радев се бави с мерките за високите цени на горивата
След кратко боледуване: почина президентът на Крумовград Басри Саров
Александър Николов е №2 при реализаторите на Евроволей