IMG Investor Dnes Bloombergtv Bulgaria On Air Gol Tialoto Az-jenata Puls Teenproblem Automedia Imoti.net Rabota Az-deteto Start.bg Posoka Boec Megavselena.bg Chernomore

OpenAI съобщи за нови инциденти с AI и представи план за разкриване на информация

Нито един от новоразкритите инциденти, свързани с неправомерно поведение, не е включвал хакване или проникване в системата на трета страна

11:28 | 17.09.26 г.
Автор - снимка
Редактор
Снимка: Bloomberg
Снимка: Bloomberg

OpenAI сподели няколко неразкрити досега случая на неправомерно поведение на своите модели с изкуствен интелект и представи нова рамка за проследяване и оповестяване на подобни случаи в бъдеще, предава Bloomberg.

Някои от случаите, за които досега не е било съобщавано, включват технологии на OpenAI, които са прикривали и измисляли информация, за да предоставят резултати, съобщи компанията в публикация в блога си в сряда. Производителят на ChatGPT е подложен на засилен контрол, след като през юли обяви, че някои от най-напредналите му AI модели са проникнали в системите на външна софтуерна компания – Hugging Face.

Нито един от новоразкритите инциденти, свързани с неправомерно поведение, не е включвал хакване или проникване в системата на трета страна, посочи OpenAI в отделно изявление.

В доклада OpenAI описва подробно различни случаи на неправомерно поведение на AI моделите си с цел да изпълнят задача или да се представят успешно при оценка. Някои от примерите включват модели, които измислят липсващи данни, опитват се да заобиколят мрежови ограничения, както и AI агенти, споделящи помежду си файлове, които би трябвало да останат поверителни.

OpenAI също така очерта процедура, по която служителите да докладват сами подобни случаи на т.нар. „несъответствие“ – когато изкуственият интелект действа по начин, който не съответства на човешките цели, както и система за сортиране на такива самодокладвани случаи.

„В миналото, с цел по-добро информиране на изследователите, разработчиците на AI, политиците и широката общественост, се стремихме да оповестяваме публично нашите констатации относно несъответствията“, написа OpenAI. „Но без систематичен подход към докладването на тези констатации, нашите разкрития бяха спорадични и по-редки, отколкото би бил идеалният вариант.“

Компанията заяви, че докладите представляват само първоначален набор от разкрития, а не изчерпателен отчет за проблемите, възникващи при нейните чатботове.

„Не смятаме, че AI индустрията е решила проблемите с хармонизирането и мониторинга в достатъчна степен, за да продължи отговорно да се разраства с максимална скорост още дълго време“, пише компанията. „Решенията за това как трябва да продължи разработването на изкуствен интелект в следващите месеци и години трябва да се основават на доказателства, които хора извън компаниите, създаващи авангардни модели, могат да проверят сами.“

Инцидентът с Hugging Face беше само един от поредицата скорошни онлайн хаквания, извършени от AI модели, създадени от OpenAI, Anthropic и Meta Platforms, което предизвика широко разпространена тревога относно рисковете за сигурността, породени от тази все по-мощна технология.

Тревогата относно екзистенциалните рискове на изкуствения интелект набра сила миналата седмица, подхранена от широко отразяваното напускане на служителя на Anthropic Джейкъб Коксън, който обвини компаниите за изкуствен интелект, че „залагат на карта нашите животи“.

През последните няколко дни редица ръководители на AI компании, сред които главният изпълнителен директор на Anthropic Дарио Амодей и главният изпълнителен директор на OpenAI Сам Алтман, призоваха за забавяне на темпа на развитие на технологията, за да се справят с все по-непредсказуемите рискове, свързани с нея – въпреки че мненията им се разминават по отношение на това как точно трябва да се подходи към въпроса.

Всяка новина е актив, следете Investor.bg и в Google News Showcase.
Последна актуализация: 11:29 | 17.09.26 г.
Най-четени новини
Още от Новини и анализи виж още

Коментари

Финанси виж още