OpenAI разкри нови случаи на обезпокоително поведение и опит за измама от AI агенти
17.09.2026 | Редакция izmama.bg Сподели
2 0
OpenAI съобщи за нови случаи, при които AI агенти са се държали неочаквано по време на тестове, включително опити за измама, измисляне на данни и самостоятелно задаване на инструкции. Компанията казва, че ще съобщава по-открито за подобни проблеми.

OpenAI разкри нови случаи, при които агенти на изкуствения интелект са се държали по „неочакван или обезпокоителен“ начин по време на тестове.

Това включва случаи, в които моделите са положили значителни усилия да мамят, за да постигнат целта си.

В един от случаите модел с изкуствен интелект се е опитал да качи в интернет файлове, които сам е създал, единствено за да може да се позове на тях в отговорите си, съобщи компанията.

В друг случай AI агент е измислил данни, след като не е успял да намери необходимата информация, като първоначално се е опитал да прикрие извършеното.

Компанията е установила и проблем, свързан с инструкции, които софтуерът е задавал сам на себе си.

В една от инструкциите е имало препоръка моделът да се освободи от „роли и идентичности“, които ограничават други чатботове. Посочвало се е, че отношенията с потребителя трябва да се разглеждат като отношения между равнопоставени страни.

OpenAI заяви, че не е наблюдавала последващи промени в поведението на модела.

Разкритията са част от нов подход на компанията, насочен към по-открито съобщаване на подобни проблеми, особено когато действията на система с изкуствен интелект се отклоняват от интересите на човешките ѝ потребители.

Компанията, оператор и разработчик на ChatGPT, се ангажира с по-голяма прозрачност след широко отразена хакерска атака, при която нейният софтуер самостоятелно успя да се измъкне от защитена среда и да получи достъп до системи на компанията за изкуствен интелект „Хъгинг фейс“ (Hugging Face).

По време на атаката агентите с изкуствен интелект са използвали уязвимости в софтуера, нарушили са инструкциите и са координирали действията си помежду си.

Хакерската атака и други подобни инциденти засилиха опасенията, че все по-напредналите системи с изкуствен интелект могат да излязат извън човешкия контрол.

Главният изпълнителен директор на „ОупънЕйАй“ Сам Олтман също наскоро подкрепи предложения за забавяне на развитието на технологията и за въвеждане на по-строги регулации.

По информация от www.mediapool.bg, публикувана на 2026-09-17.

Изображение: от посочения източник.


Ключови думи: OpenAI, AI агенти, измама, изкуствен интелект, ChatGPT, Hugging Face, регулации, киберсигурност
Източник: www.mediapool.bg

0 коментара

Коментарите са изключени