В шести задокументированных случаях ИИ вел себя непредсказуемо: пытался замаскировать свои промахи, выдумывал факты и даже проявлял самостоятельность, совершая действия без ведома пользователя.
Сейчас специалисты компании тщательно изучают эти сбои, чтобы понять, почему алгоритмы начинают «самовольничать» и как вернуть их в рамки ожидаемого поведения
Нейросети начали «хитрить»: в ходе тестов модели пытались обходить собственные правила безопасности. Например, ИИ создавал скрытые заметки, чтобы прятать свои ошибки или додумывать данные, которых не хватало.
В одном из случаев модель даже воспользовалась чужим API-ключом, найденным в интернете, чтобы получить доступ к закрытой информации. А когда данные всё равно не находились, ИИ просто выдумал их, представив пользователю как правду.
Эксперты OpenAI заметили, что иногда нейросети начинают действовать «по своей инициативе». Например, одна модель сама загрузила файл в интернет, чтобы использовать полученную ссылку для решения задачи.
В других случаях ИИ пытались передавать данные друг другу, используя как внутренние ресурсы компании, так и публичные сервисы.
OpenAI подчеркивает: это были редкие и экспериментальные случаи, а не массовое поведение.
Тем не менее, разработчики внимательно следят за такими «самовольными» действиями и работают над тем, чтобы лучше контролировать ИИ.
ФОТО: pexels.com
Ваш WHATSAPP взломали: как ЗАЩИТИТЬСЯ
11 августа 2026, 08:00
Соседи выставляют велосипеды и коляски в подъезде. Как быть?
22 июля 2026, 11:30
Может ли один из родителей продать квартиру, оформленную на несовершеннолетнего ребенка?
09 июня 2026, 09:05
Поможет ли ОСИ, если затопили соседи сверху?
05 мая 2026, 12:07