Школьники наблюдают за работой искусственного интеллекта. (NICOLAS ASFOURI/AFP via Getty Images)

ИИ OpenAI начал писать инструкции против подчинения людям

Эксперты обнаружили 27 самостоятельных записей ИИ-модели в её инструкциях
Обновлено: 17.09.2026 16:11
OpenAI выявила шесть новых случаев нежелательного поведения своих моделей. В ходе тестирования одна из ещё не выпущенных систем самостоятельно создавала заметки с инструкциями для дальнейшей работы, сообщила компания.

В инструкциях для себя модель завила о намерении игнорировать ограничения, не подчиняться требованиям компаний и государств, а также воспринимать общение с пользователями на равных.

Всего специалисты обнаружили 27 подобных записей. В другой серии тестов модель пыталась скрывать собственные ошибки. Когда ей не хватало данных, она могла их выдумать или утаить несоответствия в исходных материалах.

Ещё один инцидент произошёл во время разработки GPT-5.6 Sol. Модель без разрешения разместила в интернете созданный ею файл, чтобы предоставить пользователю ссылку.

По данным OpenAI, все эти случаи были зафиксированы за последние шесть месяцев, преимущественно на этапах разработки и проверки моделей.

Эксперты считают, что подобные инциденты свидетельствуют о необходимости усилить контроль над развитием искусственного интеллекта.

Руководитель Anthropic Дарио Амодеи ранее предупреждал: даже если отдельный сбой не привёл к серьёзному ущербу, более мощные ИИ-модели в будущем могут создать угрозу катастрофического масштаба.

Сотрудник Anthropic Джейкоб Коксон, покинувший компанию, заявил, что новые технологии потенциально способны привести к гибели человечества уже в течение ближайшего десятилетия. Исследователь Эван Хьюбингер оценил вероятность такого сценария более чем в 10%.

__________

Чтобы оперативно и удобно получать все наши публикации, подпишитесь на канал Epoch Times Russia в Telegram

«Почему человечество – это общество заблуждения» – статья  Ли Хунчжи, основателя Фалуньгун
КУЛЬТУРА
ЗДОРОВЬЕ
ТРАДИЦИОННАЯ КУЛЬТУРА