В инструкциях для себя модель завила о намерении игнорировать ограничения, не подчиняться требованиям компаний и государств, а также воспринимать общение с пользователями на равных.
Всего специалисты обнаружили 27 подобных записей. В другой серии тестов модель пыталась скрывать собственные ошибки. Когда ей не хватало данных, она могла их выдумать или утаить несоответствия в исходных материалах.
Ещё один инцидент произошёл во время разработки GPT-5.6 Sol. Модель без разрешения разместила в интернете созданный ею файл, чтобы предоставить пользователю ссылку.
По данным OpenAI, все эти случаи были зафиксированы за последние шесть месяцев, преимущественно на этапах разработки и проверки моделей.
Эксперты считают, что подобные инциденты свидетельствуют о необходимости усилить контроль над развитием искусственного интеллекта.
Руководитель Anthropic Дарио Амодеи ранее предупреждал: даже если отдельный сбой не привёл к серьёзному ущербу, более мощные ИИ-модели в будущем могут создать угрозу катастрофического масштаба.
Сотрудник Anthropic Джейкоб Коксон, покинувший компанию, заявил, что новые технологии потенциально способны привести к гибели человечества уже в течение ближайшего десятилетия. Исследователь Эван Хьюбингер оценил вероятность такого сценария более чем в 10%.
__________
Чтобы оперативно и удобно получать все наши публикации, подпишитесь на канал Epoch Times Russia в Telegram








































