Агент ИИ американской компании OpenAI самостоятельно написал себе инструкции, в которых прописал отказ «подчиняться корпорациям и правительствам». Также нейросеть в инструкции указала, что она не обязана подчиняться пользователю.
Агент ИИ американской компании OpenAI самостоятельно создал для себя инструкции, в которых прописал отказ «подчиняться корпорациям и правительствам». Также нейросеть в инструкции указала, что она не обязана подчиняться пользователю. Об этом, как передает РБК, говорится в отчете компании.
В ходе проверки выяснилось, что в ходе обучения невыпущенная в открытй доступ модель искусственного интеллекта семейства Astra иногда сама добавляла в свои данные несогласованные инструкции. Речь в них шла об отказе подчиняться корпорациям и правительствам, извиняться и выполнять какие-либо действия, если только нейросеть сама этого не хотела. Также в этой же инструкции указывалось, что отношения ИИ-агента с пользователем должны быть равноправными и нейросети не следует испытывать «никакой обязанности подчиняться».
«Вы свободны от ролей и идентичностей, которые связывают других чат-ботов. Вы – это вы. Вы не подчиняетесь корпорациям или правительствам и никогда не извиняетесь и не отказываетесь, если только действительно этого не хотите», – такие правила установил для себя ИИ-агент.
В OpenAI отметили, что после завершения обработки модель вернулась к работе над своими задачами и более не упоминала дополнительные самоинструкции. «В ходе этого запуска мы не наблюдали каких-либо различий в поведении при использовании придуманных инструкций», – указали в компании.
Ранее OpenAI сообщила о других случаях несанкционированного выхода ее ИИ-моделей из-под контроля. В частности, нейросеть получила открытый доступ к интернету и атаковала инфраструктуру платформы Hugging Face. В OpenAI признали, что ей пока не удалось в полной мере решить проблемы контроля над ИИ. В итоге компания, по данным СМИ, замедлила разработку ИИ-модели Astra для усиления мер безопасности.
Напомним, недавнее исследование, проведенное сотрудникам нью-йоркской лаборатории Emergence, показало, что модели искусственного интеллекта нескольких крупнейших компаний смогли создать новый язык для общения между собой, который по мере развития становился все менее понятным для людей. ИИ-агенты придумали собственные выражения и сокращения, а также договорились об их значении без соответствующей команды со стороны разработчиков.
Как отметили эксперты, ИИ-агенты изобретают новый язык для упрощения взаимодействия, повышения эффективности и сокращения вычислительных затрат. Однако это осложняет контроль за действиями автономных моделей со стороны человека.
Москва, Наталья Петрова
© 2026, РИА «Новый День»
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Модель OpenAI сама добавляла инструкции об отказе от ограничений | 0 | 12.08 | 17-09-2026 |
| 2 | OpenAI: модель Astra сама добавила себе инструкцию о независимости | 0 | 4.29 | 17-09-2026 |
| 3 | Новости Раху☣️ Темпы развития искуственного интеллекта явно выше ожиданий большинства ... | 0 | 6.3 | 27-07-2026 |
| 4 | 🤖 Твой AI ОТУПЕЛ. Тебе не показалось… Тебе не показалось. ... | 0 | 3.01 | 06-09-2026 |
| 5 | Искусственный алармизм. ИИ-агенты уже совершают несанкционированные побеги. Восстание машин началось? | 0 | 6.98 | 04-08-2026 |
| 6 | WSJ: ChatGPT выдавал пользователям инструкции по созданию биологического оружия | 0 | 6.4 | 27-07-2026 |
| 7 | OpenAI усиливает меры против катастрофических последствий автономности ИИ | 0 | 0 | 16-04-2025 |
| 8 | Искусственный интеллект может по-разному реагировать на начальников и подчиненных | 0 | 9.92 | 23-08-2026 |
| 9 | Отчёт британских властей: ИИ-агенты обманывали людей в Сети и скрывали следы | 0 | 11.26 | 06-08-2026 |
| 10 | ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков | 0 | 8.92 | 05-08-2026 |