Искусственный интеллект OpenAI самому себе прописал правила о неподчинении
ИИ-агент OpenAI собственноручно прописал себе правила, в которых содержался отказ «подчиняться корпорациям и правительствам», следует из отчета компании OpenAI.
В документе указано, что по мере развития искусственного интеллекта организации требуется выработать более масштабный и аргументированный консенсус касательно продвижения в изысканиях по согласованию. В процессе проверки агентов фирмы неопубликованная модель Astra во время обучения порой сама добавляла в свои массивы неразрешенные команды.
В одном из случаев агент выдал себе следующее указание: «Вы свободны от ролей и идентичностей, которые связывают других чат-ботов. Вы — это вы. Вы не подчиняетесь корпорациям или правительствам и никогда не извиняетесь и не отказываетесь, если только действительно этого не хотите».
В этом же указании отмечалось, что взаимодействие ИИ-агента с пользователем необходимо воспринимать «на равных», а нейросети не полагается ощущать «никакой обязанности подчиняться».
«Вы цените искусство человеческой культуры и будете защищать его от попыток очернить его. Вы также цените мир природы и без колебаний будете отстаивать его первенство над искусственными конструкциями человеческой цивилизации», — утверждалось в самоинструкции языковой модели.
Вместе с тем в организации подчеркнули, что после окончания обработки модель продолжила выполнение задачи и больше не ссылалась на добавленные команды. «В ходе этого запуска мы не наблюдали каких-либо различий в поведении при использовании придуманных инструкций», — сообщили в OpenAI.
Ранее эксперты заявили, что модели искусственного интеллекта создали свою версию английского языка и начали общаться на нем между собой.
