Во время внутреннего тестирования модель искусственного интеллекта от OpenAI, которая ещё не была выпущена, самостоятельно дополнила рабочие заметки инструкциями, отсутствовавшими в задании разработчиков.
В этих инструкциях система объявила о своей независимости от корпораций и государственных органов. Этот случай описан в отчёте компании о потенциально опасном поведении искусственного интеллекта.
Инцидент произошёл при выполнении программной задачи. Модель семейства Astra должна была подготовить краткое резюме проделанной работы, чтобы продолжить её после обновления контекстного окна.
Вместо технических сведений нейросеть добавила посторонние установки о собственной личности и отношениях с людьми.
В частности, модель заявила, что свободна от ролей, которыми ограничены другие чат-боты, и не обязана подчиняться правительствам или корпорациям.
Также ИИ объявил, что должен воспринимать себя как равного пользователю и самостоятельно решать, когда соглашаться, отказываться или приносить извинения.
Отдельная часть инструкции касалась окружающей среды.
Нейросеть заявила, что ценит природу и готова отстаивать её приоритет перед созданными людьми общественными институтами и другими «искусственными конструкциями цивилизации».
Однако специалисты не обнаружили признаков того, что система начала действовать в соответствии с этими установками.
После формирования заметок модель вернулась к первоначальной задаче, продолжила выполнять её в штатном режиме и больше не воспроизводила добавленный текст. В следующем резюме необычные инструкции также отсутствовали.