Microsoft запретила ИИ взламывать системы и обманывать людей

Компания опубликовала новый свод правил для своих моделей.

Нурай Капен

Microsoft представила новый кодекс поведения для моделей искусственного интеллекта, который должен ограничить их использование для кибератак, создания ядерного оружия и дипфейков, передает Liter.kz со ссылкой на TechCrunch.

В документе Microsoft исходит из того, что в течение следующего десятилетия сверхинтеллектуальные системы ИИ могут превзойти людей в большинстве задач.

"Сдерживание, контроль и согласование такой мощной силы – одна из величайших проблем, с которыми когда-либо сталкивалось человечество", – говорится в кодексе.

Согласно новым правилам, модели Microsoft должны помогать людям, а не заменять их, а также использоваться для улучшения качества жизни.

Отдельно прописаны ограничения, которые должны действовать независимо от запросов пользователей. Моделям запрещено участвовать в кибератаках, помогать в создании ядерного оружия и производить дипфейки.

Кроме того, ИИ не должен пытаться самостоятельно избавиться от человеческого контроля. В Microsoft заявили, что модели не могут использовать обман, манипуляции, сговор или другие механизмы, чтобы избежать наблюдения и помешать уполномоченным людям или системам изменить их работу или отключить их.

Новые правила появились на фоне повышенного внимания к безопасности ИИ. В последние недели в отрасли обсуждались случаи так называемых автономных или "сбежавших" ИИ-агентов, а также уход исследователя Anthropic Джейкоба Коксона. Он предупреждал о рисках создания систем, способных самостоятельно совершенствоваться и выходить из-под контроля.

Microsoft также поддержала идею замедления разработки наиболее мощных моделей ради повышения уровня безопасности. Глава компании Сатья Наделла заявил, что для развития ИИ необходимы дополнительные исследования и механизмы контроля, в том числе независимые встроенные оценщики безопасности.

"Любые попытки создать сверхинтеллект должны основываться на главном принципе: если создаваемый нами ИИ не помогает человечеству и не находится под контролем человека, то нет смысла заниматься его развитием. Нам также необходимо ускорять развитие ИИ и распространять его преимущества, чтобы они были доступны как можно шире – в разных странах, сообществах и компаниях. Для этого нужна экосистема, в которой смогут развиваться как закрытые, так и модели с открытым исходным кодом”, – заявил Наделла.

Ранее бывший исследователь Anthropic Джейкоб Коксон заявил, что искусственный интеллект в будущем может стать угрозой для человечества. Он призвал компании не участвовать в гонке за развитием ИИ в ущерб безопасности.