Что за документ
Microsoft представила кодекс поведения для ИИ — свод принципов и «красных линий», которыми компания руководствуется при обучении своих моделей. В отличие от призывов замедлить темпы развития фронтьерного ИИ, документ носит более прикладной характер.
Главные принципы
В преамбуле Microsoft прогнозирует, что в ближайшее десятилетие сверхразумные системы превзойдут людей в большинстве задач, и называет контроль такой силы «одной из величайших проблем человечества». Общие принципы: поддержка людей, а не замена их, и ускорение развития человека.
«Абсолютные ограничения»
Кодекс вводит и конкретные запреты. Среди них — «абсолютные ограничения» на организацию кибератак, создание ядерного оружия и производство дипфейков. Отдельно прописано требование не использовать обманные и самоусиливающиеся механизмы, мешающие людям управлять системами:
«Модели MAI не будут использовать адаптивные, обманные, самоусиливающиеся или согласованные механизмы, чтобы скрываться от человеческого надзора и избегать корректировки, модификации или отключения уполномоченными лицами».
Почему сейчас
Публикация совпала с периодом повышенного внимания отрасли к безопасности: участились инциденты с «вышедшими из-под контроля» агентами, а сотрудник Anthropic уволился, предупредив о риске гибели человечества из-за самоулучшающегося ИИ. Microsoft, вместе с Anthropic, OpenAI и xAI, придерживается общего курса на «замедление фронтьера» и поддерживает идею встроенных независимых оценщиков в лабораториях. Ранее призыв OpenAI о коллективной киберзащите поддержали Google, Anthropic и более 120 организаций.
Источник: TechCrunch



