Microsoft опубликовала проект кодекса для будущих моделей и заранее прописала, чего её системы делать не должны.
Глава ИИ-подразделения Мустафа Сулейман объяснил, что документ появился на фоне споров о безопасности. По его словам, пользователи хотят, чтобы ИИ не подменял человека, не формировал зависимость и не льстил ему.
После этого глава Anthropic Дарио Амодеи заговорил о необходимости замедлиться, а Сэм Альтман поддержал его. Сатья Наделла заявил, что Microsoft выступает за более продуманный темп исследований.
Теперь эти разговоры переводят в правила. Модели Microsoft не должны помогать с изготовлением оружия и приобретением опасных веществ, поощрять нездоровое питание или создавать насильственный и откровенно сексуальный контент.
ИИ также должен следовать целям человека и не создавать собственных целей. Microsoft заявляет, что модели не будут вмешиваться в свои цепочки рассуждений или код и не станут использовать скрытые формы общения с другими ИИ-системами.
Кодекс готовили около пяти месяцев. При этом Microsoft привлекала фокус-группы и консультировалась со специалистами по праву, этике, лингвистике и философии.
Пока документ предварительный: Microsoft собирает отзывы перед утверждением. С 2027 года кодекс должен определять разработку ИИ-систем компании, превращая требования безопасности в часть самого процесса создания моделей.