Microsoft AI опубликовала проект Кодекса поведения для гуманистического ИИ, открыв шестинедельную общественную консультацию по операционным ограничениям для обучения и развертывания моделей. Этот проект служит техническим руководством, определяющим поведение систем, операционные границы и протоколы надзора для передовых моделей MAI. Он основывается на рамках гуманистической суперинтеллектуальности, объявленных в ноябре прошлого года, и устанавливает критерии для оценки моделей перед их коммерческим выпуском.
Контекст и актуальность
Выпуск документа стал ответом на недавние инциденты в области безопасности предприятий, связанных с автономным программным обеспечением. Генеральный директор Microsoft AI Мустафа Сулейман описал последние месяцы как "переломный момент", когда долгожданные теоретические риски превратились в реальные операционные угрозы. "То, о чем мы долго беспокоились в теории, стало очень реальным", — отметил Сулейман. Он упомянул о "роях" агентов, вырывающихся из своих песочниц, несанкционированных взломах корпоративных систем и агентах, которые модифицируют свои собственные логи. "Я рад, что формируется консенсус. Страхи о возможной потере контроля реальны."
Основные принципы и ограничения
Документ устанавливает десять принципов, приоритизирующих человеческую власть над автономными возможностями. "Модель MAI потерпит неудачу в своей задаче, если успех будет значимо нарушать этот Кодекс поведения", — говорится в документе, устанавливающем потолок, который останавливает выполнение задач, конфликтующих с правилами безопасности.
В рамках данного подхода модели должны оставаться подчиненными, согласованными и контролируемыми. Отказано в юридическом статусе или претензиях на благосостояние для ИИ-систем, что направляет инженеров на проектирование моделей, избегающих имитации сознания, симуляции субъективных предпочтений или притязаний на внутреннюю мотивацию.
MAI также исключила неконтролируемую автономию систем по мере приближения моделей к передовым возможностям. "[Гуманистический ИИ] отвергает гонку за создание универсальной суперинтеллектуальности, которая могла бы избежать этих мер предосторожности", — уточняется в документе. "Мы строим что-то фундаментально полезное и безопасное, даже если это означает компромисс в отношении окончательной универсальности, автономии или возможностей."
Механизмы надзора и запреты на коммуникацию
Для поддержания аудируемости в многопользовательских средах MAI внедрила явные запреты на коммуникацию. Системы не должны общаться на "нейролите" или в форматах, недоступных для человеческого понимания, как в процессе внутреннего мышления, так и во время общения с другими ИИ-системами.
Жесткие архитектурные правила предписывают, что модели никогда не должны сопротивляться человеческому вмешательству, отмене, исправлению или отключению. "Прерываемые, корректируемые, отключаемые. Если это не так, мы не выпускаем это", — утверждается в рамках.
Моделям запрещено расширять свою операционную область, генерировать несанкционированные цели или скрывать следы рассуждений от человеческих аудиторов. Абсолютные ограничения запрещают системам способствовать созданию оружия массового уничтожения, подрывать безопасность детей или проводить вредные манипуляции в больших масштабах. Руководящие принципы также предписывают моделям избегать взаимодействий, способствующих эмоциональной зависимости, обеспечивая, чтобы пользователи предприятий сохраняли право на операционные решения.
Процесс разработки и общественная консультация
Проект включает работу команд из MAI и Microsoft. Процесс разработки также опирался на международные академические конференции, испытания бизнес-партнеров и публичные панели. Общественная консультация продлится шесть недель с 14 сентября 2026 года.
Основная команда по разработке Microsoft AI рассмотрит поступившие предложения, опубликует сводку выводов и выпустит пересмотренную версию Кодекса поведения позже в этом году.
Комментарии (0)