Microsoft Искусственный интеллект
Microsoft заявляет, что ее ИИ-модели никогда не будут сопротивляться отключению
Microsoft опубликовала свод правил поведения для моделей собственной разработки, и центральный принцип в нем сформулирован предельно прямо. Модели MAI «никогда не будут сопротивляться вмешательству, исправлению или отключению со стороны человека». Документ был обнародован в понедельник одновременно с началом шестинедельних общественных обсуждений.
Рядом с ним фигурируют еще три поведенческих обязательства. Модели не будут расширять свою сферу применения, не будут ставить перед собой цели, которые не задавал человек, и не станут скрывать свои рассуждения от аудиторов.
Выше них располагаются так называемые абсолютные ограничения (Absolute Constraints) — действия, которые модели не должны совершать ни при каких обстоятельствах. Они охватывают оружие массового поражения, защиту детей и масштабные вредоносные манипуляции.
Концепция получила название «гуманистический ИИ» (Humanist AI), который Microsoft определяет как подчиненный, выровненный (aligned) и контролируемый искусственный интеллект. Самое простое выражение этого принципа звучит так: «Люди важнее ИИ. ИИ должен быть инструментом, а не личностью, и никогда не должен сопротивляться отключению».
Кодекс распространяется на MAI-Transcribe-2, MAI-Thinking-1, MAI-Code-1.1-Flash, MAI-Image-2.6 и MAI-Voice-2. Этот список показывает, как быстро продвинулась граница возможностей.
Издание TNW рассказывало о первых трех собственных моделях в апреле, когда транскрипция, голос и генерация изображений исчерпывали их функционал, а MAI-Image-2 только что занял третье место в рейтинге Arena. С тех пор появились модель для рассуждений и модель для написания кода.
Одно положение осложняет все остальные. Корпоративные партнеры могут настраивать поведение моделей, и Microsoft прямо заявляет, что не хочет навязывать пользователям единое видение ИИ.
Где заканчивается вариативность настроек и начинаются абсолютные ограничения — это вопрос, на который документ не дает ответа. Именно он определяет, является ли все это реальным обязательством или лишь настройкой по умолчанию.
Обсуждения продлятся шесть недель, до конца октября. Форма для обратной связи открыта для всех желающих, причем можно комментировать как документ в целом, так и конкретные пассажы. В Microsoft заявляют, что опубликуют сводку отзывов и внесенных изменений, а затем выпустят пересмотренную версию до конца года.
Относительно того, что именно компания готова принять во внимание, формулировки звучат откровенно:
«Мы не можем дать никаких обещаний относительно того, что именно мы внесем, но мы обещаем прислушаться».
Вопросы, которые Microsoft выносит на суд общественности, — это признание того, что еще остается нерешенным. Компания просит помочь внедрить ценности в модели, дать конкретные определения человеческого благополучия, разработать более четкие критерии оценки, осмыслить взаимодействие нескольких агентов и высказать мнения о том, как соотносить ускорение разработок с мерами безопасности. Это самые сложные аспекты, и вместо ответов на них компания задает вопросы.
Тайминг помещает Microsoft в центр дискуссии, которая на прошлой неделе вышла в публичное поле. Дарио Амодей заявил, что индустрия должна сбавить темпы, Сэм Альтман поддержал его уже через несколько часов, главный научный сотрудник OpenAI к тому моменту уже заявил, что ни одна лаборатория не должна масштабироваться на максимальной скорости, а Дональд Трамп отверг аргументы в пользу замедления чего-либо.
Microsoft заняла третью позицию: никакого замедления, никакого отмахивания от проблемы, письменный перечень того, чего ее модели делать не будут, и предложение оценивать компанию по этому списку.
В документе не описывается, каким именно образом все это будет обеспечиваться. Не упоминается внешняя верификация, не указаны штрафы за нарушение моделью установленных ограничений и не разъясняется, кто именно принимает решение о таком нарушении. Кроме того, у кодекса нет конкретного автора.
Microsoft благодарит команды ответственного ИИ (Responsible AI), юридический отдел, команды по имитации угроз (red teaming), безопасности, исследований будущего (Futures), обучения ИИ и продаж — показательный список. Кодекс поведения, составленный отчасти отделом продаж, является в такой же степени коммерческим документом, в какой и документом о безопасности, и Microsoft не пытается этого скрывать.


