Deep Tech

Z.ai и Concordia AI предлагают шесть этапов управления рисками систем ИИ с открытыми весами

Китайская компания в сфере искусственного интеллекта Z.ai и пекинская консалтинговая компания по безопасности Concordia AI опубликовали руководство по управлению рисками, связанными с ИИ-моделями с открытыми весами. Любой желающий может скачать, изменить и запустить обученные параметры таких моделей.

Z.ai и Concordia AI предлагают шесть этапов управления рисками систем ИИ с открытыми весами

Обе организации представили доклад в понедельник, как сообщил Чон Мин Ли для издания South China Morning Post.

В докладе «представлена первая комплексная, основанная на фактических данных база для преодоления этих противоречий» между открытостью и безопасностью, пишут его авторы.

Почему модели с открытыми весами — это нечто особенное

В основу руководства положены три проблемы. Выпуск модели трудно или невозможно обратить вспять. Дообучение (файн-тюнинг) может стереть защитные механизмы. А когда весы выпущены в открытый доступ, разработчики больше не могут отслеживать, как именно люди используют модель.

«Обучение безопасности может быть сведено на нет с помощью небольшого числа вредоносных примеров для обучения», — говорится в докладе.

Поэтому авторы доклада сосредоточились на мерах, которые принимаются до релиза или продолжают работать после публикации весов. На ранних этапах разработки рекомендуется тщательная фильтрация обучающих данных, а также поэтапный выпуск вместо простого выбора между полностью открытой или закрытой моделью. В качестве примера приводится модель GLM-5.3 от Z.ai: сначала ее протестировали проверенные партнеры по безопасности, и лишь после оценок безопасности весы были опубликованы полностью.

Шесть этапов

В руководстве выделено шесть этапов — от выявления рисков до управления ими:

Выявление рисков охватывает вопросы злоупотреблений и непредвиденных инцидентов. Пороговые значения рисков определяют неприемлемый риск по четырем направлениям: где запускается модель, кто может ей злоупотребить, чему она способствует и насколько общество способно поглотить причиненный ущерб. Анализ рисков проводится до разработки, перед развертыванием и после него.

Оценка рисков распределяет модели по зеленой, желтой и красной зонам: полный выпуск, ограниченный или поэтапный выпуск, либо приостановка. Снижение рисков предполагает применение защитных мер на протяжении всего жизненного цикла модели, а управление рисками определяет надзор и подотчетность.

Данный доклад дополняет «Руководство по управлению рисками передового ИИ 2.0» (Frontier AI Risk Management Framework 2.0) от Шанхайской лаборатории искусственного интеллекта и Concordia AI, опубликованное в июле.

Контекст

В этом месяце компания Z.ai привлекла 5 млрд долларов в Гонконге. На прошлой неделе она принесла извинения в связи с инструментом программирования ZCode и открыла его исходный код. В августе технологическая стратегия Белого дома оставила ИИ с открытыми весами за пределами своего списка критически важных технологий.

Опубликовано 28 сентября 2026 - 09:54 Наверх