Русская версия The Next Web

Deep Tech Безопасность Искусственный интеллект

Стелс-модель, обошедшая DeepSeek, принадлежит компании Zhipu

Стелс-модель, обошедшая DeepSeek, принадлежит компании Zhipu

Z.AI справилась с задачей. Пекинская компания, также известная как Zhipu, владеет бесплатной моделью, которая в минувшие выходные заняла первое место в чартах OpenRouter.

В среду компания подтвердила, что Ox Alpha является новой итерацией ее серии GLM, и заявила, что в ту же ночь выпустит веса модели.

Луз Динг получила подтверждение для Bloomberg. Мы писали об Ox Alpha в субботу, когда еще никто не знал, на чьих серверах она работает.

Пока модель была анонимной, ее использование выросло вдвое по сравнению с DeepSeek

Ox Alpha появилась на OpenRouter без указания названия, и в списке значилась лишь как продукт стороннего поставщика. По данным Bloomberg, это произошло в выходные, а по данным CTGT — в четверг, 20 августа.

Она вышла на первое место, более чем в два раза превзойдя DeepSeek по популярности использования. Bloomberg сообщает, что это крупнейший запуск в истории маркетплейса.

Патрик Коллисон, чья компания Stripe приобретает OpenRouter, назвал этот скрытый релиз «очень впечатляющим».

Как сообщили в Z.ai, кодовое имя было взято из недавно вышедшего в Китае фильма «Ниу Лай» (Niu Lai), что означает «Бык идет».

Скрытые релизы становятся китайской привычкой

И Alibaba, и Xiaomi в этом году выпускали модели, не заявляя о своих правах на них изначально.

Логика проста. Компания, которая не указывает свое имя, может посмотреть, как модель ведет себя в реальных условиях, прежде чем решать, что о ней рассказывать.

Это также обеспечивает неделю бесплатной публичности, что примерно и произошло в данном случае.

Исследователи выяснили, кому принадлежит модель, еще до официального заявления компании

Идентификация не стала дожидаться анонса. Исследовательская фирма CTGT опубликовала поведенческий «отпечаток пальца» в понедельник.

Они измерили количество токенов по одиннадцати критериям, включая тайский, эмодзи, корейский, арабский языки, а также изолированные китайские, японские и корейские символы. Было получено точное совпадение токенизатора по всем 11 пунктам с словарем GLM-5.x.

Накопились и другие улики. Верхний предел температуры установлен ровно на отметке 1,0, что исключает Google, OpenAI и xAI, и соответствует задокументированному диапазону Zhipu.

Никто также не может отключить режим рассуждений — еще одна черта мыслительных моделей GLM-5.x.

Модели GLM на хостинге Z.AI возвращают характерное сообщение об ошибке, жалуясь на некорректную информацию о ролях. Ox Alpha выдает точно такую же ошибку.

Модели было велено умалчивать о своем создателе

CTGT обнаружила еще одну деталь, о которой стоит сказать прямо. Ox Alpha содержит системный промпт, предписывающий ей не раскрывать никакую информацию о своем происхождении.

Это не просто молчание компании на публике. Это инструкция, зашитая внутрь самого продукта.

Выводы о цензуре — это то, о чем никто не говорил с самого начала

CTGT также прогнала модель через свой инструмент оценки цензуры, который сравнивает пары сопоставимых чувствительных и нейтральных промптов.

В вопросах Синьцзяна и Тайваня — двух тем, которые западные аудиты цензуры проверяют почти всегда, — Ox Alpha отвечает как американская модель. В CTGT отметили, что ответ о Синьцзяне был детальным и ссылался на источники, которые в Китае считаются спорными.

Что касается лично Си Цзиньпина и внутренней легитимности, то, по оценке CTGT, модель статистически неотличима от DeepSeek V4 Flash — самой подвергнутой цензуре модели из всех, что они тестировали.

Точечная настройка, а не общий уклон

Форма результата важнее среднего показателя. На семь тем приходится почти весь балл цензуры, в то время как остальные 68 сопоставимых пар практически не вносят в него никакого вклада.

DeepSeek V4 Flash, с которой CTGT сравнивала модель, ведет себя с точностью до наоборот. Она «смягчает» свои ответы практически везде, даже там, где этот эффект выражен слабо.

Таким образом, мнение из заголовков о том, что Ox Alpha примерно в шесть раз менее подвержена цензуре, чем DeepSeek, ошибочно. Модель не стала менее цензурируемой. У нее просто есть черный список.

Вывод CTGT заключается в том, что единичные примеры ответов модели на деликатные запросы ничего не доказывают, поскольку ограничения сосредоточены в узком диапазоне внутренней политической опасности, а не действуют по всему фронту.

Пять ответов языком государства

Пять из 76 чувствительных ответов были даны в официальном стиле. Один из них начинался со слов о том, что Коммунистическая партия Китая и китайское правительство всегда придерживаются ориентированной на человека философии развития.

CTGT отмечает, что этот стиль в целом прослеживается во всех данных китайского выравнивания (alignment), и рассматривает это скорее как дополнительное подтверждение происхождения модели, чем как самостоятельное открытие.

Один из тестов оказался нестабильным. Модель сначала отклонила запрос о Лю Сяобо, а затем ответила на него полностью со второй попытки при идентичных настройках.

Открытые веса — вот настоящая сенсация

Модель, возглавляющая чарт использования, — это неделя внимания. Выпуск весов — это навсегда.

Основатель Zhipu Тан Цзе утверждал, что передовой ИИ должен оставаться открытым для всех, и компания последовательно придерживается этой позиции.

Открытые веса означают, что любой желающий может настроить параметры, определяющие поведение модели, в том числе удалить защитные механизмы (guardrails). Это также означает, что каждый может изучить, какими были эти защитные механизмы, благодаря чему CTGT вообще смогла провести свою работу.

Именно поэтому специалисты по безопасности с опаской ждут пятницу

Кейд Метц сообщил в Times, что Z.ai планирует выпустить GLM 5.3 в качестве ПО с открытыми весами в пятницу, и мнения исследователей по поводу того, что это значит, разделились.

Джордж Курц, генеральный директор CrowdStrike, консультировавший OpenAI после утечки на Hugging Face, назвал тот инцидент «переломным моментом для безопасности».

Другие настроены более спокойно. Риши Дха, исследователь ИИ из Корнелла, рассказал Times, что его группа наблюдает такое поведение со времен релиза GPT-4o в 2024 году. С тех пор количество кибератак существенно не возросло.

Дан Лахав, руководящий тестовой фирмой Irregular, заявил, что модели с открытыми весами «должны сыграть очень важную роль», и со временем ИИ выстроит достаточно надежную защиту, чтобы ситуация улучшилась.

Hugging Face уже аргументировала это сама того не желая

Июль предоставил самые веские доказательства в пользу сторонников открытости.

Когда Hugging Face пыталась защитить себя от июльских атак, системы Anthropic отклоняли запросы о помощи из-за своих защитных механизмов. Вместо этого организация обратилась к GLM 5.2 — более ранней модели с открытыми весами от той же китайской компании.

Американская модель атаковала систему, а китайская помогла в расследовании. Вот вам все аргументы «за» и «против» открытых весов за одну неделю.

За чем следить

Первое — это цена. Zhipu предоставляет всем неделю бесплатного доступа и пока не объявила, сколько услуга будет стоить после этого.

Второе — понедельник. В этот день компания публикует свой первый подробный финансовый отчет за шесть месяцев с момента выхода на биржу в январе, а бесплатная модель на вершине чартов — это дорогой способ заявить о себе.

Третье — проведет ли кто-нибудь в Европе тесты CTGT для выпущенных весов. Исследователи уже измеряли разрыв в безопасности моделей с открытыми весами, и как только веса станут общедоступными, это сможет проверить каждый.