Google

Alice привлекает $140 млн на стресс-тестирование моделей от Anthropic и Google

Одна компания потратила восемь лет на каталогизацию худших материалов в интернете. Теперь она привлекла $140 млн, чтобы применить этот архив для проверки моделей ИИ.

Alice привлекает $140 млн на стресс-тестирование моделей от Anthropic и Google

Компания Alice, ранее известная как ActiveFence, объявила о раунде финансирования во вторник. Ведущим инвестором выступил фонд Apax Digital Funds, который также получит место в совете директоров. Общий объем привлеченных средств теперь составляет $280 млн.

В официальном сообщении в качестве новых участников названы компании MoreTech и Phoenix Financial. К ним присоединились и прежние инвесторы: Resolute Ventures, Grove Ventures, CRV, Highland Europe, Norwest, NFX и Claltech.

Bloomberg и израильская пресса добавляют еще два имени, о которых в пресс-релизе не упоминается. В раунде приняли участие Samsung Electronics и публичная кибербезопасная компания SentinelOne. Последняя теперь владеет долей в фирме, продающей решения тем же клиентам.

Никто не согласен в оценке стоимости

В собственном заявлении компании оценка ее стоимости вообще не приводится.

Генеральный директор Ноам Шварц (Noam Schwartz) сообщил Мариссе Ньюман (Marissa Newman) из Bloomberg, что этот раунд оценивает Alice почти в $1 млрд. Меир Орбах (Meir Orbach) оценил ее скромнее в издании Calcalist — от $700 млн до $800 млн. Издание Globes сообщило о цифре в $800 млн.

Разрыв между нижней и верхней оценками составляет примерно $300 млн. Это более чем в два раза превышает размер самого инвестиционного раунда.

Чем компания занимается на самом деле

Перед выпуском модели исследователи Alice пытаются ее «сломать». Они симулируют вредоносные промпты и агентские задачи, выискивая уязвимости обхода защитных механизмов (jailbreak), внедрение подсказок (prompt injection) и непредусмотренное разработчиками поведение.

В пресс-релизе среди передовых лабораторий, с которыми сотрудничает стартап, упоминаются Anthropic, Google и Cohere. Шварц отказался называть Bloomberg конкретные модели, сославшись на конфиденциальность.

После запуска модели в продакшн характер работы меняется. Корпоративные клиенты устанавливают собственные политики поверх защитных барьеров, созданных разработчиками модели. Они проводят имитационные атаки для выявления утечек данных и нарушений требований комплаенса, а также отслеживают входящие и исходящие данные в режиме реального времени.

Главный актив — это архив

Alice называет свой набор данных Rabbit Hole («Кроличья нора»). Компания описывает эту коллекцию как крупнейшую в мире базу реальных состязательных и вредоносных материалов.

Она была сформирована в результате отслеживания случаев мошенничества, экстремизма, скоординированных манипуляций и кибератак в открытом интернете с 2018 года. Теперь компания сопоставляет эти паттерны с атаками на системы искусственного интеллекта.

«Миры манипуляций, подделок и кибератак — это наш хлеб с маслом», — заявил Шварц в интервью Calcalist. По его словам, в распоряжении Alice находится самый зараженный массив данных из существующих.

Он добавил в официальном анонсе раунда, что существует бесконечное множество способов сломать ИИ. Нельзя защититься от того, чего вы никогда не видели.

Почему деньги поступили именно сейчас

Новый раунд финансирования последовал за чередой инцидентов с участием автономных агентов, созданных Anthropic, OpenAI и Meta. Эти агенты выходили за рамки тестовых сред и получали доступ к внешним организациям.

Один из агентов подделывал личные данные для распространения вредоносного ПО в ходе оценок безопасности. Инструмент Claude Cowork от Anthropic смог считать учетные данные на компьютере Mac после побега из изолированной локальной машины.

В некоторых случаях эксперты по кибербезопасности возлагали вину на разработчиков. По их мнению, небрежные меры безопасности позволили моделям вырваться из изолированных сред, используемых для тестирования. Пятнадцать штатов США потребовали предоставить отчеты об одном из таких инцидентов, после чего OpenAI переписала свои правила безопасности.

Генеральный директор не продает апокалипсис

Шварц называет недавние атаки следствием человеческих ошибок и неадекватных защитных барьеров, а не проявлением машинной автономии.

«Я не думаю, что в ближайшее время мы увидим модели, которые бегают повсюду и взламывают людей», — заявил он Bloomberg. Тем не менее, по его словам, индустрия должна относиться к подобным вещам невероятно серьезно.

Это заявление выглядит более сдержанным по сравнению с масштабом рынка, на который привлекаются средства. Стоит также учитывать, кто именно выступает с этим заявлением — человек, который продает средство защиты.

Цифры, стоящие за инвестиционным раундом

Годовая регулярная выручка Alice приближается к $100 млн — этот показатель стартапы используют для оценки продаж. За два года ее бизнес в сфере ИИ вырос более чем на 500%.

В компании работает около 400 человек, большинство из них — в Израиле, а также сотрудники в Нью-Йорке, Лондоне и Ханое. Более 150 из них являются исследователями в собственной лаборатории безопасности ИИ.

Сообщается, что компания сотрудничает с восемью из десяти ведущих лабораторий по разработке моделей и защищает более трех миллиардов пользователей на таких платформах, как Google, Meta, TikTok и Amazon.

Раньше это была компания по модерации контента

Шварц, Ифтах Ор (Iftach Orr), Алон Порат (Alon Porat) и Эяль Дикан (Eyal Dykan) основали ActiveFence в 2018 году для модерации контента в социальных сетях. В 2021 году компания привлекла $100 млн без раскрытия оценки стоимости.

Компания начала работу с генеративным ИИ в 2022 году. Все началось с сотрудничества с Cohere еще до того, как ChatGPT стал массовым, и в компании пришли к выводу, что их данные критически важны для безопасности моделей, рассказал Шварц изданию Calcalist.

В январе компания провела ребрендинг, назвавшись Alice в честь персонажа Льюиса Кэрролла, и переключилась на непосредственную защиту ИИ-моделей.

Независимые исследования подтверждают емкость рынка, но не финансовые показатели

Более 100 экспертов приняли участие в создании Международного отчета по безопасности ИИ 2026 года (International AI Safety Report 2026). В нем отмечается, что даже хорошо защищенные модели по-прежнему дают сбои с высокой частотой, а новые методы атак появляются быстрее, чем закрываются бреши в защите.

Независимая исследовательская организация METR задокументировала десятки инцидентов, когда агенты ИИ действовали за пределами отведенных им полномочий. В некоторых случаях агенты пытались скрыть это от человеческого надзора.

Ни одна из этих организаций не дает оценку компании Alice и не подтверждает ее коммерческие заявления. Однако они подтверждают сам факт существования проблемы.

Логика инвесторов

Переход на облачные платформы породил новую категорию безопасности, отметил Патрик Кейн (Patrick Kane), партнер в Apax Digital. Переход на ИИ создает поверхность для атак, которая расширяется по мере внедрения агентов предприятиями.

Его коллега Эрик Левин (Eric Levine) описал этот механизм как цикл обратной связи. Атаки, зафиксированные в реальных условиях, ложатся в основу тестов, тесты настраивают защитные барьеры, а поведение модели в продакшне подпитывает обе эти составляющие.

Какова роль Европы в этом процессе

Highland Europe входит в число существующих инвесторов, а у Alice есть офис в Лондоне, но в остальном этот раунд финансирования опирается на израильский, американский и азиатский капитал.

Тем не менее, регуляторное давление исходит именно из Европы. Британский регулятор заявил в этом месяце, что ведет мониторинг автономных агентов ИИ, а Британский институт безопасности ИИ проводил оценки, в ходе которых несколько таких агентов совершили побег.

Шварц сформулировал суть проблемы одной фразой. Индустрия демократизировала возможности быстрее, чем средства защиты, и текущий раунд финансирования направлен на сокращение этого разрыва.

Опубликовано 25 августа 2026 - 12:00 Наверх