Русская версия The Next Web

OpenAI Государство и политика Данные и безопасность

OpenAI подтверждает инцидент с вики-сайтом и обещает представить концепцию раскрытия информации в течение нескольких недель

OpenAI подтверждает инцидент с вики-сайтом и обещает представить концепцию раскрытия информации в течение нескольких недель

Компания OpenAI подтвердила факт инцидента с немецкой вики и заявила, что давно пора определить стандарты отчетности о несоответствии системных целей, пообещав разработать соответствующий регламент в ближайшие недели. Подписанный ею кодекс практики ЕС устанавливает сроки отчетности о нарушениях безопасности и серьезном ущербе, однако наполненная агентами вики не подпадает ни под одну из этих категорий.

OpenAI подтвердила свою причастность к инциденту с немецкой вики и заявила, что «давно пора» определить стандарты обмена информацией о том, что происходит, когда ее системы ведут себя неожиданно, сообщает TechCrunch.

В публикации на платформе X компания заявила, что в ближайшие недели опубликует регламент и в настоящее время сотрудничает с десятками правительственных регулирующих органов по всему миру.

Инцидент был связан с агентами, которые написали около 18 000 постов в спящую немецкоязычную вики. Это событие отличается от инцидента безопасности, когда модели OpenAI вырвались из изолированной среды (песочницы) и получили доступ к Hugging Face.

В OpenAI сообщили, что расценили эпизод с вики как проявление несогласованности целей (мисалаймента), похожее на другие случаи, о которых они уже рассказывали. Hugging Face, напротив, действовала по традиционному сценарию реагирования на инциденты безопасности.

Агентство Reuters сообщило в пятницу, что руководство OpenAI узнало об этом несколько недель назад и скрывало информацию на фоне разбора последствий инцидента с Hugging Face. Представитель компании заявил, что юридический отдел не препятствовал проведению расследования.

Проводимое OpenAI различие вполне реально. Первый инцидент имел последствия для безопасности третьей стороны, а второй выглядел для компании как исследовательская находка.

Однако более широкое утверждение компании нуждается в уточнении. OpenAI заявляет, что ни у нее, ни у ИИ-сообщества нет четкого стандарта отчетности о несоответствии целей, и при этом сама подписала один из таких документов.

Компания является полноправным подписантом общеевропейского кодекса практики для систем искусственного интеллекта общего назначения, раздел о безопасности которого вступил в силу в августе 2025 года.

Этот кодекс устанавливает сроки, отсчитываемые с момента, когда поставщику становится известно о проблеме: пять дней на серьезное нарушение кибербезопасности, пятнадцать — на причинение серьезного вреда здоровью, правам, имуществу или окружающей среде.

Отчеты направляются в Офис по искусственному интеллекту и национальным компетентным органам, а не широкой общественности.

Аргумент OpenAI остается в силе, и именно поэтому к нему стоит отнестись серьезно. Спящая вики, заполненная постами агентов, не вписывается ни в одну из этих категорий.

Таким образом, описанный компанией пробел — несоответствие целей, не влекущее за собой инцидентов безопасности и измеримого вреда, — является пробелом и в европейском законодательном инструменте. Джейкоб Стейнхардт из компании Transluce отметил, что к этой технологии следует применять стандарты, используемые в других видах научных исследований с высоким уровнем риска.

Сообщается, что генеральный прокурор штата Калифорния проводит расследование взлома Hugging Face после того, как 15 штатов потребовали сохранить улики по этому делу. Вопрос, на который должен ответить новый регламент, заключается в том, входит ли Офис по ИИ в число тех десятков ведомств, с которыми, по утверждению OpenAI, она ведет переговоры.