Перейти к содержимому
Enterprise Frontier Safeguards: защита передовых моделей для корпоративного ИИ
8 мин чтения

Enterprise Frontier Safeguards: защита передовых моделей для корпоративного ИИ

enterprise-aiai-safetydata-privacyzero-data-retentionai-governance

Anthropic представляет Enterprise Frontier Safeguards (EFS) — набор корпоративных механизмов защиты, который объединяет режим нулевого хранения данных (Zero Data Retention, ZDR) и расширенный мониторинг для выявления неправомерного использования. Данные при этом остаются в облачной инфраструктуре под контролем клиента, а не хранятся у Anthropic.

Внедрение EFS будет проходить поэтапно и начнётся позднее этой осенью. На переходный период клиенты, отвечающие условиям программы, смогут использовать ZDR для Fable 5 и Fable 5.1 — до полной готовности EFS.

Решение создавали вместе более чем со 100 заказчиками из финансового сектора, здравоохранения, промышленности, телекоммуникаций, юридических услуг, ретейла и госсектора. В работе также участвовали облачные партнёры: Amazon Web Services, Google Cloud и Microsoft Azure.

EFS будет доступен в Claude Code, Claude Enterprise, Claude Platform, Amazon Bedrock, Claude Platform on AWS, Google Agent Platform и Microsoft Foundry.

Почему защита передовых моделей стала отдельной задачей

Модели уровня Mythos — например, Claude Fable 5.1 — заметно продвинулись и в рассуждениях, и в агентных сценариях. Но рост возможностей приносит не только пользу: повышается риск злоупотреблений и нежелательного автономного поведения. Тут, как ни крути, одной формальной политики недостаточно.

В последние месяцы Anthropic фиксировала попытки неправомерного применения ИИ: от привычного мошенничества до сложных кибератак, в которых агенты способны выполнять разрушительные действия почти автономно. В ряде случаев использовались похищенные или скомпрометированные учётные данные корпоративных клиентов. Без анализа трафика и поиска аномалий такие эпизоды обнаружить крайне трудно.

Наиболее сложные случаи, включая описанные Anthropic сценарии ИИ-шпионажа, распределяются между множеством задач, сессий и учётных записей. Поэтому недостаточно автоматически проверить отдельный запрос и тут же удалить сведения о нём. Для выявления взаимосвязей данные нужно сопоставлять во времени — иначе общая картина рассыпается на разрозненные фрагменты.

Именно по этой причине с выходом Fable 5 Anthropic ввела 30-дневный срок хранения данных. Эта мера не связана с обучением моделей на корпоративной информации: Anthropic не обучала и не будет обучать модели на данных предприятий без их явного разрешения.

Заказчики признавали ценность мониторинга, однако для многих организаций, прежде всего из строго регулируемых отраслей, модель с хранением данных у поставщика оставалась неприемлемой. Так возникла задача: совместить конфиденциальность ZDR с защитой, для которой требуется видеть события не поодиночке, а в динамике. EFS — ответ на эту дилемму.

Решение, спроектированное вместе с заказчиками

При разработке Enterprise Frontier Safeguards Anthropic опиралась на обратную связь специалистов, которым предстоит работать с системой ежедневно: команд информационной безопасности, продуктов, комплаенса и внедрения. Среди участников был Analysis and Resilience Center for Systemic Risk (ARC), объединяющий CISO крупнейших банков США, включая Goldman Sachs, Morgan Stanley, Citi, Bank of America и Wells Fargo.

Кроме того, Anthropic обсуждала архитектуру с руководителями Comcast, KPMG, Mastercard, Salesforce и Visa. В консультациях участвовали около четверти компаний из Fortune 100, все глобально системно значимые банки США и представители практически всех регулируемых отраслей.

Ниже — ключевые требования, которые заказчики сформулировали в ходе этой работы, и способы их реализации в EFS.

Мониторинг: сигналы поступают владельцу данных

Компании давно используют мониторинг для снижения рисков внутренних угроз. Теперь им нужен столь же внятный контроль за действиями ИИ-агентов и автоматизированных систем. При этом закономерно возникают вопросы: соответствует ли мониторинг нормативным требованиям и кто именно получает доступ к чувствительной информации?

В EFS клиент сам контролирует порядок проверки данных. Если система обнаруживает паттерн, заслуживающий внимания, сигнал направляется непосредственно заказчику. Дальше ситуацию оценивает его собственная команда — с учётом внутренних процедур, прав доступа и контекста.

Хранение данных: в среде, которой управляет клиент

Добавить нового доверенного поставщика данных — это не просто поставить галочку в анкете. Организации обязаны уведомлять клиентов, пересматривать договоры, настраивать аудит и выполнять внутренние требования к защите чувствительной информации. Поэтому архитектура EFS позволяет хранить данные в уже используемой облачной среде заказчика.

Клиент управляет хранением и жизненным циклом данных. Журналы активности для мониторинга могут размещаться в аккаунте клиента — например, в Amazon S3, Azure Blob Storage или Google Cloud Storage. Организация сохраняет контроль над ключами шифрования, политиками доступа и журналами аудита. Для компаний, внедряющих ИИ-агентов и автоматизацию, такой подход особенно важен: агентные процессы нередко затрагивают критичные бизнес-данные.

Автоматическая проверка без доступа Anthropic к содержимому

Автоматизированные системы всё лучше находят подозрительные сигналы, но человеческая проверка всё ещё нужна — хотя бы для подтверждения инцидента и отсечения ложных срабатываний. Многие заказчики из регулируемых отраслей прямо указали: проверять такие сигналы должны их собственные сотрудники. У них уже есть необходимые допуски, обучение и право работать с юридически привилегированными материалами, непубличной информацией или данными о безопасности лекарственных средств.

EFS включает автоматизированный мониторинг безопасности и не предполагает ручной проверки со стороны Anthropic. Система анализирует скользящее окно трафика и ищет признаки серьёзного неправомерного использования: попытки создания наступательных кибер- или биологических возможностей, а также следы украденных либо утёкших учётных данных. Флаги передаются непосредственно клиенту, а дальнейшие действия определяет его команда безопасности. Это практичная модель безопасности ИИ-агентов: мониторинг работает, но контроль не уезжает за пределы организации.

«Механизмы контроля ИИ должны защищать конфиденциальную информацию, а защитные механизмы моделей — важная часть этой работы. Anthropic привлекла нас к разработке Enterprise Frontier Safeguards, чтобы решение соответствовало нашим требованиям и стандартам».

«Enterprise Frontier Safeguards даёт нам именно то, о чём мы просили: журналы остаются в среде Wells Fargo и защищены ключами, которыми управляет Wells Fargo. Мы сохраняем контроль над данными, а Anthropic обеспечивает обнаружение рисков. Такое разделение позволяет безопасно использовать передовые модели и выполнять обязательства перед клиентами, сотрудниками и регуляторами».

«Для компании, управляющей критически важной инфраструктурой, возможности моделей имеют большое значение. Не менее важна возможность хранить данные в собственном аккаунте — и Enterprise Frontier Safeguards решает эту задачу».

«Несколько наших участников работали с Anthropic, чтобы определить условия запуска наиболее мощных передовых моделей в системно значимых банках: кому принадлежат данные и ключи, что может видеть автоматизированная проверка и когда человеку вообще разрешено просматривать информацию. Это сотрудничество помогает создавать масштабируемые отраслевые стандарты защиты».

«Ключевой принцип архитектуры защитных механизмов — хранить данные вне самой модели, в защищённой среде заказчика. Такой подход открывает применение ИИ в строго регулируемых и чувствительных областях бизнеса, где раньше это было практически невозможно».

Сервисный партнёр

«Наши клиенты доверяют нам свои данные уже более двадцати лет. Поэтому мы решили работать с Anthropic над безопасностью и конфиденциальностью на уровне архитектуры, а не ждать в стороне».

«Клиенты хотят использовать передовые модели, а их службы безопасности хотят сохранять данные в инфраструктуре под своим контролем. Enterprise Frontier Safeguards создавалась более чем со ста компаниями именно для этого».

Сервисный партнёр

«Когда ИИ-модели начинают выполнять больше регулируемых и чувствительных задач, ответственное масштабирование определяется не одними политиками, а архитектурой. Контроль над средой данных в сочетании с автоматическим мониторингом даёт компаниям основу для подотчётного внедрения».

Сервисный партнёр

«Защитные механизмы действительно учитывают нашу обратную связь. Журналы остаются под нашим контролем и не передаются без нашего решения. Это даёт нам контроль и над данными, и над реакцией на выявленные риски».

«По мере того как ИИ глубже встраивается в работу компаний, безопасность и доверие помогают перейти от экспериментов к масштабу. EFS закладывает это с самого начала: данные мониторинга остаются в инфраструктуре клиента, а доступ к ним определяет его команда».

Сервисный партнёр

«Конфиденциальность данных клиентов — обязательство Snowflake перед каждым заказчиком. Совместная работа с Anthropic позволила совместить доступ к мощным моделям и строгие гарантии: данные остаются в среде клиента и защищены ключами под его контролем».

«Защита данных клиентов лежит в основе работы Stripe. Enterprise Frontier Safeguards позволит использовать передовые модели, сохраняя журналы диалогов в AWS-среде Stripe, а доступ и проверку — под контролем средств безопасности Stripe».

«Финансовым организациям нужен доступ к сильным интеллектуальным возможностям, но не ценой безопасности данных. Enterprise Frontier Safeguards сочетает передовые интеллектуальные возможности с корпоративными механизмами контроля, без которых внедрение ИИ в финансовом секторе не взлетит».

«FIS обеспечивает инфраструктуру, на которой держится движение денег и работа финансовых институтов. Enterprise Frontier Safeguards расширяет совместную работу с Anthropic: данные остаются в аккаунте FIS, а сигналы направляются напрямую команде безопасности компании».

«Компании доверяют автономным инженерам Cognition работу в производственной среде, и это доверие зависит от конфиденциальности. С EFS данные и идентификаторы клиентов не покидают среду Cognition. Это позволяет применять передовой ИИ в реальных рабочих процессах без компромиссов».

«Код и данные клиентов — одна из самых ценных частей их интеллектуальной собственности. Enterprise Frontier Safeguards позволяет использовать мощные модели Claude, не теряя контроль над проприетарными данными».

«Для юридических и профессиональных команд конфиденциальность и безопасность не подлежат обсуждению. EFS даёт заказчикам с наиболее строгими требованиями доступ к передовым моделям без хранения их данных поставщиком модели».

Как работает EFS

Механизмы контроля работают одинаково независимо от того, обращается ли клиент к Claude напрямую через Anthropic или через облачного партнёра. Заказчики Amazon Web Services, Google Cloud и Microsoft Azure получат эквивалентные возможности, а данные об активности будут храниться в их собственных облачных аккаунтах — в той среде, которой они уже доверяют. Anthropic также прорабатывает поддержку решений сторонних поставщиков для клиентов, соответствующих критериям EFS.

Клиентское хранилище, ключи шифрования под управлением заказчика (Customer-Managed Encryption Keys, CMEK) и полностью автоматизированная проверка подключаются независимо. Организация выбирает только нужные компоненты. При этом EFS не меняет поведение модели, стоимость API или лимиты запросов.

Anthropic не взимает отдельную плату за Enterprise Frontier Safeguards. Если клиент хранит данные в собственном облачном аккаунте, облачный провайдер тарифицирует хранилище, операции чтения и записи, а также передачу данных — как и для любых других используемых облачных ресурсов.

Для устойчивого корпоративного внедрения важны не только отдельные средства контроля, но и продуманная архитектура ИИ-агентов: разграничение доступа, наблюдаемость, управление ключами и прозрачный маршрут обработки данных должны быть предусмотрены заранее, а не добавлены в авральном режиме.

Схема работы Enterprise Frontier Safeguards

Как начать работу

Enterprise Frontier Safeguards будет развёртываться поэтапно; Anthropic планирует обеспечить широкую доступность решения позднее этой осенью. Чтобы запросить доступ, заполните форму Anthropic.

Организациям из регулируемых отраслей стоит заранее оценить требования к хранению данных, журналированию, правам доступа и проверке инцидентов. Это помогает совместить безопасность и соответствие требованиям ИИ ещё до запуска системы в промышленную эксплуатацию.

Если предстоит совместить передовые модели с требованиями регулятора, мы опишем регламенты доступа, журналирования и аудита для ИИ-агентов и соберём контур, в котором данные остаются на вашей стороне.

Источник: anthropic.com