Чем больше самостоятельности получает ИИ-агент, тем больше у компании поводов для тревоги: а что если он полезет не туда, куда нужно, или получит доступ к паролям, которые ему совсем не положены видеть? Anthropic вместе с NVIDIA решили закрыть именно эту проблему — и представили связку инструментов, которая разводит «что агент умеет» и «что агент может сделать физически» на два разных уровня контроля.
Зачем компаниям вообще это понадобилось
Ещё пару лет назад ИИ в основном отвечал на вопросы. Сейчас всё чаще агенты берут на себя целые куски работы: пишут код, собирают презентации, лезут в закрытые корпоративные базы данных и совершают действия от имени сотрудников. Логика простая — чем умнее становятся модели, тем больше задач им доверяют, а чем больше задач, тем больше доступа к системам они получают.
Но у этой логики есть обратная сторона. Доступ — это риск. Если агент может писать в базу данных, значит, теоретически он может написать туда что-то лишнее. Если он видит пароль от корпоративного аккаунта, значит, этот пароль потенциально может утечь или быть использован не по назначению. Чем шире полномочия агента, тем важнее для компании иметь способ проверить и ограничить, что именно он делает — причём независимо от того, насколько «умной» и «безопасной» считается сама модель.
Защита слоями, а не одной стеной
Ключевая идея нового подхода — не полагаться на одну линию защиты. Первый уровень безопасности встроен прямо в модель — это стандартные ограничения, которые есть у Claude по умолчанию. Но Anthropic и NVIDIA добавили ещё два слоя, которые работают снаружи модели и не зависят от того, ошиблась ли она сама или сделала всё правильно.
Claude Managed Agents отвечает за то, чтобы агент вообще не видел паролей и ключей, которые ему не положены. NVIDIA OpenShell отвечает за то, чтобы каждое действие агента — какой файл открыть, куда отправить запрос, к какому инструменту обратиться — проверялось по явным правилам. Смысл именно в модульности: каждый слой работает сам по себе, и если один почему-то подведёт, защита не рассыплется полностью. Компания при этом сама решает, какие слои ей нужны и в каком сочетании.
Почему это важнее, чем кажется
Одно дело — доверять модели «не делать плохого». Совсем другое — физически лишить её возможности сделать плохое, даже если она захочет. Второй подход надёжнее, потому что не зависит от качества самой модели.
Claude Managed Agents: работа отдельно, ключи отдельно
Managed Agents — это набор API для сборки и запуска агентов промышленного уровня. Главная архитектурная деталь: цикл работы агента выполняется на одном сервере, а песочница — изолированная среда, где физически происходит работа, — на другом. Пароли и ключи доступа хранятся в отдельном сейфе (vault), и агент их просто никогда не видит напрямую.
Это решает довольно неприятную проблему: раньше, чтобы агент мог, например, зайти в корпоративную CRM, ему нужно было где-то «знать» пароль. А значит, теоретически этот пароль мог оказаться в логах, в выводе модели, где-нибудь ещё. С раздельным хранением credentials агент просит выполнить действие, а сама аутентификация происходит в защищённом слое, минуя агента.
Дополнительно Managed Agents ведёт полный аудит: фиксирует, что именно сделал каждый агент, и интегрируется с уже существующими у компании системами контроля доступа. Компания может подключить свою собственную песочницу и решить, где и как она будет работать — на своей инфраструктуре или у управляемого провайдера.
NVIDIA OpenShell: что агенту разрешено трогать
Если Managed Agents прячет от агента ключи, то OpenShell следит за тем, что агент делает руками. Это открытое (open source) программное обеспечение от NVIDIA, безопасная среда выполнения, которая контролирует и логирует буквально каждое действие агента.
Принцип здесь жёсткий и очень наглядный: по умолчанию всё запрещено, пока правило явно не разрешит. OpenShell проверяет каждый инструмент, который пытается вызвать агент, и применяет правила к файлам, сетевым соединениям и данным, к которым он обращается. Важно, что правила исполняются снаружи самого агента — то есть агент физически не может их обойти изнутри, потому что решение принимает не он.
Каждое разрешённое и каждое заблокированное действие логируется. Это даёт командам простой рабочий цикл: начать с максимально узких прав, посмотреть логи, а затем с помощью Claude постепенно сузить правила до минимально необходимого набора доступа для конкретной задачи. А дальше в дело вступает так называемый policy prover OpenShell — механизм, который математически доказывает, что при заданных правилах агент реально может дойти только до того, что разрешено, и не дальше.
| Слой защиты | Что делает | Кто отвечает |
|---|---|---|
| Ограничения модели | Базовая безопасность внутри самого Claude | Модель |
| Claude Managed Agents | Прячет пароли и ключи от агента, ведёт аудит действий | Anthropic |
| NVIDIA OpenShell | Разрешает или блокирует каждое конкретное действие агента | NVIDIA |
Что входит в Managed Agents
Managed Agents — это не одна функция, а целый набор возможностей для запуска агентов в проде:
- Агенты промышленного уровня с готовой безопасной песочницей, аутентификацией и выполнением инструментов — всё это уже настроено за тебя.
- Долгие сессии: агент может автономно работать часами, а прогресс и результаты сохраняются даже при разрывах соединения.
- Мультиагентная оркестрация: один агент может запускать других агентов и распределять между ними сложную задачу параллельно.
- Проверенное управление доступом: агенты получают доступ к реальным системам с чётко ограниченными правами, встроенным управлением идентификацией и трассировкой всех выполненных действий.
Это фактически инфраструктура, которая раньше требовала от команды самостоятельно собирать десятки кусков — свою систему логирования, свою аутентификацию, свою изоляцию. Теперь всё это идёт готовым набором.
Как это уже используют реальные компании
Notion встроил Managed Agents прямо в рабочее пространство: инженеры используют агентов, чтобы писать код, а остальные сотрудники — чтобы собирать сайты и презентации. Десятки задач могут выполняться параллельно, пока команда обсуждает результаты вместе.
Rakuten запустил специализированных агентов сразу в нескольких направлениях — в инженерии, продукте, продажах, маркетинге и финансах, и каждый такой агент был развёрнут в течение всего одной недели. Это показывает, насколько быстро компания может начать применять агентов при готовой инфраструктуре безопасности, не выстраивая всё с нуля.
Asana построила на базе Managed Agents свои AI Teammates — агентов, которые работают вместе с людьми прямо внутри проектов Asana, берут на себя задачи и готовят черновики результатов. По словам команды, использование Managed Agents позволило добавлять продвинутые функции заметно быстрее, чем если бы им пришлось собирать всю инфраструктуру самим.
Доступность и что дальше
Managed Agents доступен уже сейчас. Он может работать в песочнице, которую контролирует сама компания — либо на собственной инфраструктуре, либо через управляемого провайдера. NVIDIA OpenShell распространяется как открытое программное обеспечение под лицензией Apache 2.0 и доступен на GitHub и на странице ресурсов для разработчиков NVIDIA.
Это важный сигнал для рынка в целом: крупные игроки признают, что автономные агенты — это не просто «умная модель», а целая архитектура безопасности вокруг неё. Тем, кто хочет разобраться в основах работы с агентами и терминалом с нуля, будет полезен бесплатный курс zero2claude — он объясняет базовые принципы работы с Claude Code ещё до того, как речь заходит о промышленных развёртываниях с песочницами и сейфами ключей.
Частые вопросы
Что такое NVIDIA OpenShell?
Это открытое (open source) программное обеспечение от NVIDIA, которое контролирует и логирует каждое действие ИИ-агента. Оно работает по принципу «всё запрещено, если явно не разрешено» и проверяет каждый вызов инструмента, файл, сетевое соединение и обращение к данным.
В чём разница между Claude Managed Agents и NVIDIA OpenShell?
Managed Agents отвечает за то, чтобы агент вообще не видел паролей и ключей доступа — они хранятся в отдельном защищённом сейфе. OpenShell отвечает за то, что агент может делать физически: какие файлы открывать, куда обращаться по сети, какие инструменты вызывать. Это два независимых слоя защиты, которые дополняют друг друга.
Нужно ли использовать оба инструмента одновременно?
Нет, слои защиты модульны, и компания может выбрать те, что подходят под её инфраструктуру. Но совместное использование Managed Agents и OpenShell даёт более полную защиту, потому что каждый слой работает независимо от другого.
Кто уже использует Claude Managed Agents?
Среди компаний, применяющих Managed Agents, — Notion (для написания кода, сайтов и презентаций), Rakuten (специализированные агенты в разных отделах, развёрнутые за неделю) и Asana, построившая на его основе AI Teammates.
Где можно найти NVIDIA OpenShell?
OpenShell распространяется под лицензией Apache 2.0 и доступен как открытый проект на GitHub, а также на странице ресурсов для разработчиков NVIDIA.
Главный вывод из этого анонса простой: чем самостоятельнее становятся ИИ-агенты, тем важнее не столько «доверять» им, сколько выстраивать вокруг них инфраструктуру, которая физически ограничивает, что они могут сделать. Связка Claude Managed Agents и NVIDIA OpenShell — это попытка дать компаниям именно такой инструмент: пароли под замком, действия под логом, а доступ — ровно тот, что нужен для конкретной задачи, и не больше.
Что почитать по теме
- Claude Opus 5.5: почему новая модель дешевле для длинных сессий кода
- Как теперь публикуют плагины для Claude: новый портал
Если хочешь попробовать всё это руками — начни с бесплатного курса «Claude с нуля».
Источник
По мотивам статьи Anthropic «Giving companies more control over their AI agents, with NVIDIA». Пересказали по-русски для новичков.