Вернуться к новостям
БезопасностьAI Understanding брифинг

Capsule Security сообщает о автоматическом выключателе с искусственным интеллектом на базе Nemotron

SiliconANGLE сообщает, что Capsule Security выпустила систему на базе Nemotron, которая оценивает действия ИИ-агента непосредственно перед их выполнением и может разрешать, помечать или блокировать их.

4 min readRead the linked source
Source-provided image accompanying Capsule Security reports Nemotron-based AI circuit breaker
Ссылка на источникИсточник записан
Издатель
siliconangle.com
Ссылка на источник
siliconangle.comhttps://siliconangle.com/2026/09/02/capsule-security-fine-tunes-nvidia-nemotron-models-to-stop-rogue-ai-agents/
Тип источника
Связанный источник — статус первоисточника не установлен.
Также цитируется

Последняя редакция истории

КонтекстПоймите это за 60 секунд

Начните здесь

Ключевые термины

Память (Память агента)
Сохраненный контекст, который агент ИИ использует на этапах или сеансах для улучшения непрерывности.
Быстрая инъекция
Схема атаки, при которой вредоносные инструкции вставляются во входные данные модели или извлекаемый контент.
Контрольный показатель
Стандартизированный тест или набор данных, используемый для измерения и сравнения производительности модели.
Проверьте себяВикторина «Агенты ИИ»

Что изменилось с момента публикации

  1. Впервые опубликовано
  2. В SiliconANGLE добавляют, что Capsule Security выпустила отдельный монитор предварительного выполнения на базе Nemotron для мошеннических действий ИИ-агента. Capsule сообщает о точности 98 % по StepShield, 96,9 % по внутреннему тесту, времени отклика всего 71 миллисекунду и развертывании одного NVIDIA-L40S для своей более крупной модели. Сообщается, что эта возможность уже доступна, но цены, условия доступа, интеграция и независимая проверка неизвестны.

Что случилось

SiliconANGLE сообщает, что Capsule Security выпустила «автоматический выключатель с искусственным интеллектом», построенный на основе двух доработанных моделей NVIDIA Nemotron. Система оценивает предполагаемое действие агента непосредственно перед его выполнением и позволяет клиентам разрешить, пометить или заблокировать его. Capsule сообщила, что детектор достиг точности 98% в тесте StepShield и выдал решение всего за 71 миллисекунду. Сообщается, что эта возможность уже доступна, хотя условия доступа и цены не разглашаются.

SiliconANGLE сообщает, что Capsule Security выпустила систему обнаружения на основе двух моделей Nemotron NVIDIA, которую она доработала самостоятельно. Capsule описывает продукт как «выключатель искусственного интеллекта»: он оценивает предполагаемое действие агента непосредственно перед его выполнением, позволяя клиенту разрешить, пометить или заблокировать его. Источник сообщает, что уровень управления предназначен для агентов с полномочиями доступа к конфиденциальным данным, исходному коду или производственной инфраструктуре.

По данным SiliconANGLE, компания Capsule заявила, что ее система достигла точности 98% в тесте StepShield, использующем 9429 траекторий кодового агента, взятых из реальных инцидентов. Сообщается, что самый точный детектор Capsule набрал 96,9% по внутреннему тесту по сравнению с 86% для самой мощной неназванной сторонней модели, протестированной. В статье говорится, что Capsule не идентифицировала эту модель и не предоставила разбивку оценок.

SiliconANGLE сообщает, что решения возвращаются всего за 71 миллисекунду. В Capsule заявили, что требования к памяти ее более крупной модели были снижены почти вдвое без потери производительности, что позволило ей работать на одном графическом процессоре NVIDIA L40S. Сообщается, что данные обучения включали следы реальных агентов и проверенные человеком примеры состязаний, отмечающие границу между разрешенным и несанкционированным поведением.

Источник сообщает, что такая возможность уже доступна. В нем не указаны цены, закупки, поддерживаемые агентские платформы, географические ограничения или общедоступность выпуска. Ни одна из заявлений о производительности, отзывов клиентов или заявленной доступности не было независимо подтверждено в ходе этой оценки.

Подробности об источнике: siliconangle.com ↗

Почему это важно

Сообщаемая система нацелена на практическую слабость безопасности агента: разрешения могут ограничивать доступ агента, но они не обязательно определяют, подходит ли конкретное действие для задачи. Уровень принятия решений перед выполнением может дать группам безопасности еще одну точку контроля, прежде чем ошибка станет инцидентом. Показатели производительности, заявления клиентов и сравнения остаются результатом заявлений Capsule от SiliconANGLE и не получили здесь независимого подтверждения.

Сообщаемый подход фокусируется на том, соответствует ли действие задаче, назначенной агенту, а не только на проверке того, имеет ли агент технически разрешение на его выполнение. Это различие имеет значение, поскольку организации предоставляют агентам доступ к учетным данным, репозиториям кода и производственным системам. Контроль, применяемый до исполнения, может ограничить время между принятием небезопасного решения и возможными последствиями, хотя источник не предоставляет независимых доказательств того, что он предотвращает реальные инциденты.

Заявление о задержке и развертывании с одним графическим процессором может сделать мониторинг на уровне шагов более практичным для некоторых организаций, чем большая генеративная модель, используемая в качестве отдельного проверяющего. Однако в статье не приводятся ложноположительные или ложноотрицательные показатели, примеры заблокированных действий, методология тестирования, выходящая за рамки указанного контрольного показателя, или независимая репликация. Поэтому сравнение с неназванными сторонними и пограничными моделями не может установить превосходство.

В SiliconANGLE говорят, что среди клиентов есть финансовые учреждения и технологические компании, и цитируют директора по информационной безопасности H&R Block, поддерживающего меры такого рода. Эти ссылки указывают на заявленный корпоративный интерес, а не на доказательство широкого распространения или эффективности. Источник не уточняет, предназначен ли продукт для самообслуживания, предназначен только для предприятий или продается как отдельная платная услуга.

Interactive Mechanism

Интерактивный механизм: как он на самом деле работает

Изучите технологию, лежащую в основе этой разработки, в интерактивном режиме.

Agent Lifecycle Stage:
1
User Intent & Planning: "Audit customer refund request #4092 and settle payment."
2
Tool Calling: Emits structured JSON call crm_get_transaction(id='4092').
3
Guardrail & Verification:🛡️ Paused: High-value action requires human operator sign-off.
4
Final Settlement: Refund recorded, email receipt dispatched, and audit log stored.
Core takeaway: An AI agent is not just a language model—it is a closed loop of planning, tool invocation, and environment feedback. Production systems require self-healing retries and strict human approval guardrails.
Интерактивная проверка концепции+10 Points
AI Agents Quiz

An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?

Что посмотреть дальше

Следите за независимым тестированием результатов StepShield компании Capsule, подробностями о ложноположительных и ложноотрицательных результатах, а также данными из производственных развертываний. Также неясно, как система интегрируется с различными платформами агентов, какие действия она может проверять, требуется ли одобрение человека для заблокированных или помеченных действий и сохраняется ли заявленная задержка в 71 миллисекунду при рабочих нагрузках предприятия. SiliconANGLE не сообщил о ценах или общедоступном способе самостоятельной регистрации.

Независимые исследователи и клиенты должны проверить, переносится ли сообщаемая точность из внутренних тестов StepShield и Capsule на различные агентские платформы, инструменты, задачи и методы атак. Сама по себе точность на уровне шагов может не показать, как часто монитор пропускает вредное действие или прерывает законную работу.

В дальнейших отчетах должно быть указано, как Capsule обрабатывает неоднозначные действия, каскадные вызовы инструментов, внедрение подсказок, скомпрометированные учетные данные и агентов, поведение которых меняется после мониторинга. Источник не объясняет, какие доказательства использует детектор, чтобы решить, разрешено ли действие или как клиенты настраивают политики.

Эта возможность описана как доступная сейчас, но SiliconANGLE не предоставляет информации о цене, процессе регистрации, условиях уровня обслуживания или списке поддерживаемых интеграций. Эти детали определят, кто на самом деле сможет его использовать и будет ли продукт полезен для небольших организаций, а также для корпоративных клиентов, упомянутых в отчете.

Сопутствующие руководства и викторины

ИИ-агентыОбъяснение моделей искусственного интеллектаЭтика ИИПроверьте свои знания — пройдите бесплатную викторину по искусственному интеллектуНайдите термин ИИ в нашем глоссарии.Следите за трекером регулирования ИИ

Обновления и исправления

Эта каноническая история обновляется при существенных изменениях развивающегося события. Его URL-адрес и первоначальная дата публикации никогда не меняются.

  • В SiliconANGLE добавляют, что Capsule Security выпустила отдельный монитор предварительного выполнения на базе Nemotron для мошеннических действий ИИ-агента. Capsule сообщает о точности 98 % по StepShield, 96,9 % по внутреннему тесту, времени отклика всего 71 миллисекунду и развертывании одного NVIDIA-L40S для своей более крупной модели. Сообщается, что эта возможность уже доступна, но цены, условия доступа, интеграция и независимая проверка неизвестны.
Посмотреть журнал общедоступных исправлений
Нашли это полезным?