Tillbaka till Nyheter
SäkerhetAI Understanding genomgång

Capsule Security rapporterar Nemotron-baserad AI-strömbrytare

SiliconANGLE rapporterar att Capsule Security släppte ett Nemotron-baserat system som utvärderar AI-agentåtgärder omedelbart före exekvering och kan tillåta, flagga eller blockera dem.

4 min readRead the linked source
Source-provided image accompanying Capsule Security reports Nemotron-based AI circuit breaker
KällhänvisningKälla inspelad
Förläggare
siliconangle.com
Källlänk
siliconangle.comhttps://siliconangle.com/2026/09/02/capsule-security-fine-tunes-nvidia-nemotron-models-to-stop-rogue-ai-agents/
Källtyp
Länkad källa – status för primär källa har inte fastställts.
Också citerad

Berättelsen senast reviderad

SammanhangFörstå detta på 60 sekunder

Börja här

Nyckeltermer

Minne (agentminne)
Lagrat sammanhang som en AI-agent använder över steg eller sessioner för att förbättra kontinuiteten.
Snabb injektion
Ett attackmönster där skadliga instruktioner infogas i modellinmatningar eller hämtat innehåll.
Referenspunkt
Ett standardiserat test eller datauppsättning som används för att mäta och jämföra modellprestanda.
Testa dig självAI Agents Quiz

Vad har förändrats sedan publiceringen

  1. Först publicerad
  2. SiliconANGLE tillägger att Capsule Security har släppt en separat Nemotron-baserad pre-execution monitor för oseriösa AI-agentåtgärder. Capsule rapporterar 98 % noggrannhet på StepShield, 96,9 % på ett internt riktmärke, svarstider så låga som 71 millisekunder och singel-NVIDIA-L40S-distribution för sin större modell. Möjligheten sägs vara tillgänglig nu, men prissättning, åtkomstvillkor, integrationer och oberoende validering är okända.

Vad hände

SiliconANGLE rapporterar att Capsule Security släppte en "AI-kretsbrytare" byggd av två finjusterade NVIDIA Nemotron-modeller. Systemet utvärderar en agents avsedda åtgärd omedelbart före exekvering och låter kunder tillåta, flagga eller blockera den. Capsule sa att detektorn nådde 98 % noggrannhet på StepShield-riktmärket och returnerade beslut på så lite som 71 millisekunder. Funktionen är enligt uppgift tillgänglig nu, även om åtkomstvillkor och priser inte avslöjades.

SiliconANGLE rapporterar att Capsule Security släppte ett detektionssystem baserat på två NVIDIA Nemotron-modeller som det finjusterat själv. Capsule beskriver produkten som en "AI-strömbrytare": den bedömer en agents avsedda åtgärd omedelbart innan åtgärden utförs, vilket tillåter en kund att tillåta, flagga eller blockera den. Källan säger att kontrollskiktet är avsett för agenter med referenser till känslig data, källkod eller produktionsinfrastruktur.

Enligt SiliconANGLE sa Capsule att dess system uppnådde 98 % noggrannhet på StepShield, ett riktmärke som använder 9 429 kodagentbanor från verkliga incidenter. Capsules mest exakta detektor fick enligt uppgift 96,9 % på ett internt riktmärke, jämfört med 86 % för den starkaste icke namngivna tredjepartsmodellen som testades. Artikeln säger att Capsule inte identifierade den modellen eller gav en uppdelning av poängen.

SiliconANGLE rapporterar att beslut återkom på så lite som 71 millisekunder. Capsule sa att dess större modells minneskrav minskade med nästan hälften utan prestandaförlust, vilket gjorde att den kunde köras på en NVIDIA L40S GPU. Träningsdatan inkluderade enligt uppgift verkliga agentspår och mänskligt granskade motståndsexempel som markerade gränsen mellan auktoriserat och obehörigt beteende.

Källan säger att kapaciteten är tillgänglig nu. Den anger inte prissättning, upphandling, agentplattformar som stöds, geografiska begränsningar eller om utgåvan är allmänt tillgänglig. Inget av prestationsanspråken, kundreferenser eller den rapporterade tillgängligheten bekräftades oberoende för denna utvärdering.

Källinformation: siliconangle.com ↗

Varför det spelar roll

Det rapporterade systemet riktar sig mot en praktisk svaghet i agentsäkerhet: behörigheter kan begränsa vad en agent får åtkomst till, men de avgör inte nödvändigtvis om en specifik åtgärd är lämplig för uppgiften. Ett beslutslager före utförande kan ge säkerhetsteam ytterligare en kontrollpunkt innan ett fel blir en incident. Prestandasiffrorna, kundanspråken och jämförelserna förblir SiliconANGLEs redogörelse för Capsules uttalanden och bekräftades inte oberoende här.

Det rapporterade tillvägagångssättet fokuserar på om en åtgärd passar den uppgift som en agent tilldelats, snarare än att bara kontrollera om agenten tekniskt sett har tillstånd att utföra den. Den skillnaden är viktig eftersom organisationer ger agenter tillgång till referenser, kodlager och produktionssystem. En kontroll som tillämpas före verkställighet kan begränsa tiden mellan ett osäkert beslut och en möjlig konsekvens, även om källan inte ger några oberoende bevis för att den förhindrar verkliga incidenter.

Det rapporterade anspråket på latens och distribution av en enda GPU kan göra övervakning på stegnivå mer praktisk för vissa organisationer än en stor generativ modell som används som en separat granskare. Däremot ger artikeln inte falsk-positiva eller falsk-negativa frekvenser, exempel på blockerade åtgärder, testmetod utöver det citerade riktmärket eller oberoende replikering. Jämförelsen med icke namngivna tredjeparts- och frontiermodeller kan därför inte fastställa överlägsenhet.

SiliconANGLE säger att kunder inkluderar finansiella institutioner och teknikföretag och citerar H&R Blocks säkerhetschef som stödjer kontroller av detta slag. Dessa referenser indikerar påstått företagsintresse, inte bevis på bred spridning eller effektivitet. Källan anger inte om produkten är självbetjäning, endast företag eller säljs som en separat betaltjänst.

Interactive Mechanism

Interaktiv mekanism: hur det faktiskt fungerar

Utforska den underliggande tekniken bakom denna utveckling interaktivt.

Agent Lifecycle Stage:
1
User Intent & Planning: "Audit customer refund request #4092 and settle payment."
2
Tool Calling: Emits structured JSON call crm_get_transaction(id='4092').
3
Guardrail & Verification:🛡️ Paused: High-value action requires human operator sign-off.
4
Final Settlement: Refund recorded, email receipt dispatched, and audit log stored.
Core takeaway: An AI agent is not just a language model—it is a closed loop of planning, tool invocation, and environment feedback. Production systems require self-healing retries and strict human approval guardrails.
Interaktiv konceptkontroll+10 Points
AI Agents Quiz

An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?

Vad du ska titta på härnäst

Se efter oberoende testning av Capsules StepShield-resultat, detaljer om falska positiva och falska negativa och bevis från produktionsinstallationer. Det är också oklart hur systemet integreras med olika agentramverk, vilka åtgärder det kan inspektera, om mänskligt godkännande krävs för blockerade eller flaggade åtgärder och om den rapporterade 71 millisekunders fördröjningen håller under företagets arbetsbelastning. SiliconANGLE rapporterade inte prissättning eller en offentlig självbetjäningsväg.

Oberoende forskare och kunder bör testa om den rapporterade noggrannheten överförs från StepShield och Capsules interna till olika agentramverk, verktyg, uppgifter och attackmetoder. Enbart noggrannhet på stegnivå visar kanske inte hur ofta en bildskärm missar en skadlig åtgärd eller avbryter legitimt arbete.

Ytterligare rapportering bör förtydliga hur Capsule hanterar tvetydiga åtgärder, överlappande verktygsanrop, snabb injektion, komprometterade autentiseringsuppgifter och agenter vars beteende förändras efter övervakning. Källan förklarar inte vilka bevis detektorn använder för att avgöra om en åtgärd är auktoriserad eller hur kunder konfigurerar policyer.

Möjligheten beskrivs som tillgänglig nu, men SiliconANGLE tillhandahåller inget pris, registreringsprocess, tjänstenivåvillkor eller lista över integrationer som stöds. Dessa detaljer kommer att avgöra vem som faktiskt kan använda den och om produkten är praktisk för mindre organisationer såväl som de företagskunder som nämns i rapporten.

Relaterade guider och frågesporter

AI-agenterAI-modeller förklarasAI-etikTesta vad du vet – prova ett gratis AI-quizSlå upp en AI-term i vår ordlistaFölj AI-regleringen

Uppdateringar och korrigeringar

Denna kanoniska berättelse uppdateras på plats när händelsen som utvecklas väsentligt förändras. Dess URL och ursprungliga publiceringsdatum ändras aldrig.

  • SiliconANGLE tillägger att Capsule Security har släppt en separat Nemotron-baserad pre-execution monitor för oseriösa AI-agentåtgärder. Capsule rapporterar 98 % noggrannhet på StepShield, 96,9 % på ett internt riktmärke, svarstider så låga som 71 millisekunder och singel-NVIDIA-L40S-distribution för sin större modell. Möjligheten sägs vara tillgänglig nu, men prissättning, åtkomstvillkor, integrationer och oberoende validering är okända.
Se den offentliga korrigeringsloggen
Hittade du detta användbart?