Cosa è successo
Anthropic ha pubblicato un rapporto di intelligence sulle minacce che descrive l'uso dannoso di Claude in sette aree di pericolo. La società afferma che gruppi sospettati di sostegno statale, criminali, venditori di spyware, istituzioni di propaganda e individui politicamente motivati hanno utilizzato Claude Haiku, Sonnet e Opus in operazioni che comportavano attacchi informatici, sorveglianza, frode, attività di influenza, armi convenzionali, uso improprio di prodotti biologici e distillazione di modelli. Anthropic afferma di aver interrotto l'attività e di aver utilizzato i risultati per migliorare le garanzie, ma il rapporto è il resoconto dell'azienda e non è stato verificato in modo indipendente qui.
Anthropic afferma che l'attività è avvenuta da dicembre 2025 ad agosto 2026 e ha coinvolto Claude Haiku, Sonnet e Opus. Si afferma che nessun caso di uso improprio ha coinvolto modelli Claude Fable o di classe Mythos, ad eccezione di un caso di distillazione illecita. L'azienda caratterizza gli esempi come insolitamente notevoli piuttosto che rappresentativi di tutti gli abusi.
Il rapporto descrive una sospetta operazione legata allo stato russo che avrebbe utilizzato flussi di lavoro assistiti da Claude per gestire phishing, infrastruttura, persistenza, esfiltrazione di dati e riqualificazione di malware. Anthropic afferma che sono state prese di mira più di 20 organizzazioni, tra cui organizzazioni governative ucraine ed europee, diplomatiche, della difesa e del settore dei droni. Descrive inoltre presunte compromissioni che coinvolgono fornitori Wi-Fi di hotel, account di messaggistica, sistemi di streaming di telecamere e database governativi.
Anthropic descrive separatamente l'attività motivata dal punto di vista finanziario che associa agli affiliati del collettivo ShinyHunters. La società afferma che un operatore ha automatizzato la raccolta e l'analisi di applicazioni e credenziali Android, mentre le relative intrusioni avrebbero esposto identificatori nazionali, dati di carte di pagamento e registri dei passeggeri. Queste sono le affermazioni contenute nel rapporto di Anthropic; la fonte non fornisce una convalida forense indipendente nel testo fornito.
Il rapporto afferma che Anthropic ha interrotto l’attività, rafforzato le garanzie e condiviso informazioni con le autorità e i partner del settore, ove appropriato. Non annuncia un nuovo prodotto Claude, una politica di accesso o una modifica dei prezzi.
Dettagli della fonte: anthropic.com ↗
Perché è importante
L’affermazione centrale del rapporto è che l’intelligenza artificiale sta riducendo le competenze, la manodopera e gli strumenti necessari per operazioni informatiche complesse. Anthropic afferma che gli aggressori hanno utilizzato Claude all'interno di flussi di lavoro multi-agente per ricognizione, phishing, sfruttamento, furto di dati e ripetute modifiche al malware, consentendo ad alcune campagne di operare più velocemente e su più obiettivi. Se confermato in modo indipendente, ciò renderebbe la sofisticatezza dell’aggressore un segnale di attribuzione meno affidabile e aumenterebbe la pressione sui difensori affinché vadano oltre i metodi di rilevamento statici.
Il significato pratico è la combinazione segnalata della capacità del modello con l'orchestrazione. Anthropic afferma che gli esseri umani generalmente selezionavano obiettivi ed esaminavano i dati rubati, mentre i sistemi di intelligenza artificiale gestivano parti di ricognizione, sfruttamento, configurazione e monitoraggio delle infrastrutture. Questa distinzione è importante perché la minaccia non viene presentata come un hacking completamente autonomo, ma come una riduzione del numero di persone qualificate e delle ore necessarie per sostenere le campagne.
Anthropic sostiene che l’intelligenza artificiale può aiutare gli aggressori a modificare ripetutamente gli strumenti dopo che i prodotti di sicurezza li hanno rilevati, riducendo potenzialmente il periodo in cui le firme convenzionali rimangono efficaci. Il rapporto sottolinea quindi una maggiore importanza per controlli a più livelli come la protezione delle credenziali, l’applicazione rapida di patch, il rilevamento basato sul comportamento, la segmentazione della rete e il monitoraggio di automazioni insolite.
Le prove rimangono limitate dalla provenienza. La fonte è una divulgazione della società il cui modello è stato presumibilmente utilizzato e fornisce casi di studio selezionati anziché uno studio sulla prevalenza. Non stabilisce quanta parte del danno segnalato si sarebbe verificata senza Claude, se tutte le affermazioni di attribuzione fossero corrette o con quale frequenza le misure di salvaguardia abbiano impedito tentativi di abuso.
Meccanismo interattivo: come funziona realmente
Esplora la tecnologia alla base di questo sviluppo in modo interattivo.
crm_get_transaction(id='4092').An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?
Cosa guardare dopo
Cerca conferme indipendenti delle intrusioni segnalate, dell’entità del danno effettivo alle vittime e se altri fornitori di IA stanno osservando modelli operativi simili. Il rapporto non stabilisce che ogni operazione descritta abbia avuto successo grazie a Claude, né quantifica il contributo di Claude rispetto alle alternative non basate sull’intelligenza artificiale. Inoltre, non viene annunciato alcun nuovo accesso rivolto agli utenti, modifiche ai prezzi o alla disponibilità.
Rapporti indipendenti di intelligence sulle minacce, divulgazione delle vittime e indagini governative potrebbero confermare o contestare l’attribuzione e le stime di Anthropic dei dati rubati. Particolare attenzione dovrebbe essere rivolta al presunto attacco contro organizzazioni ucraine, catene di approvvigionamento legate ai droni, sistemi diplomatici e database di identità governative.
I team di sicurezza dovrebbero valutare se i loro controlli sono in grado di rilevare ricognizioni automatizzate, abusi di credenziali, rapidi cambiamenti delle infrastrutture e ripetute modifiche di strumenti sospetti. L’avvertimento pratico della fonte è che i difensori potrebbero aver bisogno di misurare il comportamento degli aggressori durante un’intera campagna piuttosto che fare affidamento solo sulle firme malware conosciute.
Ulteriori segnalazioni potrebbero chiarire i casi di abuso biologico e di armi convenzionali a cui fa riferimento la panoramica del rapporto ma non dettagliato nell’estratto fornito. La fonte non lascia inoltre chiaro come Anthropic abbia misurato il miglioramento dell’intelligenza artificiale, quante operazioni siano state interrotte prima dell’impatto sulle vittime e se le misure di salvaguardia descritte siano disponibili per altri sviluppatori.