Aggiornato quotidianamente1821 storie verificate

Notizie sull'AI.Senza il rumore.

Copertura controllata dall'IA su lanci di prodotti, cambiamenti di politiche, ricerche sulla sicurezza e mosse del settore, spiegata in un linguaggio semplice da un team educativo non profit.

Fonti verificate

Ogni articolo è collegato alle prove più forti disponibili: fonti originali quando disponibili, altrimenti segnalazioni chiaramente attribuite.

Inglese semplice

Cosa è successo, perché è importante e cosa guardare, senza usare termini tecnici.

Nessun riempitivo

Quando il segnale è debole, non pubblichiamo nulla invece di riempire il feed.

Archivio notizie

Archivio notizie dell'AI — Pagina 151

Storie di intelligenza artificiale controllate alla fonte, prima le più recenti, per le persone che hanno bisogno di comprendere l'intelligenza artificiale senza inseguire l'hype.

Source-provided image accompanying Paper Proposes Grading AI Security Agents Without Labels by Measuring Convergence to a Stronger ModelStoria principale
Innovazione7 min leggere
Innovazione7 min leggere

Paper Proposes Grading AI Security Agents Without Labels by Measuring Convergence to a Stronger Model

A new arXiv preprint argues security teams can judge whether a memory- or retrieval-equipped AI agent is learning by measuring how far it closes the gap to a stronger "teacher" model, rather than on labeled benchmarks that are often scarce or stale. Judging by a similarly powered model gave no usable signal.

Leggi la storia Fonte verificata: arxiv.org
9 storie
  1. Sicurezza7 min leggere

    I difetti di CoreBreak consentono l'esecuzione degli strumenti dell'agente senza che il modello venga mai chiamato

    Una nota di ricerca della Cloud Security Alliance descrive CoreBreak, un modello di difetti in Amazon Bedrock AgentCore, nell'Agent Development Kit di Google e nei pacchetti di cablaggio AI SDK di Vercel che consentivano l'esecuzione degli strumenti senza una svolta del modello, lasciando i guardrail a livello di modello senza nulla da ispezionare.

    labs.cloudsecurityalliance.org
  2. Sicurezza6 min leggere

    Il documento SEAG propone l'aliasing delle entità sensibili prima che le query RAG raggiungano LLM esterni

    Una prestampa pubblicata su arXiv descrive un framework che scambia nomi sensibili nelle query e documenti recuperati con alias prima di inviarli a un modello di terze parti. Gli autori riportano un'accuratezza superiore all'80% sulla metrica utente end-to-end e tassi di occultamento totale compresi tra il 74,91% e il 77,83% su tre piccoli modelli.

    arxiv.org

Un briefing utile ogni settimana

Tieni il passo con l'IA senza vivere nel feed.

Ricevi le notizie verificate sull'IA della settimana, dati originali, strumenti utili, scelte per l'apprendimento e nuovi lavori in IA.

Send me
One email a week. Switch any time.

Raggiungi le persone che stanno imparando l'intelligenza artificiale

Assumere un professionista dell'IA o lanciare un prodotto AI utile? Mettilo davanti a chi è venuto qui per imparare e agire.

Pubblica un lavoro AI Invia uno strumento AI