Torna alle notizie
InnovazioneAI Understanding briefing

La Damo Academy di Alibaba rilascia un modello di imaging medico open source

La Damo Academy di Alibaba ha rilasciato Damo Radar, un modello di linguaggio visivo open source in grado di identificare quasi 150 malattie addominali dalle scansioni TC.

4 min readRead the linked source
Source-page capture accompanying Alibaba's Damo Academy releases open-source medical imaging model
Riferimento alla fonteFonte registrata
Editore
newsbytesapp.com
Collegamento alla fonte
newsbytesapp.comhttps://www.newsbytesapp.com/news/science/alibaba-s-ai-model-can-detect-nearly-150-abdominal-diseases/story
Tipo di fonte
Fonte collegata: lo stato di fonte primaria non è stato stabilito.
ContestoComprendilo in 60 secondi

Inizia qui

Termini chiave

Modello Visione-Linguaggio (VLM)
Un modello multimodale che elabora congiuntamente informazioni visive e testuali.
Set di dati
Una raccolta di esempi strutturati o non strutturati utilizzati per la formazione, la convalida o il test.
Mettiti alla provaQuiz sulla spiegazione dei modelli di intelligenza artificiale

Cosa è successo

La divisione di ricerca di Alibaba, Damo Academy, ha rilasciato un modello di linguaggio visivo open source chiamato Damo Radar, progettato per analizzare le scansioni TC con contrasto. Il modello è in grado di identificare 146 risultati clinici distinti in 18 organi addominali, inclusi vari tumori maligni. Secondo il rapporto di NewsBytes, il modello è stato addestrato su un set di dati comprendente sia scansioni TC che rapporti clinici per raggiungere le sue capacità diagnostiche.

La Damo Academy di Alibaba ha rilasciato Damo Radar, un modello di linguaggio visivo open source appositamente progettato per l'imaging medico. Il sistema è progettato per elaborare scansioni TC con contrasto per identificare un'ampia gamma di condizioni addominali.

Il modello copre 18 organi addominali ed è in grado di rilevare 146 diversi risultati clinici, inclusi tumori maligni. Il gruppo di ricerca descrive il sistema come un modello di imaging medico "generalista", destinato a fornire analisi a livello di esperti.

La formazione per Damo Radar ha coinvolto un set di dati su larga scala di scansioni TC abbinate ai corrispondenti report clinici. Il modello ha raggiunto un’area media sotto la curva (AUC) di 0,913 sulla base di test condotti su quasi 40.000 esami nel mondo reale.

Dettagli della fonte: newsbytesapp.com ↗

Perché è importante

L'introduzione di Damo Radar rappresenta un passo significativo nell'applicazione dei modelli visione-linguaggio alla diagnostica medica. Raggiungendo un'area sotto la curva (AUC) di 0,913 in quasi 40.000 esami reali, il modello dimostra prestazioni di alto livello nell'identificazione di patologie addominali complesse. Questo sviluppo è notevole per il suo potenziale di assistere i radiologi automatizzando lo screening delle scansioni TC, riducendo potenzialmente i tempi diagnostici e migliorando il rilevamento di anomalie che altrimenti potrebbero passare inosservate. La natura open source del modello consente una più ampia ricerca e integrazione nei sistemi sanitari, sebbene l’implementazione pratica in contesti clinici rimanga soggetta all’approvazione normativa e a ulteriore convalida. Il gruppo di ricerca suggerisce che la metodologia di formazione sottostante potrebbe eventualmente essere estesa ad altre forme di imaging medico, ampliando potenzialmente l’ambito della diagnostica assistita dall’intelligenza artificiale oltre la salute addominale.

Il rilascio di Damo Radar evidenzia la crescente capacità dei modelli di linguaggio visivo di gestire compiti medici specializzati. Automatizzando l'analisi di scansioni TC complesse, il modello mira a supportare gli operatori sanitari nell'identificazione delle malattie in modo più efficiente.

La disponibilità open source del modello è un fattore significativo, poiché consente a ricercatori e sviluppatori di basarsi sull'architettura esistente. Ciò potrebbe accelerare lo sviluppo di strumenti simili per altre modalità di imaging medico.

L’AUC riportata di 0,913 indica un elevato livello di accuratezza diagnostica, che è fondamentale per l’adozione clinica. Tuttavia, l’impatto pratico dipenderà dall’efficacia con cui il modello potrà essere integrato nei flussi di lavoro clinici esistenti e dalle sue prestazioni in ambienti reali e non controllati.

Interactive Mechanism

Meccanismo interattivo: come funziona realmente

Esplora la tecnologia alla base di questo sviluppo in modo interattivo.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Verifica concettuale interattiva+10 Points
AI Models Explained Quiz

Which component of an AI application is the machine-learning model itself?

Cosa guardare dopo

L'obiettivo principale degli osservatori sarà la transizione del modello dalla ricerca all'applicazione clinica. Le principali incognite includono i percorsi normativi specifici richiesti per la sua implementazione in varie giurisdizioni sanitarie e la disponibilità del modello per l’integrazione da parte di sviluppatori di software medico di terze parti. Inoltre, sebbene l’AUC riportata di 0,913 sia elevata, sarà necessaria una validazione clinica indipendente in diverse popolazioni di pazienti per confermarne l’affidabilità in diversi ambienti ospedalieri e apparecchiature di imaging. Gli aggiornamenti futuri potrebbero chiarire se il modello sarà integrato nelle piattaforme diagnostiche esistenti o se richiederà un’infrastruttura autonoma.

Controlla gli annunci riguardanti i termini di licenza specifici della versione open source e l'eventuale documentazione associata per gli sviluppatori.

Monitorare studi indipendenti o pubblicazioni sottoposte a revisione paritaria che convalidano le prestazioni del modello al di fuori dei set di dati di formazione e test iniziali forniti da Damo Academy.

Osserva come le istituzioni sanitarie o le aziende di tecnologia medica scelgono di implementare o adattare questo modello per l'uso clinico, in particolare per quanto riguarda i protocolli di sicurezza e la supervisione diagnostica.

Guide e quiz correlati

Spiegazione dei modelli di intelligenza artificialeFuturo dell'IAFormazione sull'intelligenza artificialeMetti alla prova ciò che sai: prova un quiz gratuito sull'intelligenza artificialeCerca un termine AI nel nostro glossarioSegui il tracker del rilascio del modello AI
Lo hai trovato utile?