OSS Scanner, scansioni gratuite con Claude per la sicurezza dell’open source

Oltre 29.000 potenziali vulnerabilità individuate in sei mesi, circa 6.000 esaminate manualmente: nella ricerca di Anthropic sul software open source, la verifica umana fatica a tenere il passo con i risultati dei modelli. Da questa esperienza nasce OSS Scanner, che offre ai progetti ammessi scansioni approfondite, gratuite e periodiche con i modelli più avanzati dell’azienda, tra cui Claude Mythos. Il servizio è ad adesione volontaria e consegna ai manutentori i report generati dall’IA senza revisione o selezione umana preventiva, insieme agli elementi per riprodurre i difetti e alle possibili correzioni.

Il servizio nasce dall’esperienza di Project Glasswing, l’iniziativa dedicata alla ricerca e alla correzione delle vulnerabilità nel software critico. L’adesione risponde a una necessità operativa precisa: alcuni gruppi di manutenzione hanno le risorse per verificare direttamente un volume elevato di segnalazioni e preferiscono ricevere subito anche quelle ancora prive di validazione umana.

Dalla scoperta dei difetti alla capacità di correggerli

Negli ultimi sei mesi Anthropic ha individuato oltre 29.000 potenziali vulnerabilità, riuscendo a sottoporne circa 6.000 a revisione e valutazione manuale. La capacità delle persone di controllare i risultati costituisce quindi un collo di bottiglia. Su richiesta dei manutentori, l’azienda ha già consegnato quasi 5.000 report non verificati, accompagnati dalle proposte di patch disponibili.

Il miglioramento dei modelli rende questa scelta più praticabile. Anthropic indica che sul benchmark accademico CyberGym, dedicato alla ricerca delle vulnerabilità, la percentuale di difetti individuati dagli LLM è passata da meno del 20% all’inizio del 2025 a oltre l’85% nel 2026. Parallelamente è aumentata la qualità delle segnalazioni ricevute dai progetti open source. La rapidità conta anche perché gli exploit, cioè i metodi con cui sfruttare una vulnerabilità, possono ormai essere sviluppati nell’arco di minuti.

Per i progetti che hanno bisogno di segnalazioni già controllate, soprattutto quando mancano risorse per esaminarle autonomamente, continuerà il processo di divulgazione coordinata delle vulnerabilità, o CVD: Anthropic verifica i difetti con esperti umani e li comunica ai responsabili del software secondo le proprie procedure.

Che cosa contengono i report

L’ispirazione viene da OSS-Fuzz di Google, che cerca vulnerabilità nei progetti open source attraverso il fuzzing, una tecnica basata sull’esecuzione di test con input variati per provocare comportamenti anomali. OSS Scanner applica invece i modelli linguistici all’analisi del codice e utilizza diversi sistemi di esecuzione degli agenti, comprese configurazioni sperimentali che richiedono molti token, per cercare difetti più profondi. Anthropic sostiene integralmente i costi.

Ogni report comprende una riproduzione autonoma del problema, una spiegazione della vulnerabilità e, quando disponibile, una proposta di correzione. Dove possibile, viene anche ricostruito il momento in cui il difetto è stato introdotto attraverso la bisezione della cronologia del codice, che restringe progressivamente la ricerca tra le revisioni del progetto.

La pipeline comprende agenti incaricati di ricontrollare i bug, proporre patch e analizzare le cause. I manutentori ricevono un insieme di report via email dopo la prima scansione; le analisi successive cercano sia nuove vulnerabilità introdotte nel frattempo sia problemi sfuggiti ai controlli precedenti. La frequenza dipende dal numero di progetti in lavorazione, dalla loro diffusione e da altri fattori operativi.

Nelle settimane di sperimentazione con decine di progetti, il sistema ha prodotto centinaia di segnalazioni. Tra queste figurano vulnerabilità che Anthropic è riuscita a concatenare fino a ottenere l’esecuzione remota di codice senza autenticazione, una condizione in cui un attaccante può far eseguire istruzioni al sistema senza disporre di credenziali.

I risultati delle verifiche e il riscontro dei manutentori

Per controllare una prima versione del servizio, gli esperti di penetration testing che collaborano al processo CVD hanno esaminato 97 vulnerabilità di gravità alta o critica in 48 progetti. Di queste, 85, pari all’88%, hanno soddisfatto i criteri del processo di divulgazione coordinata. Altre 11 erano reali, ma duplicavano problemi già noti o altre segnalazioni della stessa scansione; una sola era un falso positivo. L’88% misura quindi l’idoneità al processo CVD del campione esaminato, mentre i duplicati restano difetti effettivi.

Una quota insolitamente elevata delle segnalazioni ha individuato difetti in PostgreSQL. Noah Misch, del progetto, sottolinea che diversi report contenevano correzioni utilizzabili “quasi senza modifiche” e che l’accesso rapido ha consentito di risolvere problemi recenti prima che arrivassero in una versione generalmente disponibile.

Il confronto con le prime segnalazioni generate dall’IA, circa 18 mesi prima di questo annuncio e prima di Project Glasswing, è netto per Anton Arapov, di OpenSSL Corporation, che ne ricorda la qualità pessima. I report ricevuti da Anthropic, compresi gli output grezzi dei modelli, sono risultati “altrettanto validi e talvolta migliori” di quelli ricevuti dalle persone. Arapov evidenzia soprattutto il valore di un exploit concreto allegato alla segnalazione, che permette agli ingegneri di verificare subito il problema.

Dei 74 report ricevuti da wolfSSL, “tutti tranne due erano validi”, afferma Todd Ouska: 72 segnalazioni valide, cinque delle quali hanno ottenuto un identificativo CVE, il riferimento pubblico standard usato per catalogare le vulnerabilità. Le patch allegate si sono inserite nel processo esistente di verifica e correzione. Eddie Kohler, di HotCRP, descrive le segnalazioni come “approfondite e chiare”, evidenziando la comprensione del complesso sistema di permessi del software e la corretta assegnazione delle priorità ai bug.

Dopo l’invio di molti dei risultati ai manutentori, Anthropic ha ricevuto raramente contestazioni sulla validità delle segnalazioni di gravità alta o critica, in linea con la propria esperienza precedente nell’open source. La consegna senza controllo umano comporta comunque limiti concreti: i report possono contenere errori o segnalazioni non valide. Alcuni manutentori hanno riscontrato valutazioni della gravità eccessive o interpretazioni inesatte del modello di minaccia del progetto, cioè delle condizioni e degli attacchi da considerare rilevanti. Anthropic continuerà a migliorare il sistema sulla base dei riscontri ricevuti e dei progressi dei modelli.

Chi può aderire e come preparare il progetto

I criteri di ammissione sono simili a quelli di OSS-Fuzz: vengono valutati caso per caso progetti consolidati con un impatto critico sull’infrastruttura e sulla sicurezza degli utenti. Contano, tra gli altri aspetti, l’esposizione agli attacchi remoti, come nel caso di librerie che elaborano input non attendibili, e il numero di utenti o di altri progetti che dipendono dal software. Il servizio è pensato per gruppi già in grado di gestire le segnalazioni verificate di gravità alta o critica.

I manutentori principali possono candidarsi aprendo una pull request nel repository GitHub di OSS Scanner, seguendo il modello fornito. Anthropic verifica manualmente che chi richiede l’adesione sia effettivamente un manutentore principale e, quando necessario, contatta il progetto attraverso altri canali.

La configurazione richiede l’indirizzo del repository Git, che può essere ospitato anche fuori da GitHub, un contatto email principale e un Dockerfile che predisponga l’ambiente, installi le dipendenze e compili il software. La costruzione del container avviene con accesso alla rete, mentre l’analisi degli agenti si svolge senza connessione a Internet, in ambienti isolati e rafforzati. Prima della candidatura è consigliato controllare la configurazione con lo strumento di validazione fornito e verificare localmente sia la costruzione del container sia l’esecuzione dei test; Anthropic segnala via email eventuali errori di compilazione sulla propria infrastruttura.

La configurazione di OSS Scanner consente anche di aggiungere contatti in copia e un file con il modello di minaccia, il perimetro dei controlli, i criteri di gravità, le preferenze sulle patch e sulla deduplicazione dei report. È possibile richiedere email cifrate attraverso una chiave pubblica GPG; in quel caso le comunicazioni vengono inviate soltanto al contatto principale, senza destinatari in copia. L’adesione comporta l’accettazione delle condizioni del servizio.

Divulgazione, sospensione e supporto alle correzioni

Ai risultati non validati non si applica un termine automatico di divulgazione di 90 giorni. Se Anthropic verifica successivamente una segnalazione attraverso il processo CVD, può applicare la propria politica facendo decorrere i 90 giorni dalla notifica della validazione umana. Un’eventuale futura introduzione di scadenze per alcune vulnerabilità gravi verrà comunicata con un preavviso adeguato e con la possibilità di rinunciare al servizio.

I manutentori possono sospendere i report impostando disabled: true nella configurazione oppure uscire dal programma attraverso una pull request che rimuova la directory del progetto. In entrambi i casi cessa l’invio automatico delle segnalazioni non verificate e rimane il normale percorso CVD. I riscontri possono essere inviati rispondendo alle email; un’eventuale attribuzione della scoperta a OSS Scanner, con l’identificativo del report, è facoltativa e aiuta Anthropic a seguire le correzioni effettivamente adottate. I report sono conservati in un progetto cloud isolato, accessibile soltanto al personale di sicurezza che ne ha bisogno per sviluppare il sistema e gestire il programma.

Per le aziende, Claude Security offre analisi e correzione del codice integrate nel ciclo di sviluppo. Ai manutentori open source sono invece disponibili anche Claude for OSS, con abbonamenti gratuiti Claude Max 20x per correggere vulnerabilità e migliorare i progetti, e il Cyber Verification Program, che mette a disposizione dei professionisti della sicurezza qualificati capacità cyber avanzate e classificatori di blocco meno restrittivi per le attività ammesse.

Se questo articolo ti è piaciuto e vuoi rimanere sempre informato sulle novità tecnologiche

LASCIA UN COMMENTO

Inserisci il tuo commento
Inserisci il tuo nome