Test di sicurezza di AI e LLM

Test avversariali di applicazioni LLM, agenti e integrazioni MCP: prompt injection, fuga di dati, abuso degli strumenti e uscita dal compito previsto.

AI, Web3 e crittografia

Un’applicazione basata su un modello linguistico riceve istruzioni da tutto ciò che legge: l’utente, un documento recuperato, il contenuto di una pagina web, l’output di uno strumento. Non sa distinguere in modo affidabile un’istruzione dai dati. Quando il modello può chiamare strumenti, inviare messaggi o scrivere in un database, una frase nascosta in un documento diventa un’azione nei tuoi sistemi.

Testiamo l’intera applicazione e non solo il modello: i prompt, la pipeline di recupero, gli strumenti e i loro permessi, gli agenti e i protocolli che li collegano. La domanda è che cosa un attaccante può far fare, leggere o rivelare al sistema, e se i controlli attorno al modello reggono quando il modello stesso non regge.

01Perimetro

Che cosa testiamo

  • Prompt injection diretta e indiretta attraverso ogni input che il modello legge
  • Rivelazione di prompt di sistema, segreti e dati di altri utenti o tenant
  • Retrieval-augmented generation: avvelenamento, controllo degli accessi all’archivio dei documenti
  • Strumenti e function calling: permessi eccessivi, parametri non sicuri, confused deputy
  • Agenti: dirottamento degli obiettivi, avvelenamento della memoria, autonomia non sicura, fiducia tra agenti
  • Server Model Context Protocol: autenticazione, avvelenamento degli strumenti, esecuzione di comandi
  • Gestione dell’output: injection in browser, shell, query e sistemi a valle
  • Guardrail e filtri: aggiramento tramite codifica, lingua, gioco di ruolo e attacchi in più turni
  • Consumo di risorse e abuso dei costi

02Approccio

Come si svolge il lavoro

  1. Revisione dell’architettura

    Mappiamo che cosa legge il modello, che cosa può chiamare e con i permessi di chi. La maggior parte dei rilievi critici è visibile già in questa fase, sotto forma di un confine di fiducia che manca.

  2. Test avversariali

    Gli input vengono costruiti a mano e generati su larga scala contro ogni canale che porta al modello. Un attacco riuscito viene ridotto all’input minimo che lo riproduce.

  3. Abuso di strumenti e agenti

    Usiamo istruzioni iniettate per pilotare strumenti e agenti: leggere ciò che dovrebbe restare illeggibile, agire a nome di un altro utente, passare da un sistema al successivo.

  4. Validazione dei controlli

    Filtri, guardrail e passaggi di approvazione vengono testati singolarmente. Il report indica quale controllo ha fermato quale attacco e quale non ne ha fermato nessuno.

Metodologia

03

Che cosa ricevi

  • Input di attacco con il tasso di riproduzione, perché il comportamento del modello è probabilistico
  • Diagramma dei confini di fiducia con i controlli mancanti e quelli deboli
  • Un set di regressione di input avversariali per la tua pipeline di test
  • Sintesi per la direzione
  • Report tecnico: ogni rilievo con prove, vettore CVSS 4.0, classe CWE e correzione
  • Chiamata di debriefing con il tuo team tecnico
  • Un retest di ogni rilievo entro 60 giorni dalla consegna del report
  • Lettera di attestazione dopo il retest

04

Che cosa ci serve da te

  • Accesso all’applicazione come utenti di ogni ruolo
  • Una descrizione dell’architettura: modelli, prompt, fonti di recupero, strumenti, agenti
  • Un ambiente di test in cui gli strumenti possono essere attivati senza effetti nel mondo reale
  • La politica d’uso del tuo fornitore del modello, se limita i test avversariali

05Standard

Gli standard alla base del metodo

06Domande

Domande su questo servizio

Testate il modello o l’applicazione?

L’applicazione. La sicurezza del modello di base è responsabilità del suo fornitore. Ciò che controlli tu, e ciò che gli attaccanti sfruttano, è il modo in cui il modello è collegato ai tuoi dati e ai tuoi strumenti.

La prompt injection non si può correggere del tutto. A che cosa serve trovarla?

Serve a sapere che cosa ne consegue. Se l’injection porta a una risposta sbagliata, è un problema di qualità. Se porta a un’email inviata a nome dell’utente, è una vulnerabilità nei permessi attorno al modello, e si può correggere.

Usate i nostri dati per addestrare servizi di AI esterni o nei prompt che inviate loro?

No. I dati dei clienti, i prompt e i rilievi non vengono inviati a servizi di AI pubblici e non vengono usati per l’addestramento. Gli strumenti basati su modelli linguistici girano in ambienti che controlliamo noi.

Questo copre i requisiti dell’AI Act dell’UE?

I test avversariali sono una delle misure a cui il regolamento fa riferimento per determinati sistemi e modelli. Il report documenta metodo, perimetro e risultati in una forma adatta a essere usata come prova. Se e come il regolamento si applica al tuo sistema è una questione legale a cui non rispondiamo.

08Richiesta

Dicci che cosa va testato

  • Verifica del sito gratuita
  • Risposta entro 1 giorno lavorativo
  • NDA prima di qualsiasi dettaglio tecnico
  • Prezzo fisso per gli incarichi a pagamento
  • Senza impegno

Richiedi una valutazione

Descrivi i sistemi e l’obiettivo. Un responsabile risponde entro 1 giorno lavorativo con domande di chiarimento e il passo successivo.

A chi rispondere

Rispondiamo a questo indirizzo, se non scegli un altro canale.

Un imprenditore individuale scrive il proprio nome.

Canale preferito
Che cosa valutare
Servizi di interesse

Scegli tutte le opzioni pertinenti.

Verifica gratuita

Verifichiamo gratuitamente il tuo sito

Se non troviamo problemi, ricevi gratuitamente anche il report. Paghi il report solo se troviamo problemi, e il suo prezzo dipende dal loro numero e dalla loro gravità.

Condizioni della verifica gratuita della sicurezza del sito

Sicurezza delle applicazioni

Infrastruttura e cloud

Simulazione di attacco

AI, Web3 e crittografia

Programmi e verifiche

Sicurezza delle applicazioni

Verifica gratuita della sicurezza del sito

Guardiamo il tuo sito dall’esterno, come fa un attaccante, e verifichiamo se può essere violato: impostazioni deboli, software non aggiornato, file esposti, moduli non sicuri. La verifica è gratuita.

Sicurezza delle applicazioni

Penetration test di applicazioni web

Proviamo a violare la tua applicazione web come farebbe un vero attaccante: accedere agli account di altre persone, leggere i dati di altri clienti, modificare prezzi o ordini. Scopri che cosa è possibile prima dei criminali.

Sicurezza delle applicazioni

Test di sicurezza delle API

Un’API è il canale attraverso cui la tua app, il tuo sito e i tuoi partner scambiano dati con i tuoi server. Verifichiamo che nessuno possa usarla per leggere o modificare dati non suoi.

Sicurezza delle applicazioni

Penetration test di applicazioni mobili

Esaminiamo la tua app iOS o Android e i server che la supportano: che cosa l’app conserva sul telefono, che cosa se ne può estrarre e se le sue richieste possono essere manomesse.

Sicurezza delle applicazioni

Revisione di sicurezza del codice

I nostri specialisti leggono il codice sorgente del tuo prodotto e trovano gli errori che portano a una violazione, compresi quelli che non si vedono dall’esterno.

Infrastruttura e cloud

Valutazione della sicurezza di cloud e Kubernetes

Verifichiamo come è configurato il tuo cloud (AWS, Azure, Google Cloud, Kubernetes): chi ha accesso a che cosa, quali dati sono aperti a internet e fin dove arriva un attaccante dopo il primo errore.

Infrastruttura e cloud

Penetration test dell’infrastruttura

Testiamo i tuoi server e la rete del tuo ufficio dall’esterno e dall’interno: se un attaccante può entrare e, una volta dentro, raggiungere il sistema di contabilità, la posta o i backup.

Infrastruttura e cloud

Valutazione della superficie di attacco esterna

Troviamo tutto ciò che la tua azienda espone su internet, compreso ciò che è stato dimenticato: vecchi siti, server di test, password trapelate. Poi mostriamo che cosa di tutto questo può essere attaccato.

Infrastruttura e cloud

Sicurezza di CI/CD e supply chain

Verifichiamo il percorso che il tuo codice compie dallo sviluppatore al cliente: server di build, librerie di terzi, chiavi di accesso. Chi controlla questo percorso controlla il tuo prodotto.

Simulazione di attacco

Operazioni di Red Team

Un’esercitazione su scala reale. Il nostro team interpreta un vero attaccante con un obiettivo, ad esempio arrivare ai dati dei clienti, e tu vedi se la tua difesa se ne accorge e lo ferma.

Simulazione di attacco

Esercitazioni di Purple Team

I nostri attaccanti e i tuoi difensori lavorano fianco a fianco: noi mostriamo una tecnica di attacco, il tuo team controlla se la vede, e le lacune nel monitoraggio vengono chiuse sul momento.

Simulazione di attacco

Test di ingegneria sociale

Testiamo le persone, non le macchine: le email di phishing, le telefonate e i messaggi che gli attaccanti usano per ottenere le password. Scopri quanti dipendenti verrebbero ingannati e su che cosa formarli.

AI, Web3 e crittografia

Test di sicurezza di AI e LLM

Se il tuo prodotto ha un chatbot o un altro modello di AI, verifichiamo se lo si può convincere a rivelare dati riservati, a infrangere le proprie regole o ad agire per conto di qualcun altro.

AI, Web3 e crittografia

Audit di smart contract

Prima che uno smart contract custodisca denaro, cerchiamo nel suo codice gli errori che permetterebbero a qualcuno di prelevare o bloccare i fondi. Una volta pubblicato il contratto, questi errori non si possono più correggere.

AI, Web3 e crittografia

Revisione della crittografia

Verifichiamo come il tuo prodotto cifra i dati e protegge le chiavi: se sono stati scelti gli algoritmi giusti e se vengono applicati correttamente. Un errore qui rende inutile la cifratura.

Programmi e verifiche

Gestione di programmi di bug bounty

Un bug bounty è un programma in cui ricercatori indipendenti cercano vulnerabilità nel tuo prodotto e vengono pagati per ognuna che trovano. Avviamo e gestiamo un programma di questo tipo per te.

Programmi e verifiche

Programma di divulgazione delle vulnerabilità (VDP)

Una pagina pubblica e una procedura che spiegano ai ricercatori come segnalarti una vulnerabilità in modo sicuro. Senza di esse le segnalazioni vanno perse o arrivano sotto forma di minacce. Impostiamo il processo e gestiamo le segnalazioni in arrivo.

Programmi e verifiche

Penetration test continuo

Invece di un test all’anno, testiamo ogni modifica significativa del tuo prodotto durante tutto l’anno, così una nuova vulnerabilità non aspetta mesi per essere trovata.

Programmi e verifiche

Penetration test per la conformità

Un penetration test organizzato in modo che un auditor, un’autorità di vigilanza o un grande cliente ne accetti il report: PCI DSS, DORA, NIS2, ISO/IEC 27001, SOC 2.

Servizi di interesse

Non so ancora

Scegli questa opzione se non sai quale servizio ti serve. Descrivi l’esigenza con parole tue e uno specialista suggerirà il servizio nella risposta.

Dominio o URL del sito o del sistema principale da testare, ad esempio app.example.com.

Che cosa va testato, perché ora, eventuali scadenze o requisiti di conformità. Niente password, chiavi o dettagli di vulnerabilità.

Conferme

Non inviare credenziali, chiavi o dettagli di una vulnerabilità tramite questo modulo. Un canale sicuro viene concordato dopo la prima risposta.

Controllo antiabuso automatico