Säkerhetstest av AI och LLM

Adversariell testning av LLM-applikationer, agenter och MCP-integrationer: prompt injection, dataläckage, missbruk av verktyg och utbrytning från den avsedda uppgiften.

AI, Web3 och kryptografi

En applikation som bygger på en språkmodell tar emot instruktioner från allt den läser: användaren, ett hämtat dokument, innehållet på en webbsida, utdata från ett verktyg. Den kan inte på ett tillförlitligt sätt skilja en instruktion från data. När modellen kan anropa verktyg, skicka meddelanden eller skriva till en databas blir en mening som är gömd i ett dokument en handling i dina system.

Vi testar hela applikationen och inte bara modellen: prompterna, pipelinen för hämtning, verktygen och deras behörigheter, agenterna och de protokoll som kopplar samman dem. Frågan är vad en angripare kan få systemet att göra, läsa eller avslöja, och om skydden runt modellen håller när modellen själv inte gör det.

01Omfattning

Vad vi testar

  • Direkt och indirekt prompt injection via all indata som modellen läser
  • Röjande av systemprompter, hemligheter och andra användares eller tenanters data
  • Retrieval-augmented generation: förgiftning, åtkomstkontroll i dokumentlagret
  • Verktyg och funktionsanrop: överdrivna behörigheter, osäkra parametrar, confused deputy
  • Agenter: kapning av mål, förgiftning av minnet, osäker autonomi, förtroende mellan agenter
  • Servrar för Model Context Protocol: autentisering, förgiftning av verktyg, kommandokörning
  • Hantering av utdata: injektion i webbläsare, skal, frågor och efterföljande system
  • Skyddsräcken och filter: kringgående genom kodning, språk, rollspel och attacker över flera meddelanden
  • Resursförbrukning och missbruk som driver upp kostnader

02Arbetssätt

Så utförs arbetet

  1. Granskning av arkitekturen

    Vi kartlägger vad modellen läser, vad den kan anropa och med vems behörigheter. De flesta kritiska fynd syns redan i det här skedet, som en förtroendegräns som saknas.

  2. Adversariell testning

    Indata skapas för hand och genereras i stor skala mot varje kanal in i modellen. En lyckad attack reduceras till den minsta indata som återskapar den.

  3. Missbruk av verktyg och agenter

    Vi använder injicerade instruktioner för att styra verktyg och agenter: för att läsa det som inte ska gå att läsa, för att agera i en annan användares namn, för att ta oss från ett system till nästa.

  4. Validering av skydden

    Filter, skyddsräcken och godkännandesteg testas vart för sig. Rapporten anger vilket skydd som stoppade vilken attack och vilket som inte stoppade någon.

Metodik

03

Vad du får

  • Indata för attacker med andelen lyckade återskapanden, eftersom modellens beteende är sannolikhetsbaserat
  • Diagram över förtroendegränser med de skydd som saknas och de som är svaga
  • En regressionsuppsättning av adversariella indata för din egen testpipeline
  • Sammanfattning för ledningen
  • Teknisk rapport: varje fynd med bevis, CVSS 4.0-vektor, CWE-klass och åtgärd
  • Genomgång med dina tekniker
  • Ett omtest av varje fynd inom 60 dagar efter leverans av rapporten
  • Intyg efter omtestet

04

Vad vi behöver från dig

  • Åtkomst till applikationen som användare i varje roll
  • En beskrivning av arkitekturen: modeller, prompter, källor för hämtning, verktyg, agenter
  • En testmiljö där verktyg kan utlösas utan verklig effekt
  • Din modelleverantörs användningspolicy, där den begränsar adversariell testning

05Standarder

Standarder bakom metoden

06Frågor

Frågor om den här tjänsten

Testar ni modellen eller applikationen?

Applikationen. Basmodellens säkerhet är dess leverantörs ansvar. Det du har kontroll över, och det som angripare utnyttjar, är hur modellen är kopplad till dina data och dina verktyg.

Prompt injection kan inte åtgärdas helt. Vad är poängen med att hitta den?

Poängen är att veta vad som följer av den. Om injektionen leder till ett felaktigt svar är det en kvalitetsfråga. Om den leder till ett e-postmeddelande som skickas i användarens namn är det en sårbarhet i behörigheterna runt modellen, och den kan åtgärdas.

Använder ni våra data för att träna eller prompta externa AI-tjänster?

Nej. Kunddata, prompter och fynd skickas inte till offentliga AI-tjänster och används inte för träning. Verktyg som bygger på språkmodeller körs i miljöer som vi har kontroll över.

Täcker det här kraven i EU:s AI-förordning?

Adversariell testning är en av de åtgärder som förordningen hänvisar till för vissa system och modeller. Rapporten dokumenterar metod, omfattning och resultat i en form som lämpar sig som bevis. Om och hur förordningen gäller ditt system är en juridisk fråga som vi inte besvarar.

08Förfrågan

Berätta vad som behöver testas

  • Gratis kontroll av webbplatsen
  • Svar inom 1 arbetsdag
  • Sekretessavtal före alla tekniska detaljer
  • Fast pris för betalda uppdrag
  • Utan förpliktelser

Begär en granskning

Beskriv systemen och målet. En kundansvarig svarar inom 1 arbetsdag med förtydligande frågor och nästa steg.

Vem vi ska svara

Vi svarar till den här adressen om du inte väljer en annan kanal.

En enskild näringsidkare anger sitt eget namn.

Önskad kanal
Vad som ska granskas
Tjänster av intresse

Välj alla som är aktuella.

Gratis kontroll

Vi kontrollerar din webbplats kostnadsfritt

Om vi inte hittar några problem får du även rapporten kostnadsfritt. Du betalar för rapporten bara när vi hittar problem, och priset beror på hur många de är och hur allvarliga de är.

Villkor för gratis säkerhetskontroll av webbplats

Applikationssäkerhet

Infrastruktur och moln

Attacksimulering

AI, Web3 och kryptografi

Program och verifiering

Applikationssäkerhet

Gratis säkerhetskontroll av webbplats

Vi tittar på din webbplats utifrån, så som en angripare gör, och kontrollerar om det går att bryta sig in i den: svaga inställningar, föråldrad programvara, exponerade filer, osäkra formulär. Kontrollen är kostnadsfri.

Applikationssäkerhet

Penetrationstest av webbapplikationer

Vi försöker bryta oss in i din webbapplikation så som en verklig angripare skulle göra: logga in på andras konton, läsa andra kunders data, ändra priser eller beställningar. Du får veta vad som är möjligt innan brottslingar gör det.

Applikationssäkerhet

Säkerhetstest av API:er

Ett API är den kanal som din app, din webbplats och dina partner använder för att utbyta data med dina servrar. Vi testar om någon kan använda den för att läsa eller ändra data som tillhör andra.

Applikationssäkerhet

Penetrationstest av mobilappar

Vi undersöker din iOS- eller Android-app och servrarna bakom den: vad appen sparar på telefonen, vad som kan utvinnas ur den och om dess anrop kan manipuleras.

Applikationssäkerhet

Säkerhetsgranskning av källkod

Våra specialister läser källkoden till din produkt och hittar de misstag som leder till ett intrång, även de som inte syns utifrån.

Infrastruktur och moln

Säkerhetsgranskning av moln och Kubernetes

Vi granskar hur ditt moln är konfigurerat (AWS, Azure, Google Cloud, Kubernetes): vem som har åtkomst till vad, vilka data som är öppna mot internet och hur långt en angripare kommer efter det första misstaget.

Infrastruktur och moln

Penetrationstest av infrastruktur

Vi testar dina servrar och ditt kontorsnätverk utifrån och inifrån: om en angripare kan ta sig in och, väl inne, nå ekonomisystemet, e-posten eller säkerhetskopiorna.

Infrastruktur och moln

Granskning av extern attackyta

Vi hittar allt som ditt företag exponerar mot internet, även det som har glömts bort: gamla webbplatser, testservrar, läckta lösenord. Sedan visar vi vad av det som kan angripas.

Infrastruktur och moln

Säkerhet i CI/CD och leveranskedjan

Vi granskar vägen som din kod tar från utvecklaren till kunden: byggservrar, bibliotek från tredje part, åtkomstnycklar. Den som har kontroll över den vägen har kontroll över din produkt.

Attacksimulering

Red Team-operationer

En övning i full skala. Vårt team spelar en verklig angripare med ett mål, till exempel att nå kunddata, och du ser om ditt försvar märker det och stoppar det.

Attacksimulering

Purple Team-övningar

Våra angripare och dina försvarare arbetar sida vid sida: vi visar en attackteknik, ditt team undersöker om det ser den, och luckorna i övervakningen täpps till på plats.

Attacksimulering

Social engineering-test

Vi testar människor, inte maskiner: nätfiske via e-post, samtal och meddelanden som angripare använder för att komma åt lösenord. Du får veta hur många anställda som skulle bli lurade och vad som behöver tränas.

AI, Web3 och kryptografi

Säkerhetstest av AI och LLM

Om din produkt har en chattbot eller en annan AI-modell testar vi om den kan förmås att avslöja konfidentiella data, bryta mot sina egna regler eller agera för någon annans räkning.

AI, Web3 och kryptografi

Granskning av smarta kontrakt

Innan ett smart kontrakt förvaltar pengar letar vi efter misstag i dess kod som skulle låta någon ta ut eller frysa medlen. Efter driftsättningen går sådana misstag inte att rätta.

AI, Web3 och kryptografi

Kryptografigranskning

Vi granskar hur din produkt krypterar data och skyddar nycklar: om rätt algoritmer har valts och om de används korrekt. Ett misstag här gör krypteringen värdelös.

Program och verifiering

Förvaltning av bug bounty-program

Bug bounty är ett program där oberoende säkerhetsforskare letar efter sårbarheter i din produkt och får betalt för varje sårbarhet de hittar. Vi lanserar och driver ett sådant program åt dig.

Program och verifiering

Program för sårbarhetsrapportering (VDP)

En offentlig sida och en rutin som berättar för säkerhetsforskare hur de på ett säkert sätt kan rapportera en sårbarhet till dig. Utan dem försvinner rapporter eller kommer i form av hot. Vi sätter upp processen och hanterar inkommande rapporter.

Program och verifiering

Kontinuerlig penetrationstestning

I stället för ett test om året testar vi varje betydande ändring i din produkt under hela året, så att en ny sårbarhet inte väntar i månader på att bli hittad.

Program och verifiering

Penetrationstest för regelefterlevnad

Ett penetrationstest som läggs upp så att en revisor, en tillsynsmyndighet eller en stor kund godtar rapporten: PCI DSS, DORA, NIS2, ISO/IEC 27001, SOC 2.

Tjänster av intresse

Vet inte ännu

Välj det här om du inte vet vilken tjänst du behöver. Beskriv uppgiften med egna ord, så föreslår en specialist en tjänst i svaret.

Domän eller URL för webbplatsen eller för det huvudsakliga system som ska testas, till exempel app.example.com.

Vad som behöver testas, varför just nu och eventuella tidsfrister eller krav på regelefterlevnad. Inga lösenord, nycklar eller detaljer om sårbarheter.

Bekräftelser

Skicka inte inloggningsuppgifter, nycklar eller detaljer om en sårbarhet via det här formuläret. Vi kommer överens om en säker kanal efter det första svaret.

Automatisk kontroll mot missbruk