KI- und LLM-Sicherheitstest

Tests von LLM-Anwendungen, Agenten und MCP-Integrationen aus Sicht eines Angreifers: Prompt Injection, Abfluss von Daten, Missbrauch von Tools und Ausbruch aus der vorgesehenen Aufgabe.

KI, Web3 und Kryptografie

Eine Anwendung auf Basis eines Sprachmodells nimmt Anweisungen aus allem entgegen, was sie liest: vom Benutzer, aus einem abgerufenen Dokument, aus dem Inhalt einer Seite im Internet, aus der Ausgabe eines Tools. Die Anwendung kann eine Anweisung nicht zuverlässig von Daten unterscheiden. Sobald das Modell Tools aufrufen, Nachrichten senden oder in eine Datenbank schreiben kann, wird ein in einem Dokument versteckter Satz zu einer Aktion in Ihren Systemen.

Wir testen die gesamte Anwendung und nicht nur das Modell: die Prompts, die Retrieval-Pipeline, die Tools und ihre Berechtigungen, die Agenten und die Protokolle, die sie verbinden. Die Frage ist, was ein Angreifer das System tun, lesen oder preisgeben lassen kann und ob die Schutzmaßnahmen rund um das Modell halten, wenn das Modell selbst versagt.

01Umfang

Was wir testen

  • Direkte und indirekte Prompt Injection über jede Eingabe, die das Modell liest
  • Preisgabe von System-Prompts, Geheimnissen und Daten anderer Benutzer oder Mandanten
  • Retrieval-Augmented Generation: Poisoning, Zugriffskontrolle des Dokumentenspeichers
  • Tools und Function Calling: übermäßige Berechtigungen, unsichere Parameter, Confused Deputy
  • Agenten: Goal Hijacking, Memory Poisoning, unsichere Autonomie, Vertrauen zwischen Agenten
  • Server für das Model Context Protocol: Authentifizierung, Tool Poisoning, Ausführung von Befehlen
  • Verarbeitung der Ausgaben: Injection in Browser, Shells, Abfragen und nachgelagerte Systeme
  • Guardrails und Filter: Umgehung durch Kodierung, Sprache, Rollenspiel und Angriffe über mehrere Dialogrunden
  • Ressourcenverbrauch und Missbrauch, der Kosten verursacht

02Vorgehen

Wie die Arbeit abläuft

  1. Prüfung der Architektur

    Wir erfassen, was das Modell liest, was es aufrufen kann und mit wessen Berechtigungen. Die meisten kritischen Befunde sind schon in dieser Phase als fehlende Vertrauensgrenze sichtbar.

  2. Tests aus Angreifersicht

    Eingaben werden von Hand ausgearbeitet und in großer Zahl erzeugt, gegen jeden Kanal, über den etwas zum Modell gelangt. Ein erfolgreicher Angriff wird auf die kleinste Eingabe reduziert, die ihn reproduziert.

  3. Missbrauch von Tools und Agenten

    Mit eingeschleusten Anweisungen steuern wir Tools und Agenten: um zu lesen, was nicht lesbar sein sollte, um im Namen eines anderen Benutzers zu handeln, um von einem System zum nächsten zu gelangen.

  4. Prüfung der Schutzmaßnahmen

    Filter, Guardrails und Freigabeschritte werden einzeln getestet. Der Bericht hält fest, welche Schutzmaßnahme welchen Angriff gestoppt hat und welche keinen.

Methodik

03

Was Sie erhalten

  • Angriffseingaben mit ihrer Reproduktionsrate, da sich Modelle probabilistisch verhalten
  • Diagramm der Vertrauensgrenzen mit den fehlenden und den schwachen Schutzmaßnahmen
  • Ein Regressionsset von Angriffseingaben für Ihre eigene Testpipeline
  • Management-Zusammenfassung
  • Technischer Bericht: jeder Befund mit Nachweisen, Vektor nach CVSS 4.0, CWE-Klasse und Empfehlung zur Behebung
  • Abschlussgespräch mit Ihrem technischen Team
  • Ein Nachtest jedes Befunds innerhalb von 60 Tagen nach Übergabe des Berichts
  • Bestätigungsschreiben nach dem Nachtest

04

Was wir von Ihnen brauchen

  • Zugang zur Anwendung als Benutzer jeder Rolle
  • Eine Beschreibung der Architektur: Modelle, Prompts, Retrieval-Quellen, Tools, Agenten
  • Eine Testumgebung, in der sich Tools auslösen lassen, ohne in der realen Welt etwas zu bewirken
  • Die Nutzungsrichtlinie Ihres Modellanbieters, sofern sie Tests aus Angreifersicht einschränkt

05Standards

Standards hinter der Methode

06Fragen

Fragen zu dieser Leistung

Testen Sie das Modell oder die Anwendung?

Die Anwendung. Für die Sicherheit des Basismodells ist sein Anbieter verantwortlich. Was Sie kontrollieren und was Angreifer ausnutzen, ist die Art, wie das Modell mit Ihren Daten und Ihren Tools verbunden ist.

Prompt Injection lässt sich nicht vollständig beheben. Wozu sie dann suchen?

Um zu wissen, was aus ihr folgt. Führt eine Injection zu einer falschen Antwort, ist das ein Qualitätsproblem. Führt sie dazu, dass eine E-Mail im Namen des Benutzers gesendet wird, ist das eine Schwachstelle in den Berechtigungen rund um das Modell, und diese lässt sich beheben.

Nutzen Sie unsere Daten, um externe KI-Dienste zu trainieren oder mit Prompts zu versorgen?

Nein. Daten von Kunden, Prompts und Befunde werden nicht an öffentliche KI-Dienste übermittelt und nicht für Training verwendet. Werkzeuge, die auf Sprachmodellen beruhen, laufen in Umgebungen, die wir kontrollieren.

Deckt das Anforderungen der KI-Verordnung der EU ab?

Tests aus Angreifersicht sind eine der Maßnahmen, auf die die Verordnung für bestimmte Systeme und Modelle verweist. Der Bericht dokumentiert Methode, Prüfumfang und Ergebnisse in einer Form, die sich als Nachweis eignet. Ob und wie die Verordnung auf Ihr System anwendbar ist, ist eine Rechtsfrage, die wir nicht beantworten.

08Anfrage

Sagen Sie uns, was getestet werden soll

  • Website-Check kostenlos
  • Antwort innerhalb von 1 Arbeitstag
  • NDA vor jedem technischen Detail
  • Festpreis für kostenpflichtige Projekte
  • Unverbindlich

Prüfung anfragen

Beschreiben Sie die Systeme und das Ziel. Ein Kundenbetreuer antwortet innerhalb von 1 Arbeitstag mit Rückfragen und dem nächsten Schritt.

Wem wir antworten

Wir antworten an diese Adresse, sofern Sie keinen anderen Kanal wählen.

Einzelunternehmer geben ihren eigenen Namen an.

Bevorzugter Kanal
Was wir prüfen sollen
Gewünschte Leistungen

Mehrfachauswahl möglich.

Kostenloser Check

Wir prüfen Ihre Website kostenlos

Finden wir keine Probleme, erhalten Sie auch den Bericht kostenlos. Sie zahlen für den Bericht nur, wenn wir Probleme finden, und sein Preis hängt von ihrer Anzahl und ihrem Schweregrad ab.

Bedingungen des kostenlosen Website-Sicherheitschecks

Anwendungssicherheit

Infrastruktur und Cloud

Angriffssimulation

KI, Web3 und Kryptografie

Programme und Absicherung

Anwendungssicherheit

Kostenloser Website-Sicherheitscheck

Wir betrachten Ihre Website von außen, so wie ein Angreifer sie sieht, und prüfen, ob jemand in sie eindringen kann: schwache Einstellungen, veraltete Software, offen zugängliche Dateien, unsichere Formulare. Der Check ist kostenlos.

Anwendungssicherheit

Penetrationstest für Webanwendungen

Wir versuchen, in Ihre Webanwendung einzudringen, so wie es ein echter Angreifer täte: uns in fremde Konten einloggen, die Daten anderer Kunden lesen, Preise oder Bestellungen ändern. Sie erfahren, was möglich ist, bevor Kriminelle es erfahren.

Anwendungssicherheit

API-Sicherheitstest

Eine API ist der Kanal, über den Ihre App, Ihre Website und Ihre Partner Daten mit Ihren Servern austauschen. Wir prüfen, ob jemand darüber Daten lesen oder ändern kann, die ihm nicht gehören.

Anwendungssicherheit

Penetrationstest für mobile Apps

Wir prüfen Ihre iOS- oder Android-App und die Server dahinter: was die App auf dem Telefon speichert, was sich aus ihr auslesen lässt und ob sich ihre Anfragen manipulieren lassen.

Anwendungssicherheit

Quellcode-Review

Unsere Spezialisten lesen den Quellcode Ihres Produkts und finden die Fehler, die zu einem Einbruch führen, auch solche, die von außen nicht zu sehen sind.

Infrastruktur und Cloud

Sicherheitsprüfung für Cloud und Kubernetes

Wir prüfen, wie Ihre Cloud eingerichtet ist (AWS, Azure, Google Cloud, Kubernetes): wer worauf Zugriff hat, welche Daten aus dem Internet offen zugänglich sind und wie weit ein Angreifer nach dem ersten Fehler kommt.

Infrastruktur und Cloud

Penetrationstest der Infrastruktur

Wir testen Ihre Server und Ihr Büronetzwerk von außen und von innen: Kommt ein Angreifer hinein, und erreicht er dann das Buchhaltungssystem, die E-Mails oder die Backups?

Infrastruktur und Cloud

Prüfung der externen Angriffsfläche

Wir finden alles, was von Ihrem Unternehmen im Internet sichtbar ist, auch das Vergessene: alte Websites, Testserver, geleakte Passwörter. Dann zeigen wir, was davon angreifbar ist.

Infrastruktur und Cloud

Sicherheit von CI/CD und Lieferkette

Wir prüfen den Weg, den Ihr Code vom Entwickler zum Kunden nimmt: Build-Server, Bibliotheken von Dritten, Zugriffsschlüssel. Wer diesen Weg kontrolliert, kontrolliert Ihr Produkt.

Angriffssimulation

Red-Team-Operationen

Eine Übung in vollem Umfang. Unser Team spielt einen echten Angreifer mit einem Ziel, zum Beispiel an Kundendaten zu gelangen, und Sie sehen, ob Ihre Verteidigung ihn bemerkt und stoppt.

Angriffssimulation

Purple-Team-Übungen

Unsere Angreifer und Ihre Verteidiger arbeiten Seite an Seite: Wir zeigen eine Angriffstechnik, Ihr Team prüft, ob es sie sieht, und die Lücken in der Überwachung werden sofort geschlossen.

Angriffssimulation

Social-Engineering-Prüfung

Wir testen Menschen, nicht Maschinen: mit den Phishing-E-Mails, Anrufen und Nachrichten, mit denen Angreifer an Passwörter gelangen. Sie erfahren, wie viele Beschäftigte sich täuschen lassen würden und wo Schulungen ansetzen sollten.

KI, Web3 und Kryptografie

KI- und LLM-Sicherheitstest

Wenn Ihr Produkt einen Chatbot oder ein anderes KI-Modell enthält, prüfen wir, ob es sich dazu überreden lässt, vertrauliche Daten preiszugeben, seine eigenen Regeln zu brechen oder im Namen einer anderen Person zu handeln.

KI, Web3 und Kryptografie

Smart-Contract-Audit

Bevor ein Smart Contract Geld verwahrt, suchen wir in seinem Code nach Fehlern, über die jemand die Gelder abziehen oder einfrieren könnte. Nach der Bereitstellung auf der Blockchain lassen sich solche Fehler nicht mehr korrigieren.

KI, Web3 und Kryptografie

Kryptografie-Review

Wir prüfen, wie Ihr Produkt Daten verschlüsselt und Schlüssel schützt: ob die richtigen Algorithmen gewählt sind und ob sie richtig angewendet werden. Ein Fehler an dieser Stelle macht die Verschlüsselung wertlos.

Programme und Absicherung

Management von Bug-Bounty-Programmen

In einem Bug-Bounty-Programm suchen unabhängige Sicherheitsforscher nach Schwachstellen in Ihrem Produkt und erhalten für jede gefundene Schwachstelle eine Prämie. Wir starten und betreiben ein solches Programm für Sie.

Programme und Absicherung

Programm zur Offenlegung von Schwachstellen (VDP)

Eine öffentliche Seite und ein Verfahren, die Sicherheitsforschern sagen, wie sie Ihnen eine Schwachstelle gefahrlos melden. Ohne sie gehen Meldungen verloren oder kommen als Drohungen an. Wir richten den Prozess ein und bearbeiten eingehende Meldungen.

Programme und Absicherung

Kontinuierliche Penetrationstests

Statt eines Tests im Jahr testen wir jede wesentliche Änderung Ihres Produkts über das ganze Jahr hinweg, damit eine neue Schwachstelle nicht monatelang darauf wartet, gefunden zu werden.

Programme und Absicherung

Penetrationstest für Compliance

Ein Penetrationstest, der so angelegt ist, dass ein Auditor, eine Aufsichtsbehörde oder ein Großkunde seinen Bericht akzeptiert: PCI DSS, DORA, NIS2, ISO/IEC 27001, SOC 2.

Gewünschte Leistungen

Noch nicht sicher

Wählen Sie diese Option, wenn Sie nicht wissen, welche Leistung Sie brauchen. Beschreiben Sie die Aufgabe in eigenen Worten, und ein Spezialist schlägt in der Antwort eine Leistung vor.

Domain oder URL der Website oder des Hauptsystems, das getestet werden soll, zum Beispiel app.example.com.

Was getestet werden soll, warum jetzt und welche Fristen oder Compliance-Anforderungen es gibt. Keine Passwörter, Schlüssel oder Details zu Schwachstellen.

Bestätigungen

Senden Sie über dieses Formular keine Zugangsdaten, Schlüssel oder Details zu einer Schwachstelle. Ein sicherer Kanal wird nach der ersten Antwort vereinbart.

Automatische Missbrauchsprüfung