Testy bezpieczeństwa AI i LLM

Testy z pozycji atakującego dla aplikacji LLM, agentów AI i integracji MCP: prompt injection, wycieki danych, nadużycie narzędzi i wyjście poza zamierzone zadanie.

AI, Web3 i kryptografia

Aplikacja zbudowana na modelu językowym przyjmuje polecenia ze wszystkiego, co czyta: od użytkownika, z pobranego dokumentu, z treści strony internetowej, z wyniku działania narzędzia. Nie potrafi niezawodnie odróżnić polecenia od danych. Gdy model może wywoływać narzędzia, wysyłać wiadomości lub zapisywać dane w bazie, zdanie ukryte w dokumencie staje się działaniem w Twoich systemach.

Testujemy całą aplikację, a nie tylko model: prompty, potok wyszukiwania dokumentów, narzędzia i ich uprawnienia, agentów i protokoły, które ich łączą. Pytanie brzmi: do czego atakujący może zmusić system, co może przez niego odczytać lub ujawnić i czy zabezpieczenia wokół modelu wytrzymują, gdy sam model zawodzi.

01Zakres

Co testujemy

  • Bezpośrednie i pośrednie ataki prompt injection przez każde źródło danych, które czyta model
  • Ujawnienie promptów systemowych, sekretów i danych innych użytkowników lub tenantów
  • Retrieval-augmented generation (RAG): zatruwanie danych, kontrola dostępu do bazy dokumentów
  • Narzędzia i wywoływanie funkcji: nadmierne uprawnienia, niebezpieczne parametry, problem confused deputy
  • Agenci: przejmowanie celu, zatruwanie pamięci, niebezpieczna autonomia, zaufanie między agentami
  • Serwery Model Context Protocol: uwierzytelnianie, zatruwanie narzędzi, wykonywanie poleceń
  • Obsługa odpowiedzi modelu: wstrzykiwanie do przeglądarek, powłok, zapytań i dalszych systemów
  • Mechanizmy ochronne i filtry: obchodzenie przez kodowanie, zmianę języka, odgrywanie ról i ataki wieloetapowe
  • Zużycie zasobów i nadużycia generujące koszty

02Podejście

Jak przebiega praca

  1. Przegląd architektury

    Ustalamy, co model czyta, co może wywołać i z czyimi uprawnieniami. Większość krytycznych znalezisk widać już na tym etapie jako brakującą granicę zaufania.

  2. Testy z pozycji atakującego

    Dane wejściowe przygotowujemy ręcznie i generujemy na dużą skalę dla każdego kanału prowadzącego do modelu. Udany atak sprowadzamy do najkrótszego wejścia, które go odtwarza.

  3. Nadużycie narzędzi i agentów

    Za pomocą wstrzykniętych poleceń sterujemy narzędziami i agentami: odczytujemy to, co powinno być niedostępne, działamy w imieniu innego użytkownika, przechodzimy z jednego systemu do kolejnego.

  4. Testy zabezpieczeń

    Filtry, mechanizmy ochronne i kroki zatwierdzania testujemy osobno. Raport podaje, które zabezpieczenie zatrzymało który atak, a które nie zatrzymało żadnego.

Metodyka

03

Co otrzymujesz

  • Dane wejściowe ataków z odsetkiem skutecznych powtórzeń, bo zachowanie modelu jest probabilistyczne
  • Diagram granic zaufania z brakującymi i słabymi zabezpieczeniami
  • Zestaw złośliwych danych wejściowych do testów regresji we własnym potoku testowym
  • Podsumowanie dla kierownictwa
  • Raport techniczny: każde znalezisko z dowodami, wektorem CVSS 4.0, klasą CWE i sposobem naprawy
  • Omówienie wyników z Twoimi inżynierami
  • Jeden retest każdego znaleziska w ciągu 60 dni od przekazania raportu
  • Poświadczenie wykonania testów po reteście

04

Czego potrzebujemy od Ciebie

  • Dostęp do aplikacji z kontami użytkowników każdej roli
  • Opis architektury: modele, prompty, źródła dokumentów, narzędzia, agenci
  • Środowisko testowe, w którym można uruchamiać narzędzia bez skutków w realnym świecie
  • Zasady korzystania dostawcy Twojego modelu, jeśli ograniczają testy z pozycji atakującego

05Standardy

Standardy, na których opiera się metoda

06Pytania

Pytania o tę usługę

Testujecie model czy aplikację?

Aplikację. Za bezpieczeństwo modelu bazowego odpowiada jego dostawca. To, co kontrolujesz i co wykorzystują atakujący, to sposób, w jaki model jest połączony z Twoimi danymi i narzędziami.

Podatności na prompt injection nie da się całkowicie usunąć. Po co jej szukać?

Po to, by wiedzieć, co z niej wynika. Jeśli wstrzyknięcie prowadzi do błędnej odpowiedzi, to problem jakości. Jeśli prowadzi do e-maila wysłanego w imieniu użytkownika, to podatność w uprawnieniach wokół modelu, a tę można usunąć.

Czy używacie naszych danych do trenowania zewnętrznych usług AI lub w promptach do nich?

Nie. Danych klientów, promptów ani znalezisk nie przesyłamy do publicznych usług AI i nie używamy ich do trenowania. Narzędzia oparte na modelach językowych działają w środowiskach, które kontrolujemy.

Czy usługa obejmuje wymagania unijnego aktu w sprawie sztucznej inteligencji (AI Act)?

Testy z pozycji atakującego to jeden ze środków, o których akt mówi w odniesieniu do niektórych systemów i modeli. Raport dokumentuje metodę, zakres i wyniki w formie, która może posłużyć jako dowód. To, czy i jak akt ma zastosowanie do Twojego systemu, jest kwestią prawną, na którą nie odpowiadamy.

08Zapytanie

Napisz, co trzeba przetestować

  • Bezpłatne sprawdzenie strony
  • Odpowiedź w ciągu 1 dnia roboczego
  • NDA przed przekazaniem szczegółów technicznych
  • Stała cena płatnych projektów
  • Bez zobowiązań

Wyślij zapytanie

Opisz systemy i cel. Menedżer odpowie w ciągu 1 dnia roboczego: zada pytania doprecyzowujące i zaproponuje kolejny krok.

Komu odpowiedzieć

Odpowiadamy na ten adres, chyba że wybierzesz inny kanał.

Osoba prowadząca jednoosobową działalność gospodarczą wpisuje swoje imię i nazwisko.

Preferowany kanał kontaktu
Co sprawdzić
Interesujące Cię usługi

Zaznacz wszystkie, które pasują.

Bezpłatne sprawdzenie

Sprawdzamy Twoją stronę bezpłatnie

Jeśli nie znajdziemy problemów, raport również otrzymujesz bezpłatnie. Za raport płacisz tylko wtedy, gdy znajdziemy problemy, a jego cena zależy od ich liczby i istotności.

Warunki bezpłatnego sprawdzenia bezpieczeństwa strony

Bezpieczeństwo aplikacji

Infrastruktura i chmura

Symulacja ataków

AI, Web3 i kryptografia

Programy i kontrola

Bezpieczeństwo aplikacji

Bezpłatne sprawdzenie bezpieczeństwa strony

Patrzymy na Twoją stronę z zewnątrz, tak jak atakujący, i sprawdzamy, czy można się na nią włamać: słabe ustawienia, nieaktualne oprogramowanie, publicznie dostępne pliki, niebezpieczne formularze. Sprawdzenie jest bezpłatne.

Bezpieczeństwo aplikacji

Testy penetracyjne aplikacji webowych

Próbujemy włamać się do Twojej aplikacji webowej tak, jak zrobiłby to prawdziwy atakujący: zalogować się na cudze konta, odczytać dane innych klientów, zmienić ceny lub zamówienia. Dowiadujesz się, co jest możliwe, zanim dowiedzą się tego przestępcy.

Bezpieczeństwo aplikacji

Testy bezpieczeństwa API

API to kanał, przez który Twoja aplikacja, strona internetowa i partnerzy wymieniają dane z Twoimi serwerami. Sprawdzamy, czy nikt nie może przez nie odczytać ani zmienić cudzych danych.

Bezpieczeństwo aplikacji

Testy penetracyjne aplikacji mobilnych

Badamy Twoją aplikację na iOS lub Androida i stojące za nią serwery: co aplikacja przechowuje w telefonie, co można z niej wydobyć i czy da się podmienić jej żądania.

Bezpieczeństwo aplikacji

Przegląd bezpieczeństwa kodu

Nasi specjaliści czytają kod źródłowy Twojego produktu i znajdują błędy, które prowadzą do włamania, także te niewidoczne z zewnątrz.

Infrastruktura i chmura

Ocena bezpieczeństwa chmury i Kubernetesa

Sprawdzamy, jak skonfigurowana jest Twoja chmura (AWS, Azure, Google Cloud, Kubernetes): kto ma dostęp do czego, które dane są otwarte na internet i jak daleko zajdzie atakujący po pierwszym błędzie.

Infrastruktura i chmura

Testy penetracyjne infrastruktury

Testujemy Twoje serwery i sieć biurową z zewnątrz i od środka: czy atakujący może dostać się do środka, a gdy już tam jest, dotrzeć do systemu księgowego, poczty lub kopii zapasowych.

Infrastruktura i chmura

Ocena zewnętrznej powierzchni ataku

Znajdujemy wszystko, co Twoja firma wystawia do internetu, także to, o czym zapomniano: stare strony, serwery testowe, hasła, które wyciekły. Potem pokazujemy, co z tego można zaatakować.

Infrastruktura i chmura

Bezpieczeństwo CI/CD i łańcucha dostaw

Sprawdzamy drogę, jaką Twój kod przechodzi od programisty do klienta: serwery budowania, biblioteki zewnętrzne, klucze dostępu. Kto kontroluje tę drogę, kontroluje Twój produkt.

Symulacja ataków

Operacje Red Team

Ćwiczenie na pełną skalę. Nasz zespół odgrywa prawdziwego atakującego z konkretnym celem, na przykład dotarciem do danych klientów, a Ty widzisz, czy Twoja obrona go zauważy i zatrzyma.

Symulacja ataków

Ćwiczenia Purple Team

Nasi atakujący i Twoi obrońcy pracują ramię w ramię: pokazujemy technikę ataku, Twój zespół sprawdza, czy ją widzi, a luki w monitoringu są zamykane na miejscu.

Symulacja ataków

Testy socjotechniczne

Testujemy ludzi, a nie maszyny: e-maile phishingowe, telefony i wiadomości, których atakujący używają, by zdobyć hasła. Dowiadujesz się, ilu pracowników dałoby się oszukać i na czym skupić szkolenia.

AI, Web3 i kryptografia

Testy bezpieczeństwa AI i LLM

Jeśli Twój produkt ma chatbota lub inny model AI, sprawdzamy, czy da się go namówić do ujawnienia poufnych danych, złamania własnych zasad albo działania w cudzym imieniu.

AI, Web3 i kryptografia

Audyt smart kontraktów

Zanim smart kontrakt zacznie przechowywać pieniądze, szukamy w jego kodzie błędów, które pozwoliłyby komuś wypłacić lub zamrozić środki. Po wdrożeniu takich błędów nie da się poprawić.

AI, Web3 i kryptografia

Przegląd kryptografii

Sprawdzamy, jak Twój produkt szyfruje dane i chroni klucze: czy wybrano właściwe algorytmy i czy są prawidłowo stosowane. Błąd w tym miejscu sprawia, że szyfrowanie staje się bezużyteczne.

Programy i kontrola

Zarządzanie programem bug bounty

Bug bounty to program, w którym niezależni badacze szukają podatności w Twoim produkcie i otrzymują nagrodę za każdą, którą znajdą. Uruchamiamy i prowadzimy taki program dla Ciebie.

Programy i kontrola

Program ujawniania podatności (VDP)

Publiczna strona i procedura, które mówią badaczom, jak bezpiecznie zgłosić Ci podatność. Bez nich zgłoszenia giną albo przychodzą w formie gróźb. Uruchamiamy ten proces i obsługujemy przychodzące zgłoszenia.

Programy i kontrola

Ciągłe testy penetracyjne

Zamiast jednego testu w roku testujemy każdą istotną zmianę w Twoim produkcie przez cały rok, aby nowa podatność nie czekała miesiącami na wykrycie.

Programy i kontrola

Testy penetracyjne na potrzeby zgodności

Test penetracyjny zorganizowany tak, aby jego raport zaakceptował audytor, regulator lub duży klient: PCI DSS, DORA, NIS2, ISO/IEC 27001, SOC 2.

Interesujące Cię usługi

Jeszcze nie wiem

Wybierz tę opcję, jeśli nie wiesz, której usługi potrzebujesz. Opisz zadanie własnymi słowami, a specjalista zaproponuje usługę w odpowiedzi.

Domena lub adres URL strony internetowej albo głównego systemu do testów, na przykład app.example.com.

Co wymaga testów, dlaczego teraz oraz ewentualny termin lub wymóg zgodności. Bez haseł, kluczy i szczegółów podatności.

Potwierdzenia

Nie przesyłaj przez ten formularz danych logowania, kluczy ani szczegółów podatności. Bezpieczny kanał uzgadniamy po pierwszej odpowiedzi.

Automatyczna weryfikacja chroniąca przed nadużyciami