Тестирование безопасности AI и LLM

Состязательное тестирование LLM-приложений, агентов и интеграций MCP: prompt injection, утечки данных, злоупотребление инструментами, выход за рамки задачи.

AI, Web3 и криптография

Приложение на основе языковой модели принимает инструкции из всего, что читает: от пользователя, из найденного документа, из содержимого веб-страницы, из ответа инструмента. Надёжно отличить инструкцию от данных оно не может. Как только модель получает возможность вызывать инструменты, отправлять сообщения или писать в базу данных, фраза, спрятанная в документе, становится действием в ваших системах.

Мы тестируем приложение целиком, а не только модель: промпты, конвейер поиска, инструменты и их права, агентов и протоколы, которые их связывают. Вопрос в том, что злоумышленник может заставить систему сделать, прочитать или раскрыть и выдержат ли меры защиты вокруг модели, когда сама модель не выдержит.

01Объём

Что мы проверяем

  • Прямая и косвенная prompt injection через каждый источник, который читает модель
  • Раскрытие системных промптов, секретов и данных других пользователей или арендаторов
  • RAG: отравление данных, разграничение доступа к хранилищу документов
  • Инструменты и вызов функций: избыточные права, небезопасные параметры, confused deputy
  • Агенты: подмена цели, отравление памяти, небезопасная автономность, доверие между агентами
  • Серверы Model Context Protocol: аутентификация, отравление инструментов, выполнение команд
  • Обработка вывода: инъекции в браузер, командную оболочку, запросы и смежные системы
  • Защитные фильтры: обход через кодирование, язык, ролевые сценарии и многоходовые атаки
  • Потребление ресурсов и злоупотребление стоимостью

02Подход

Как выполняется работа

  1. Анализ архитектуры

    Выясняем, что модель читает, что может вызывать и с чьими правами. Большинство критических находок видно уже здесь — как отсутствующая граница доверия.

  2. Состязательное тестирование

    Входные данные составляются вручную и генерируются в большом объёме для каждого канала, ведущего к модели. Успешная атака сводится к минимальному входу, который её воспроизводит.

  3. Злоупотребление инструментами и агентами

    С помощью внедрённых инструкций управляем инструментами и агентами: читаем то, что должно быть недоступно, действуем от имени другого пользователя, переходим из одной системы в другую.

  4. Проверка мер защиты

    Фильтры, ограничители и шаги подтверждения тестируются по отдельности. В отчёте указано, какая мера остановила какую атаку и какая не остановила ни одной.

Методология

03

Что вы получаете

  • Входные данные атак с частотой воспроизведения: поведение модели вероятностно
  • Схема границ доверия с отсутствующими и слабыми мерами защиты
  • Регрессионный набор состязательных входов для вашего конвейера тестирования
  • Резюме для руководства
  • Технический отчёт: каждая находка с доказательствами, вектором CVSS 4.0, классом CWE и исправлением
  • Созвон с разбором для ваших инженеров
  • Одна повторная проверка каждой находки в течение 60 дней после передачи отчёта
  • Письмо-подтверждение после повторной проверки

04

Что нужно от вас

  • Доступ к приложению от имени пользователей каждой роли
  • Описание архитектуры: модели, промпты, источники поиска, инструменты, агенты
  • Тестовая среда, где инструменты можно вызывать без последствий в реальном мире
  • Правила использования вашего поставщика модели, если они ограничивают состязательное тестирование

05Стандарты

Стандарты, на которых построен метод

06Вопросы

Вопросы об этой услуге

Вы тестируете модель или приложение?

Приложение. За безопасность базовой модели отвечает её поставщик. То, что контролируете вы и чем пользуются злоумышленники, — это способ подключения модели к вашим данным и инструментам.

Prompt injection нельзя устранить полностью. Какой смысл её искать?

Смысл в том, чтобы знать её последствия. Если инъекция приводит к неверному ответу, это вопрос качества. Если она приводит к письму, отправленному от имени пользователя, это уязвимость в правах вокруг модели, и её можно устранить.

Вы используете наши данные для обучения или запросов к внешним AI-сервисам?

Нет. Данные заказчика, промпты и находки не передаются в публичные AI-сервисы и не используются для обучения. Инструменты на основе языковых моделей работают в средах, которые контролируем мы.

Это закрывает требования EU AI Act?

Состязательное тестирование — одна из мер, на которые Регламент ссылается для отдельных систем и моделей. Отчёт фиксирует метод, объём и результаты в виде, пригодном в качестве доказательства. Применим ли Регламент к вашей системе и как именно — юридический вопрос, на который мы не отвечаем.

08Заявка

Расскажите, что нужно проверить

  • Проверка сайта — бесплатно
  • Ответ в течение 1 рабочего дня
  • NDA до передачи технических деталей
  • Фиксированная стоимость платных проектов
  • Без обязательств

Оставить заявку

Опишите системы и задачу. Менеджер ответит в течение 1 рабочего дня: задаст уточняющие вопросы и предложит следующий шаг.

Кому ответить

Ответим на этот адрес, если вы не выберете другой канал.

Индивидуальный предприниматель указывает своё имя.

Удобный канал связи
Что проверить
Интересующие услуги

Можно выбрать несколько.

Бесплатная проверка

Проверим ваш сайт бесплатно

Если проблем не найдено, отчёт вы тоже получите бесплатно. Отчёт оплачивается, только если мы нашли проблемы, и его цена зависит от их числа и критичности.

Условия бесплатной проверки безопасности сайта

Безопасность приложений

Инфраструктура и облако

Имитация атак

AI, Web3 и криптография

Программы и контроль

Безопасность приложений

Бесплатная проверка безопасности сайта

Смотрим на ваш сайт снаружи — так, как это делает злоумышленник, — и проверяем, можно ли в него проникнуть: слабые настройки, устаревшие программы, открытые файлы, небезопасные формы. Проверка бесплатная.

Безопасность приложений

Пентест веб-приложений

Пробуем взломать ваше веб-приложение так, как это сделал бы настоящий злоумышленник: войти в чужой аккаунт, прочитать данные других клиентов, изменить цены или заказы. Вы узнаёте о слабых местах раньше преступников.

Безопасность приложений

Тестирование безопасности API

API — это канал, по которому ваше приложение, сайт и партнёры обмениваются данными с вашими серверами. Проверяем, что через него нельзя прочитать или изменить чужие данные.

Безопасность приложений

Пентест мобильных приложений

Изучаем ваше приложение для iOS или Android и серверы, с которыми оно работает: что приложение хранит на телефоне, что из него можно извлечь и можно ли подменить его запросы.

Безопасность приложений

Аудит исходного кода

Наши специалисты читают исходный код вашего продукта и находят ошибки, которые ведут к взлому, — в том числе те, которых не видно снаружи.

Инфраструктура и облако

Аудит безопасности облака и Kubernetes

Проверяем, как настроено ваше облако (AWS, Azure, Google Cloud, Kubernetes): у кого к чему есть доступ, какие данные открыты в интернет и как далеко пройдёт злоумышленник после первой ошибки.

Инфраструктура и облако

Пентест инфраструктуры

Проверяем ваши серверы и офисную сеть снаружи и изнутри: сможет ли злоумышленник попасть внутрь и добраться до бухгалтерии, почты или резервных копий.

Инфраструктура и облако

Анализ внешней поверхности атаки

Находим всё, что ваша компания выставила в интернет, включая забытое: старые сайты, тестовые серверы, утёкшие пароли. И показываем, что из этого можно атаковать.

Инфраструктура и облако

Безопасность CI/CD и цепочки поставок

Проверяем путь вашего кода от разработчика до клиента: серверы сборки, сторонние библиотеки, ключи доступа. Кто контролирует этот путь, тот контролирует ваш продукт.

Имитация атак

Red Team

Полномасштабное учение. Наша команда играет роль настоящего злоумышленника с целью — например, добраться до данных клиентов, — а вы видите, заметит ли и остановит ли его ваша защита.

Имитация атак

Purple Team

Наши атакующие и ваши защитники работают вместе: мы показываем приём атаки, ваша команда проверяет, видит ли она его, и пробелы в мониторинге закрываются сразу.

Имитация атак

Проверка социальной инженерией

Проверяем не технику, а людей: фишинговые письма, звонки и сообщения, которыми злоумышленники выманивают пароли. Вы узнаёте, сколько сотрудников поддались бы на обман и чему их учить.

AI, Web3 и криптография

Тестирование безопасности AI и LLM

Если в вашем продукте есть чат-бот или другая модель ИИ, проверяем, можно ли уговорить её выдать конфиденциальные данные, нарушить собственные правила или действовать от чужого имени.

AI, Web3 и криптография

Аудит смарт-контрактов

Прежде чем смарт-контракт начнёт хранить деньги, ищем в его коде ошибки, которые позволят вывести или заблокировать средства. После публикации такие ошибки уже не исправить.

AI, Web3 и криптография

Криптографический аудит

Проверяем, как ваш продукт шифрует данные и защищает ключи: те ли алгоритмы выбраны и правильно ли они применены. Ошибка здесь делает шифрование бесполезным.

Программы и контроль

Управление программой Bug Bounty

Bug bounty — программа, в которой независимые исследователи ищут уязвимости в вашем продукте и получают вознаграждение за каждую найденную. Мы запускаем и ведём такую программу за вас.

Программы и контроль

Программа раскрытия уязвимостей (VDP)

Публичная страница и порядок, которые объясняют исследователям, как безопасно сообщить вам об уязвимости. Без них сообщения теряются или приходят в виде угроз. Мы настраиваем процесс и обрабатываем входящие сообщения.

Программы и контроль

Непрерывный пентест

Вместо одного теста в год проверяем каждое значимое изменение вашего продукта в течение всего года, чтобы новая уязвимость не ждала своего обнаружения месяцами.

Программы и контроль

Пентест для соответствия требованиям

Тест на проникновение, оформленный так, чтобы его отчёт принял аудитор, регулятор или крупный заказчик: PCI DSS, DORA, NIS2, ISO/IEC 27001, SOC 2.

Интересующие услуги

Пока не определились

Выберите этот вариант, если не знаете, какая услуга вам нужна. Опишите задачу своими словами, и специалист предложит услугу в ответе.

Домен или URL сайта либо основной системы, которую нужно проверить, например app.example.com.

Что нужно проверить, почему сейчас, есть ли срок или требование регулятора. Не указывайте пароли, ключи и детали уязвимостей.

Подтверждения

Не отправляйте через форму учётные данные, ключи и детали уязвимостей. Защищённый канал согласуем после первого ответа.

Автоматическая проверка от злоупотреблений