website
// услуга

Пентест ИИ и LLM-приложений

Пентест ИИ и LLM-приложений — это ручная проверка безопасности продуктов на базе больших языковых моделей: чат-ботов, ассистентов, RAG-систем и приложений с генеративным ИИ. Мы находим prompt-инъекции, утечки системного промпта и данных, обход ограничений и небезопасную обработку вывода модели — то, что не видит ни один классический сканер. Каждая находка подтверждается эксплуатацией и сопровождается рекомендациями.

Что мы проверяем в LLM-приложении

ИИ-приложение — это новая, плохо изученная поверхность атаки: модель принимает недоверенный текст и может выполнить его как инструкцию. Мы тестируем всю цепочку — от пользовательского ввода до действий, которые совершает модель:

  • Prompt-инъекции — прямые и косвенные (через документы, веб-страницы, данные RAG).
  • Утечка системного промпта и конфиденциальных инструкций.
  • Утечка данных — доступ к чужим сессиям, документам, данным других пользователей.
  • Обход ограничений (jailbreak) — генерация запрещённого контента, обход политик.
  • Небезопасная обработка вывода — XSS, SSRF, выполнение кода через ответ модели.
  • Отравление контекста и RAG — подмена источников знаний.

Как проходит тестирование

Мы моделируем действия реального злоумышленника, а не прогоняем автоматический чек-лист. Работа идёт в несколько этапов: разведка (какая модель, какие инструменты и данные ей доступны), построение карты доверия, состязательное тестирование каждого канала ввода, эскалация найденных инъекций до реального воздействия и проверка бизнес-последствий. Всё, что нашли, мы воспроизводим и фиксируем пошагово.

Стандарты и методологии

Мы работаем не «по наитию», а по признанным отраслевым методологиям безопасности ИИ:

  • OWASP Top 10 for LLM Applications (2025) — эталонный список рисков LLM: prompt-инъекции, утечка данных, отравление, небезопасный вывод.
  • OWASP Agentic Security / MAESTRO — риски автономных агентов и мульти-агентных систем.
  • MITRE ATLAS — матрица тактик и техник атак на системы машинного обучения.
  • NIST AI Risk Management Framework — управление рисками ИИ на уровне процессов.

Что вы получаете

По итогам вы получаете отчёт с приоритизированным списком уязвимостей, воспроизведением каждой находки, оценкой бизнес-риска и понятными рекомендациями для команды разработки и ML-инженеров. После устранения проводим бесплатный повторный тест.

Пентест ИИ особенно важен, если ваш ассистент имеет доступ к данным клиентов, внутренним системам или может совершать действия от имени пользователя.

// оставить заявку

Готовы усилить защиту?

Оставьте заявку — проведём бесплатную консультацию, оценим объём работ и рассчитаем фиксированную стоимость. Ответим в течение одного рабочего дня.

  • Бесплатная консультация и оценка
  • Фиксированная цена без скрытых доплат
  • Полная конфиденциальность по NDA
  • Бесплатный ретест после устранения
./связаться




    // тарифы

    Тарифы и стоимость

    Фиксированная стоимость под объём задач. Точную цену рассчитаем после бесплатной консультации — без скрытых доплат.

    Экспресс
    от 180 000 ₽
    Чат-бот / ассистент без внешних инструментов
    • Тестирование по OWASP LLM Top 10
    • Prompt-инъекции и джейлбрейки
    • Проверка утечки системного промпта
    • Отчёт с рекомендациями
    • Срок 5–7 дней
    Заказать
    Комплекс
    от 900 000 ₽
    Полноценный ИИ-продукт
    • Всё из «Стандарта»
    • White Box с доступом к промптам и коду
    • Тестирование бизнес-логики ИИ-сценариев
    • Проверка интеграций и цепочек действий
    • Аттестация для клиентов и партнёров
    • Срок от 3 недель
    Заказать
    // faq

    Частые вопросы

    Что такое prompt-инъекция и чем она опасна?
    Это когда недоверенный текст (ввод пользователя, документ, веб-страница) заставляет модель выполнить инструкцию злоумышленника — раскрыть данные, обойти политику или совершить действие. Для приложений с доступом к данным это критический риск.
    Можно ли протестировать чат-бота, если у нас нет доступа к его коду?
    Да. Мы работаем в режиме блэкбокс — тестируем через интерфейс так же, как это делал бы атакующий. Грейбокс (с доступом к промптам) даёт более глубокий результат.
    Сколько стоит пентест ИИ-приложения?
    От 180 000 ₽ за экспресс-проверку чат-бота до 900 000 ₽ и выше за комплексный аудит полноценного ИИ-продукта с интеграциями.
    Чем это отличается от обычного пентеста веб-приложения?
    Классический пентест не покрывает специфику LLM: prompt-инъекции, утечку промпта, отравление RAG, небезопасный вывод модели. Мы тестируем именно ИИ-слой.
    Вы проверяете модель или приложение вокруг неё?
    И то, и другое: поведение модели на состязательный ввод и безопасность обвязки — обработку вывода, доступ к данным, действия и интеграции.