Пентест ИИ и LLM-приложений — это ручная проверка безопасности продуктов на базе больших языковых моделей: чат-ботов, ассистентов, RAG-систем и приложений с генеративным ИИ. Мы находим prompt-инъекции, утечки системного промпта и данных, обход ограничений и небезопасную обработку вывода модели — то, что не видит ни один классический сканер. Каждая находка подтверждается эксплуатацией и сопровождается рекомендациями.
Что мы проверяем в LLM-приложении
ИИ-приложение — это новая, плохо изученная поверхность атаки: модель принимает недоверенный текст и может выполнить его как инструкцию. Мы тестируем всю цепочку — от пользовательского ввода до действий, которые совершает модель:
- Prompt-инъекции — прямые и косвенные (через документы, веб-страницы, данные RAG).
- Утечка системного промпта и конфиденциальных инструкций.
- Утечка данных — доступ к чужим сессиям, документам, данным других пользователей.
- Обход ограничений (jailbreak) — генерация запрещённого контента, обход политик.
- Небезопасная обработка вывода — XSS, SSRF, выполнение кода через ответ модели.
- Отравление контекста и RAG — подмена источников знаний.
Как проходит тестирование
Мы моделируем действия реального злоумышленника, а не прогоняем автоматический чек-лист. Работа идёт в несколько этапов: разведка (какая модель, какие инструменты и данные ей доступны), построение карты доверия, состязательное тестирование каждого канала ввода, эскалация найденных инъекций до реального воздействия и проверка бизнес-последствий. Всё, что нашли, мы воспроизводим и фиксируем пошагово.
Стандарты и методологии
Мы работаем не «по наитию», а по признанным отраслевым методологиям безопасности ИИ:
- OWASP Top 10 for LLM Applications (2025) — эталонный список рисков LLM: prompt-инъекции, утечка данных, отравление, небезопасный вывод.
- OWASP Agentic Security / MAESTRO — риски автономных агентов и мульти-агентных систем.
- MITRE ATLAS — матрица тактик и техник атак на системы машинного обучения.
- NIST AI Risk Management Framework — управление рисками ИИ на уровне процессов.
Что вы получаете
По итогам вы получаете отчёт с приоритизированным списком уязвимостей, воспроизведением каждой находки, оценкой бизнес-риска и понятными рекомендациями для команды разработки и ML-инженеров. После устранения проводим бесплатный повторный тест.
Пентест ИИ особенно важен, если ваш ассистент имеет доступ к данным клиентов, внутренним системам или может совершать действия от имени пользователя.