Guardrails
Защитные механизмы для AI-агентов
PII Detection
Обнаружение персональных данных (ФИО, телефоны, email, паспортные данные, ИНН) во входящих сообщениях.
Prompt Injection Protection
Защита от попыток манипуляции промптом через инъекции в пользовательском вводе.
Topic Restriction
Ограничение тем разговора. Агент отвечает только на вопросы по заданным темам.
Toxicity Filter
Фильтрация токсичного, оскорбительного и неприемлемого контента в ответах.
Hallucination Check
Проверка ответов на галлюцинации путём сверки с источниками в базе знаний.
Fact Verification
Верификация фактов в ответе путём проверки в доверенных источниках.
JSON Format Validation
Проверка, что ответ является валидным JSON согласно заданной схеме.
Keyword Blocker
Блокировка ответов, содержащих запрещённые ключевые слова.
Regex Output Filter
Фильтрация вывода по регулярным выражениям для удаления нежелательных паттернов.
Rate Limiter
Ограничение частоты вызовов инструментов для предотвращения злоупотреблений.
Database Permission Check
Проверка прав доступа перед выполнением запросов к базам данных.
SQL Injection Prevention
Кастомный guardrail для предотвращения SQL-инъекций в запросах к БД.