LLM Guardrails
Также: охранные рельсы LLM, ограничители языковой модели, guardrails AI, LLM safety filters, барьеры безопасности LLM
LLM Guardrails - набор механизмов, ограничивающих поведение языковой модели в рамках допустимого для конкретной системы. Они работают на двух уровнях: на входе - фильтруют запросы, блокируя попытки обойти ограничения или получить служебную информацию; на выходе - проверяют ответ перед отдачей, предотвращая утечку чувствительных данных и выход за пределы заданной области знаний. В агентных сценариях guardrails дополнительно контролируют, какие инструменты и действия модель вправе инициировать.
Статьи с этим термином · 5
- Может ли ИИ выдать чужие персональные данные: галлюцинации и приватные модели · 11 августа 2026
- Сотрудник загрузил базу клиентов в чат-бот: как это перехватить · 7 августа 2026
- Threat model LLM-агента после OWASP Top-10 2026: два вектора и OPA-guardrails · 24 марта 2026
- AI-агент для инфраструктурных операций: пилот GigaChat + Ansible с guardrails · 19 июня 2025
- LLM-агент на IT-хелпдеске: первый месяц в проде · 30 января 2025