Защита языковой модели отличается от защиты обычного веб-приложения одной принципиальной особенностью: пользовательский ввод для LLM — это не только данные, но и потенциальная инструкция. В обычном приложении строка остаётся строкой. В LLM пользовательский текст интерпретируется самой моделью…
FlautGuard: как мы построили многоуровневую защиту LLM от prompt injection и утечек данных
Это краткое изложение. Полный текст материала доступен на сайте источника.