В репозитории GitHub представлены документы, описывающие 16 методов инъекции промптов и стратегии защиты для публичных AI-чатов.

Разработчик создал пользовательский AI-чат на своём сайте в качестве эксперимента и столкнулся с множеством проблем безопасности, когда реальные пользователи попытались его взломать. Этот опыт побудил его создать подробное руководство по безопасности, доступное на GitHub.
Проблемы безопасности, с которыми столкнулись
Пользователи пытались использовать различные атаки, включая:
- Инъекцию промптов
- Атаки через ролевые игры
- Многоязычные уловки
- Полезные нагрузки в кодировке base64
Реализованные стратегии защиты
Разработчик задокументировал подход «защита в глубину», охватывающий:
- Санацию ввода
- Ограничение частоты запросов
- Дизайн системного промпта с нулевым доверием
- Контроль вывода
- Ограничения по стоимости
Содержимое репозитория на GitHub
Репозиторий включает:
- Разбор 16 техник инъекции промптов
- Навык кода Claude, который автоматически тестирует все 16 техник на вашем чат-боте
- Полные детали реализации защиты
Разработчик отмечает, что пользователи пробовали вещи, которые он «никогда бы не додумался протестировать», и что руководство предназначено для всех, кто внедряет похожие публичные системы AI-чатов.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также
Попытка инъекции промптов в OpenClaw 2026.9.2: как это произошло и какие выводы сделать
Злоумышленник отправил payload для prompt-инъекции в WhatsApp-канал OpenClaw, но собственный детектор агента раскрыл его. Никакого ущерба не было — кроме пары greps в режиме чтения. Что мы можем узнать о структурных границах доверия?

Microsoft с открытым исходным кодом взломаны: вредоносное ПО для кражи паролей атакует репозитории AI-разработчиков
Хакеры внедрили кражу паролей в как минимум 70 репозиториев Microsoft на GitHub, нацелившись на AI-разработчиков, использующих Claude Code, Gemini CLI и VS Code. Это повторная компрометация проекта Durable Task.

Fil-C делает setjmp/longjmp и ucontext безопасными для памяти
Fil-C реализует setjmp/longjmp и ucontext API без повреждения стека или висящих указателей, предотвращая распространенные ошибки, ведущие к сбоям или уязвимостям.
