В репозитории GitHub представлены документы, описывающие 16 методов инъекции промптов и стратегии защиты для публичных AI-чатов.

✍️ OpenClawRadar📅 Опубликовано: 10 марта 2026 г.🔗 Source
В репозитории GitHub представлены документы, описывающие 16 методов инъекции промптов и стратегии защиты для публичных AI-чатов.
Ad

Разработчик создал пользовательский AI-чат на своём сайте в качестве эксперимента и столкнулся с множеством проблем безопасности, когда реальные пользователи попытались его взломать. Этот опыт побудил его создать подробное руководство по безопасности, доступное на GitHub.

Проблемы безопасности, с которыми столкнулись

Пользователи пытались использовать различные атаки, включая:

  • Инъекцию промптов
  • Атаки через ролевые игры
  • Многоязычные уловки
  • Полезные нагрузки в кодировке base64

Реализованные стратегии защиты

Разработчик задокументировал подход «защита в глубину», охватывающий:

  • Санацию ввода
  • Ограничение частоты запросов
  • Дизайн системного промпта с нулевым доверием
  • Контроль вывода
  • Ограничения по стоимости
Ad

Содержимое репозитория на GitHub

Репозиторий включает:

  • Разбор 16 техник инъекции промптов
  • Навык кода Claude, который автоматически тестирует все 16 техник на вашем чат-боте
  • Полные детали реализации защиты

Разработчик отмечает, что пользователи пробовали вещи, которые он «никогда бы не додумался протестировать», и что руководство предназначено для всех, кто внедряет похожие публичные системы AI-чатов.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

🦀
Безопасность

Попытка инъекции промптов в OpenClaw 2026.9.2: как это произошло и какие выводы сделать

Злоумышленник отправил payload для prompt-инъекции в WhatsApp-канал OpenClaw, но собственный детектор агента раскрыл его. Никакого ущерба не было — кроме пары greps в режиме чтения. Что мы можем узнать о структурных границах доверия?

OpenClawRadar
Microsoft с открытым исходным кодом взломаны: вредоносное ПО для кражи паролей атакует репозитории AI-разработчиков
Безопасность

Microsoft с открытым исходным кодом взломаны: вредоносное ПО для кражи паролей атакует репозитории AI-разработчиков

Хакеры внедрили кражу паролей в как минимум 70 репозиториев Microsoft на GitHub, нацелившись на AI-разработчиков, использующих Claude Code, Gemini CLI и VS Code. Это повторная компрометация проекта Durable Task.

OpenClawRadar
Fil-C делает setjmp/longjmp и ucontext безопасными для памяти
Безопасность

Fil-C делает setjmp/longjmp и ucontext безопасными для памяти

Fil-C реализует setjmp/longjmp и ucontext API без повреждения стека или висящих указателей, предотвращая распространенные ошибки, ведущие к сбоям или уязвимостям.

OpenClawRadar
Защита бюджета на AI: почему стоит использовать предоплаченную карту с OpenClaw
Безопасность

Защита бюджета на AI: почему стоит использовать предоплаченную карту с OpenClaw

r/moltbot community