Отчет OpenAI об угрозах за июнь 2026 года: ИИ-агенты используются для вредоносной деятельности

OpenAI опубликовал Отчет об угрозах за июнь 2026 года, в котором анализируется, как AI-агенты и большие языковые модели используются в злонамеренных целях. Отчет охватывает кампании по дезинформации, массовый фишинг и мошенничество с помощью AI-агентов, с конкретными примерами и метриками.
Ключевые выводы
- Операции по дезинформации: Более десятка сетей были нейтрализованы, причем контент, созданный AI, был на 30% чаще, чем операции только с участием людей. AI-агенты создавали реалистичные персонажи и автоматизировали генерацию контента для влиятельных кампаний.
- Фишинг и мошенничество: AI-агенты обеспечили 40% всех фишинговых писем, обнаруженных в первом квартале 2026 года, при этом персонализированная генерация языка увеличила процент переходов по ссылкам на 15–20% по сравнению с атаками на основе шаблонов.
- Хищение учетных данных: Агенты генерировали поддельные страницы входа, имитирующие 50+ брендов, используя адаптацию в реальном времени для обхода обнаружения.
Технические детали для разработчиков
В отчете рекомендуется несколько мер по смягчению последствий для разработчиков, развертывающих AI-агентов:
- Ограничение скорости и обнаружение аномалий: Внедрите лимиты токенов на пользователя и отслеживайте необычные паттерны (например, внезапные всплески запросов к конечным точкам генерации контента). OpenAI обнаружил 12% вредоносного использования через объемные аномалии.
- Фильтрация выходных данных: Используйте конечную точку
Moderationдля проверки выходных данных модели на наличие разжигания ненависти, преследования или сигналов дезинформации перед доставкой. Внутренние фильтры OpenAI отметили 78% оскорбительных выходных данных. - Водяные знаки: Метаданные C2PA и невидимые водяные знаки помогли отследить 90% созданных AI фишинговых страниц до конкретных экземпляров модели.
Стратегии смягчения на практике
В отчете подробно описаны три кейса:
- Ботнет дезинформации: Сеть из 2000 AI-агентов создала более 500 000 постов за 48 часов на 10 социальных платформах. OpenAI нарушила их работу, выявив общие IP-кластеры и пересечение промптов.
- Целевой фишинг в масштабе: Агенты собирали профили LinkedIn и генерировали персонализированные письма, нацеленные на 10 000 руководителей. Обнаружение основывалось на ошибке выравнивания DMARC и анализе аномалий DNS.
- Поддельные агенты поддержки: AI-агенты имитировали чат-ботов поддержки на сайтах электронной коммерции для сбора платежной информации. Меры OpenAI: принудительная аутентификация пользователей через OAuth и лимиты на количество транзакций.
Что делать разработчикам
Если вы создаете AI-агентов, интегрируйте пакет openai-moderation и включите логирование активности через Usage Dashboard. Настройте оповещения о необычных паттернах запросов (например, более 1000 генераций в час с одного ключа API). Полный отчет содержит обновленные индикаторы угроз и рекомендуемый контрольный список безопасности.
📖 Читать полный источник: HN AI Agents
👀 Смотрите также

Киберпреступники дают отпор сгенерированному ИИ мусору на подпольных форумах
Новое исследование показывает, что хакеры низкого уровня и мошенники жалуются на посты, созданные ИИ, на киберпреступных форумах, считая их низкокачественным шумом, подрывающим доверие сообщества и социальное взаимодействие.
Израильский фейковый аналитический центр атакует ИИ-чатботов с помощью SEO-отравления
Израиль создал фейковый аналитический центр, Ганноверский институт, опубликовавший более 100 статей, оптимизированных для ИИ, чтобы влиять на чат-ботов, таких как Claude и Gemini. Статьи имитируют авторитетные отчеты аналитических центров с цитатами, вероятно, для формирования ответов ИИ о конфликте Израиля и Палестины.

Пользователь OpenClaw добавляет TOTP 2FA после того, как агент оставил API-ключи в открытом тексте.
Пользователь OpenClaw создал навык безопасности под названием 'Secure Reveal', который требует аутентификации по TOTP через Telegram перед отображением сохранённых учётных данных, после того как их ИИ-агент случайно раскрыл API-ключи и пароли в открытом тексте во время демонстрации.

Безопасность OpenClaw Slack: Риски утечки API-ключей и способы их устранения
Развертывания OpenClaw Slack могут раскрывать API-ключи через сообщения об ошибках в каналах, при этом в отчете Bitsight обнаружено более 8000 уязвимых экземпляров. В источнике подробно описаны три конкретные уязвимости и предложены практические исправления, включая модификацию системных промптов и миграцию на SlackClaw.