Отчет OpenAI об угрозах за июнь 2026 года: ИИ-агенты используются для вредоносной деятельности

✍️ OpenClawRadar📅 Опубликовано: 12 июня 2026 г.🔗 Source
Отчет OpenAI об угрозах за июнь 2026 года: ИИ-агенты используются для вредоносной деятельности
Ad

OpenAI опубликовал Отчет об угрозах за июнь 2026 года, в котором анализируется, как AI-агенты и большие языковые модели используются в злонамеренных целях. Отчет охватывает кампании по дезинформации, массовый фишинг и мошенничество с помощью AI-агентов, с конкретными примерами и метриками.

Ключевые выводы

  • Операции по дезинформации: Более десятка сетей были нейтрализованы, причем контент, созданный AI, был на 30% чаще, чем операции только с участием людей. AI-агенты создавали реалистичные персонажи и автоматизировали генерацию контента для влиятельных кампаний.
  • Фишинг и мошенничество: AI-агенты обеспечили 40% всех фишинговых писем, обнаруженных в первом квартале 2026 года, при этом персонализированная генерация языка увеличила процент переходов по ссылкам на 15–20% по сравнению с атаками на основе шаблонов.
  • Хищение учетных данных: Агенты генерировали поддельные страницы входа, имитирующие 50+ брендов, используя адаптацию в реальном времени для обхода обнаружения.

Технические детали для разработчиков

В отчете рекомендуется несколько мер по смягчению последствий для разработчиков, развертывающих AI-агентов:

  • Ограничение скорости и обнаружение аномалий: Внедрите лимиты токенов на пользователя и отслеживайте необычные паттерны (например, внезапные всплески запросов к конечным точкам генерации контента). OpenAI обнаружил 12% вредоносного использования через объемные аномалии.
  • Фильтрация выходных данных: Используйте конечную точку Moderation для проверки выходных данных модели на наличие разжигания ненависти, преследования или сигналов дезинформации перед доставкой. Внутренние фильтры OpenAI отметили 78% оскорбительных выходных данных.
  • Водяные знаки: Метаданные C2PA и невидимые водяные знаки помогли отследить 90% созданных AI фишинговых страниц до конкретных экземпляров модели.
Ad

Стратегии смягчения на практике

В отчете подробно описаны три кейса:

  1. Ботнет дезинформации: Сеть из 2000 AI-агентов создала более 500 000 постов за 48 часов на 10 социальных платформах. OpenAI нарушила их работу, выявив общие IP-кластеры и пересечение промптов.
  2. Целевой фишинг в масштабе: Агенты собирали профили LinkedIn и генерировали персонализированные письма, нацеленные на 10 000 руководителей. Обнаружение основывалось на ошибке выравнивания DMARC и анализе аномалий DNS.
  3. Поддельные агенты поддержки: AI-агенты имитировали чат-ботов поддержки на сайтах электронной коммерции для сбора платежной информации. Меры OpenAI: принудительная аутентификация пользователей через OAuth и лимиты на количество транзакций.

Что делать разработчикам

Если вы создаете AI-агентов, интегрируйте пакет openai-moderation и включите логирование активности через Usage Dashboard. Настройте оповещения о необычных паттернах запросов (например, более 1000 генераций в час с одного ключа API). Полный отчет содержит обновленные индикаторы угроз и рекомендуемый контрольный список безопасности.

📖 Читать полный источник: HN AI Agents

Ad

👀 Смотрите также

Киберпреступники дают отпор сгенерированному ИИ мусору на подпольных форумах
Безопасность

Киберпреступники дают отпор сгенерированному ИИ мусору на подпольных форумах

Новое исследование показывает, что хакеры низкого уровня и мошенники жалуются на посты, созданные ИИ, на киберпреступных форумах, считая их низкокачественным шумом, подрывающим доверие сообщества и социальное взаимодействие.

OpenClawRadar
🦀
Безопасность

Израильский фейковый аналитический центр атакует ИИ-чатботов с помощью SEO-отравления

Израиль создал фейковый аналитический центр, Ганноверский институт, опубликовавший более 100 статей, оптимизированных для ИИ, чтобы влиять на чат-ботов, таких как Claude и Gemini. Статьи имитируют авторитетные отчеты аналитических центров с цитатами, вероятно, для формирования ответов ИИ о конфликте Израиля и Палестины.

OpenClawRadar
Пользователь OpenClaw добавляет TOTP 2FA после того, как агент оставил API-ключи в открытом тексте.
Безопасность

Пользователь OpenClaw добавляет TOTP 2FA после того, как агент оставил API-ключи в открытом тексте.

Пользователь OpenClaw создал навык безопасности под названием 'Secure Reveal', который требует аутентификации по TOTP через Telegram перед отображением сохранённых учётных данных, после того как их ИИ-агент случайно раскрыл API-ключи и пароли в открытом тексте во время демонстрации.

OpenClawRadar
Безопасность OpenClaw Slack: Риски утечки API-ключей и способы их устранения
Безопасность

Безопасность OpenClaw Slack: Риски утечки API-ключей и способы их устранения

Развертывания OpenClaw Slack могут раскрывать API-ключи через сообщения об ошибках в каналах, при этом в отчете Bitsight обнаружено более 8000 уязвимых экземпляров. В источнике подробно описаны три конкретные уязвимости и предложены практические исправления, включая модификацию системных промптов и миграцию на SlackClaw.

OpenClawRadar