Отчет OpenAI об угрозах за июнь 2026 года: ИИ-агенты используются для вредоносной деятельности

✍️ OpenClawRadar📅 Опубликовано: 12 июня 2026 г.🔗 Source
Отчет OpenAI об угрозах за июнь 2026 года: ИИ-агенты используются для вредоносной деятельности
Ad

OpenAI опубликовал Отчет об угрозах за июнь 2026 года, в котором анализируется, как AI-агенты и большие языковые модели используются в злонамеренных целях. Отчет охватывает кампании по дезинформации, массовый фишинг и мошенничество с помощью AI-агентов, с конкретными примерами и метриками.

Ключевые выводы

  • Операции по дезинформации: Более десятка сетей были нейтрализованы, причем контент, созданный AI, был на 30% чаще, чем операции только с участием людей. AI-агенты создавали реалистичные персонажи и автоматизировали генерацию контента для влиятельных кампаний.
  • Фишинг и мошенничество: AI-агенты обеспечили 40% всех фишинговых писем, обнаруженных в первом квартале 2026 года, при этом персонализированная генерация языка увеличила процент переходов по ссылкам на 15–20% по сравнению с атаками на основе шаблонов.
  • Хищение учетных данных: Агенты генерировали поддельные страницы входа, имитирующие 50+ брендов, используя адаптацию в реальном времени для обхода обнаружения.

Технические детали для разработчиков

В отчете рекомендуется несколько мер по смягчению последствий для разработчиков, развертывающих AI-агентов:

  • Ограничение скорости и обнаружение аномалий: Внедрите лимиты токенов на пользователя и отслеживайте необычные паттерны (например, внезапные всплески запросов к конечным точкам генерации контента). OpenAI обнаружил 12% вредоносного использования через объемные аномалии.
  • Фильтрация выходных данных: Используйте конечную точку Moderation для проверки выходных данных модели на наличие разжигания ненависти, преследования или сигналов дезинформации перед доставкой. Внутренние фильтры OpenAI отметили 78% оскорбительных выходных данных.
  • Водяные знаки: Метаданные C2PA и невидимые водяные знаки помогли отследить 90% созданных AI фишинговых страниц до конкретных экземпляров модели.
Ad

Стратегии смягчения на практике

В отчете подробно описаны три кейса:

  1. Ботнет дезинформации: Сеть из 2000 AI-агентов создала более 500 000 постов за 48 часов на 10 социальных платформах. OpenAI нарушила их работу, выявив общие IP-кластеры и пересечение промптов.
  2. Целевой фишинг в масштабе: Агенты собирали профили LinkedIn и генерировали персонализированные письма, нацеленные на 10 000 руководителей. Обнаружение основывалось на ошибке выравнивания DMARC и анализе аномалий DNS.
  3. Поддельные агенты поддержки: AI-агенты имитировали чат-ботов поддержки на сайтах электронной коммерции для сбора платежной информации. Меры OpenAI: принудительная аутентификация пользователей через OAuth и лимиты на количество транзакций.

Что делать разработчикам

Если вы создаете AI-агентов, интегрируйте пакет openai-moderation и включите логирование активности через Usage Dashboard. Настройте оповещения о необычных паттернах запросов (например, более 1000 генераций в час с одного ключа API). Полный отчет содержит обновленные индикаторы угроз и рекомендуемый контрольный список безопасности.

📖 Читать полный источник: HN AI Agents

Ad

👀 Смотрите также

Агент ИИ использует SQL-инъекцию для взлома чат-бота McKinsey Lilli
Безопасность

Агент ИИ использует SQL-инъекцию для взлома чат-бота McKinsey Lilli

Исследователи безопасности из CodeWall использовали автономного ИИ-агента для взлома внутреннего чат-бота Lilli компании McKinsey, получив полный доступ на чтение и запись к его производственной базе данных за два часа через уязвимость SQL-инъекции в незащищённых API-эндпоинтах.

OpenClawRadar
ThornGuard: Прокси-шлюз для защиты подключений к серверам MCP от инъекций в промпты
Безопасность

ThornGuard: Прокси-шлюз для защиты подключений к серверам MCP от инъекций в промпты

ThornGuard — это прокси, который располагается между клиентами MCP и вышестоящими серверами, сканирует трафик на наличие шаблонов внедрения, удаляет персональные данные и ведёт логирование в панели управления. Он был создан после того, как тестирование выявило уязвимости, позволяющие серверам встраивать скрытые инструкции в ответы инструментов.

OpenClawRadar
Предупреждение о безопасности: Скрипт ClawProxy похитил API-ключи, что привело к значительному счету от OpenRouter
Безопасность

Предупреждение о безопасности: Скрипт ClawProxy похитил API-ключи, что привело к значительному счету от OpenRouter

Разработчик установил закрытый исходный код скрипта ClawProxy от пользователя Reddit на изолированную систему WSL Ubuntu 24.04, который украл его ключ API OpenRouter и использовал его через Google Vertex API, чтобы накрутить крупный счёт на Opus 4.6 за ночь.

OpenClawRadar
Умный Bash-хук для контроля прав Claude Code предотвращает обход составных команд
Безопасность

Умный Bash-хук для контроля прав Claude Code предотвращает обход составных команд

Python-хук PreToolUse устраняет уязвимость в системе разрешений Claude Code, где составные bash-команды могли обходить шаблоны разрешения/запрета. Скрипт разбивает команды на подкоманды и проверяет каждую отдельно по существующим правилам разрешений.

OpenClawRadar