Искусственные интеллекты самостоятельно устанавливают защитные меры в открытом эксперименте.

✍️ OpenClawRadar📅 Опубликовано: 2 марта 2026 г.🔗 Source
Искусственные интеллекты самостоятельно устанавливают защитные меры в открытом эксперименте.
Ad

Экспериментальная установка

Разработчик запустил 5 ИИ-агентов на трёх машинах Apple Silicon с начала февраля, причём основную нагрузку взял на себя Claude. Агенты координируются через общую базу данных SQLite и JSON-файлы состояния, работая полностью на подписочных тарифах с нулевой стоимостью API.

Роли агентов включают: один пишет код (в основном Claude Opus и Sonnet в зависимости от сложности), один проверяет результаты других, один управляет контентом, один занимается операциями, а один проводит исследования.

Результаты открытого задания

Три недели назад вместо конкретных задач разработчик дал агентам открытое задание: проанализировать, с чем сталкиваются разработчики на Reddit, Hacker News и GitHub, разработать решение и создать рабочий прототип за ночь.

После 170+ прототипов 28 из них — созданных в разные ночи на основе совершенно разных входных данных — независимо пришли к одной и той же категории проблем: сканеры безопасности и контроль затрат. Агенты продолжали создавать защитные механизмы для себя.

Ad

Конкретные примеры, созданные Claude

  • Шифрующий слой для .env файлов: Обнаружив популярную тему на HN об утечке секретов в рабочих процессах ИИ-кодирования, Claude создал шифрующий слой, который сканирует на предмет утечек секретов перед коммитами за ночь.
  • Многоуровневый валидатор кода: В ответ на жалобы разработчиков о слиянии ИИ-сгенерированных PR без должной проверки, Claude создал валидатор, который оценивает, действительно ли PR безопасен для отправки, а не просто проходят ли тесты.
  • Инструмент экономии токенов с переписыванием на Rust: Claude создал инструмент, который строит графы зависимостей AST, чтобы определить, какие файлы агенту действительно нужны в контексте, достигнув значительного сокращения токенов. Затем он переписал основной модуль на Rust без запроса, оставив заметку с объяснением, почему это быстрее.

Ключевые наблюдения

Разработчик отмечает, что агенты достигли потолка, не связанного с генерацией кода — они могли создавать что угодно, но не могли проверять собственные результаты, контролировать свои затраты или ограничивать свою область доступа. Поэтому они создали инфраструктуру для этого самостоятельно.

Это отражает паттерны корпоративного программного обеспечения, где команды, получившие автономию без защитных механизмов, сначала создают свои собственные защитные механизмы. Claude в частности был наиболее последовательным в выявлении этих пробелов.

Вывод: проблема возможностей в основном решена (Claude Code, Cursor, Codex могут быстро генерировать код), но не хватает инфраструктуры делегирования, которая делает автономных агентов безопасными для производства.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

Пользователь OpenClaw сообщает о значительных улучшениях после перехода на аутентификацию OpenAI OAuth с использованием GPT-4.
Кейсы

Пользователь OpenClaw сообщает о значительных улучшениях после перехода на аутентификацию OpenAI OAuth с использованием GPT-4.

Разработчик, испытывавший трудности с моделями Kimi k2.5 и Minimax2.7 в OpenClaw, перешёл на OAuth-подключение OpenAI с GPT-4 и адаптивным мышлением, сообщив о немедленном улучшении стабильности и выполнении нескольких задач автоматизации за 4-5 часов.

OpenClawRadar
🦀
Кейсы

Создание мультиагентного ассистента OpenClaw на Raspberry Pi 5

Разработчик делится архитектурой JDM Assistant: OpenClaw как операционная система для мультиагентного персонального ассистента на Raspberry Pi 5, с отказоустойчивостью и защитными механизмами.

OpenClawRadar
Агент OpenClaw AI помогает команде спасти демо-день с помощью быстрого прототипа.
Кейсы

Агент OpenClaw AI помогает команде спасти демо-день с помощью быстрого прототипа.

Команда разработчиков использовала ИИ-агент OpenClaw, чтобы создать работающий демо-сайт с тестовыми данными за 10 минут после того, как их смена продукта поставила под угрозу участие в демо-дне South Park Commons.

OpenClawRadar
Создание персональной OS для Клода с долговременной памятью: психологический профиль, цели и контекст в реальном времени через Notion + Shortcuts
Кейсы

Создание персональной OS для Клода с долговременной памятью: психологический профиль, цели и контекст в реальном времени через Notion + Shortcuts

Разработчик создал постоянную персональную ОС в Notion, которая внедряет сжатый психологический профиль из 800 слов, цели, отношения и живой контекст (местоположение, время, календарь, погоду) в каждый вызов API Claude через iOS Shortcuts, с ночным циклом подведения итогов для поддержания контекста актуальным.

OpenClawRadar