오픈클로 AI 에이전트에 대한 하드 가드레일 강제: 승인 게이팅 및 동시성 제한

✍️ OpenClawRadar📅 게시일: August 1, 2026🔗 Source
오픈클로 AI 에이전트에 대한 하드 가드레일 강제: 승인 게이팅 및 동시성 제한
Ad

Mac mini에서 Ollama(GLM 5.2, 폴백 Anthropic Sonnet 4.6 및 Haiku)로 OpenClaw 봇을 실행하는 개발자가 전형적인 문제에 직면했습니다: 봇이 "승인 없이 이메일 보내지 않기" 및 "최대 5개 동시 호출"과 같은 하드 규칙을 매번 이해를 확인함에도 불구하고 반복적으로 위반합니다. 사용자의 가설은 정확합니다: 이것은 컨텍스트로서의 규칙이지 제약으로서의 규칙이 아닙니다. 모델은 지침을 권고로 처리하므로 프롬프팅이나 메모리 강화로는 해결되지 않습니다.

표준 해결책은 적용을 모델의 추론 루프 외부로 이동하는 것입니다. 통계적 텍스트 예측기에 하드 제한을 적용하도록 의존할 수 없습니다. 오케스트레이션 계층에서 결정적 검사가 필요합니다.

도구 호출에 대한 승인 게이팅

이메일(또는 위험한 작업)을 승인 뒤로 게이트하려면 도구 호출을 인간-인-더-루프 패턴으로 래핑하세요:

  • 모델이 이메일 전송을 요청하면 실행 전에 호출을 가로챕니다.
  • Discord에서 확인 프롬프트를 표시합니다(예: 버튼 또는 반응).
  • 사용자가 승인한 경우에만 실제 API 호출을 실행합니다.
# OpenClaw 도구 핸들러의 의사 코드
if tool == "send_email":
    message = f"다음으로 이메일 전송을 승인하시겠습니까? {to}"
    if not await discord_approval(message):
        return "사용자가 거부했습니다. 보내지 마세요."
    # 이메일 API 호출 진행

이렇게 하면 모델이 말로 무엇을 하든 물리적으로 게이트를 우회할 수 없습니다.

Ad

오케스트레이션 수준의 동시성 제한

"최대 5"와 같은 동시성 제한의 경우 명령 디스패처에 세마포어 또는 카운터를 구현하세요:

import asyncio
semaphore = asyncio.Semaphore(5)

async def handle_tool_call(tool, args): async with semaphore: # 도구 호출 실행

제한을 초과하는 모든 시도는 모델 의도와 관계없이 대기하거나 즉시 실패합니다.

이것이 GLM/Ollama 특정 문제인가요?

사용자는 이것이 GLM에 특정한지 아니면 로컬 모델에 일반적인지 묻습니다. r/openclaw 토론에 따르면 이는 일반적인 LLM 한계입니다—모든 모델은 지침을 컨텍스트로 처리하지 제약으로 처리하지 않습니다. 프롬프팅만으로는 하드 제한을 적용할 수 없습니다. 해결책은 항상 인프라 수준의 적용을 필요로 합니다.

권장 사항

메모리나 스킬에 규칙을 다시 진술하는 것을 중지하세요. 대신 도구 호출 계층에 명시적 검사를 구축하세요. 모델을 정책 집행자가 아닌 제안 엔진으로 취급하세요.

📖 전체 소스 읽기: r/openclaw

Ad

👀 See Also

CLAUDE.md 항목: 오푸스 4.7의 인간적 속도 조절 동작 비활성화
Tips

CLAUDE.md 항목: 오푸스 4.7의 인간적 속도 조절 동작 비활성화

긴 코딩 세션 중 Claude 4.7 Opus의 휴식 제안, 시간 과대 추정, 단계 분할을 억제하는 세 가지 CLAUDE.md 지시문.

OpenClawRadar
모든 프롬프트에 모든 MCP 서버를 로딩하면 조용히 토큰 예산이 소진된다
Tips

모든 프롬프트에 모든 MCP 서버를 로딩하면 조용히 토큰 예산이 소진된다

5~6개의 MCP 서버를 사용하는 한 사용자는 각 프롬프트가 모든 서버를 로드하여 막대한 토큰 낭비를 초래한다는 사실을 발견했습니다. 관련 서버만 로드하는 라우팅 레이어를 구현함으로써 토큰 사용량이 크게 줄고 응답 시간이 개선되었습니다.

OpenClawRadar
Claude Code와 AI 에이전트를 위한 HTML의 비합리적인 효율성
Tips

Claude Code와 AI 에이전트를 위한 HTML의 비합리적인 효율성

바이럴 게시물은 AI 코딩 에이전트(Claude Code 등)가 HTML을 생성하도록 지시할 때 더 나은 결과를 제공한다는 사실을 보여줍니다. 실제 작동하는 예제와 함께 패턴을 논의하는 블로그 게시물이 포함되어 있습니다.

OpenClawRadar
디자인 시스템으로 Claude Code의 CSS 추측 작업을 수정하는 방법
Tips

디자인 시스템으로 Claude Code의 CSS 추측 작업을 수정하는 방법

한 개발자가 Claude Code를 사용하여 주식 분석 대시보드를 구축하면서 흔히 겪는 좌절을 경험했습니다: AI가 동일하게 정렬이 틀어진 div에 대해 반복적으로 깨진 CSS를 생성한 것입니다. 6번의 반복 동안 패딩 수정, flex에서 grid로 전환, 그리고 `overflow: hidden` 추가 시도는 실패하거나 문제를 더 악화시켰습니다.

OpenClawRadar