OpenClaw 개발자, Uber 및 레스토랑 예약 자동화로 AI 에이전트 돌파구 마련

OpenClaw 개발자가 브라우저 자동화에서 상당한 진전을 이루었습니다. 이전에는 AI 에이전트가 실제 웹사이트와 상호작용하는 것을 막았던 한계를 넘어서, 이제 개발자는 스크립트된 데모 없이도 실제 사이트에서 복잡한 작업을 자율적으로 완료할 수 있는 에이전트를 성공적으로 만들었습니다.
현재 실제로 작동하는 것
개발자는 두 가지 주요 플랫폼에서 전체 흐름을 성공적으로 완료하는 데 성공했습니다:
- 우버: 에이전트가 앱을 열고, 픽업 및 목적지 위치를 입력하며, 택시 유형을 선택하고, 확인 화면까지 도달합니다.
- 레스토랑 예약: 에이전트가 레스토랑을 찾고, 예약 양식을 작성하며, 예약을 확정합니다.
이것들은 스크립트된 데모가 아닙니다. 에이전트는 실제 웹사이트를 탐색하고, 동적 요소를 처리하며, 봇 탐지 시스템을 성공적으로 우회합니다.
현재 기술 스택
작동하는 솔루션은 여러 통합된 구성 요소로 이루어져 있습니다:
- 지속적인 프로필과 지문 인식을 갖춘 스텔스 브라우저
- 주거용 프록시 라우팅
- CAPTCHA 해결 통합
개발자는 이것이 기능적이지만 아직 완성된 제품은 아니라고 언급했습니다. 현재는 "수동 설정이 필요한 여러 조각들을 임시로 연결한 상태"입니다.
개발 방향과 커뮤니티 의견
개발자는 이 개념 증명을 모든 OpenClaw 사용자가 사용할 수 있는 것으로 변환하고 싶어하지만, "이상적인" 버전을 구축하기 전에 커뮤니티 피드백을 구하고 있습니다. 장기적인 비전은 "스킬을 설치하면, 에이전트가 저장된 세션과 함께 완전한 브라우저 환경을 얻어 웹에서 자율적으로 작업을 수행할 수 있게 되는 것"입니다.
즉각적인 개발을 위해, 개발자는 커뮤니티에 구체적인 질문을 하고 있습니다:
- 브라우저 한계로 인해 어떤 구체적인 자동화 작업이 실패했나요?
- 에이전트가 사용할 수 있기를 바라는 사이트/서비스는 무엇인가요? (우버, 에어비앤비, 링크드인, 정부 포털, 음식 배달 등)
- 현재 가장 유용한 형식은 무엇인가요?
개발자는 커뮤니티 검토를 위해 여러 형식 옵션을 제시합니다:
- a) 에이전트에게 스텔스 브라우저를 제공하는 OpenClaw 스킬
- b) VPS에서 실행하고 에이전트에 연결하는 독립 실행형 도구
- c) 기본적으로 탐지 방지, 세션, 지문 인식을 처리하는 데스크톱 브라우저 앱
- d) 직접 조각들을 연결할 수 있도록 하는 설정 가이드
- e) 다른 것
개발자는 또한 사용자들이 VPS 요구사항을 수용할지, 아니면 로컬 머신 기능이 필요한지 묻습니다.
📖 전체 원문 읽기: r/openclaw
👀 See Also

C# 및 로컬 LLM으로 자율 연구 에이전트 구축하기
C# 연구 에이전트는 Ollama와 llama3.1:8b를 사용하여 로컬 LLM으로 URL 처리를 자동화하고, 웹 검색에서 구조화된 마크다운 보고서를 생성합니다.

EsoLang-Bench: LLM 추론 능력을 테스트하기 위한 난해한 프로그래밍 언어를 활용한 코딩 벤치마크
연구진은 브레인퍽(Brainfuck)과 화이트스페이스(Whitespace) 같은 난해한 프로그래밍 언어를 사용해 LLM이 진짜로 추론하는지 아니면 단순히 패턴 매칭을 하는지 테스트하는 코딩 벤치마크인 EsoLang-Bench를 만들었습니다. GPT-5.2, O4-mini, Gemini, Qwen, Kimi 중 가장 좋은 결과는 11.2%였습니다.

MCP 서버는 쿠키와 인증 정보를 사용하여 AI 에이전트를 기존 Chrome 세션에 연결합니다.
@playwright-repl/mcp는 Dramaturg 확장 프로그램을 통해 AI 에이전트가 기존 Chrome 브라우저에 연결할 수 있는 MCP 서버로, 쿠키와 인증을 포함한 실제 브라우저 세션에 접근할 수 있습니다. 전체 Playwright JavaScript와 어설션을 지원하며 Claude Desktop, Claude Code, Cursor 또는 모든 MCP 클라이언트와 함께 작동합니다.

Codev: 14일 동안 106개의 PR을 처리한 AI 에이전트 워크플로우
Codev는 엄격한 Spec→Plan→Implement→Review→PR 워크플로우를 통해 여러 AI 에이전트를 조정하는 오픈소스 시스템으로, 출시 전 20개의 버그를 발견하고 10점 만점 기준 1.2점 더 높은 평가를 받은 코드를 생산합니다.