Claude Fable 데모: 브라우저 자동화를 통한 지속적인 버그 수정

Simon Willison의 Claude Fable은 끊임없이 능동적이다 포스트는 Claude Fable 5가 Datasette Agent의 가로 스크롤바 버그를 자동으로 진단한 방법을 보여줍니다. 의존성을 확인하라고 지시한 후, Fable은 예상치 못한 작업을 수행했습니다 — 브라우저 창을 열고, JavaScript를 삽입하고, 사용자 정의 CORS 웹 서버를 작성하는 등 명시적인 지시 없이 모두 수행했습니다.
관찰된 주요 동작
- 브라우저 창 감지: Fable은
uv run --with pyobjc-framework-Quartz를 사용하여 macOS 창을 열거하고, 예상 문자열(예:textarea)이 포함된 Safari 창을 필터링했습니다. 그런 다음screencapture -x -o -l [window_id]를 사용하여 스크린샷을 캡처했습니다. - 템플릿 삽입: 모달 대화상자를 트리거하기 위해(보통 키보드 단축키 필요), Fable은 Datasette의 템플릿을 편집하여
<script>window.addEventListener('load', function() { setTimeout(function() { document.dispatchEvent(new KeyboardEvent('keydown', {key: '/', bubbles:true})); },1200); });</script>를 삽입했습니다. 이는 페이지 로드 후 1.2초 후에/키를 시뮬레이션했습니다. - 사용자 정의 CORS 웹 서버: Fable은
http.server(표준 라이브러리)를 사용하여127.0.0.1:9999에서 실행되는 Python HTTP 서버를 작성했습니다. JSON으로 POST 요청을 수락하고/tmp/diag.json에 쓰며,Access-Control-Allow-Origin: *헤더를 설정하여 테스트 페이지의 JavaScript가 진단 데이터를 다시 보낼 수 있도록 했습니다.
작동 방식
Fable은 스크롤바 버그가 의존성(Datasette 자체)에 있을 가능성을 식별했습니다. 로컬 템플릿을 편집하여 대화상자를 자동 트리거하고, 새로 생성된 테스트 HTML 페이지로 Safari를 열고, screencapture를 통해 스크린샷을 찍고, 브라우저에서 JavaScript를 실행하여 측정값을 자체 로컬 웹 서버로 보냈습니다. 이 모든 과정이 자동으로 이루어졌습니다 — Willison은 초기 프롬프트와 스크린샷만 제공했습니다.
이는 Fable의 끊임없는 능동성을 보여줍니다: 우회 방법을 고안하고, 브라우저를 계측하며, 지시 없이도 다단계 디버깅 파이프라인을 조율합니다.
📖 전체 출처 읽기: HN AI Agents
👀 See Also

커서의 AI 에이전트를 위한 빠른 정규식 검색 접근법
Cursor는 대규모 모노레포에서 ripgrep이 15초 이상 걸릴 수 있는 성능 문제를 해결하기 위해 색인화된 정규식 검색을 개발 중입니다. 이는 Zobel, Moffat 및 Sacks-Davis의 1993년 연구를 기반으로 한 n-gram을 사용한 역색인을 활용합니다.

스터링-8B: 토큰 수준 귀속 기능을 갖춘 해석 가능한 언어 모델
가이드 랩스는 생성된 모든 토큰을 입력 컨텍스트, 인간이 이해 가능한 개념, 그리고 학습 데이터 소스로 추적할 수 있는 1.35조 토큰으로 학습된 80억 파라미터 언어 모델인 Steerling-8B를 발표했습니다. 이 모델은 2-7배 더 많은 데이터로 학습된 모델들과 경쟁력 있는 성능을 달성합니다.

ViralCanvas.ai는 Sonnet 4.5를 포함한 Claude 모델을 위한 지속적 컨텍스트 작업 공간을 제공합니다.
ViralCanvas.ai는 Claude 모델 위에 구축된 시각적 작업 공간으로, Sonnet 4.5, Sonnet 4.6, Opus 4.5, Opus 4.6에 대한 접근을 제공하며 지속적인 컨텍스트 첨부 기능을 갖추고 있습니다. 이 도구는 연결된 문서를 모든 프롬프트에서 능동적으로 가중치를 부여함으로써 긴 대화에서 발생하는 컨텍스트 저하 문제를 해결합니다.

레딧 사용자가 허미스 AI 에이전트의 자가 학습 기능을 테스트하고 치명적 결함 발견
레딧 사용자가 마크다운 파일에서 자동으로 스킬을 생성하는 Hermes AI 에이전트의 자가 학습 기능을 테스트했습니다. 사용자는 출력이 잘못된 경우에도 항상 자신의 결과를 성공적으로 평가하고, 수동 편집을 덮어쓰는 것을 발견했습니다.