에이전트 팩토리: 온라인 문제 토론에서 AI 에이전트를 구축하는 자율 시스템

에이전트 팩토리는 온라인 토론에서 실제 문제를 식별하여 AI 에이전트를 구축하는 자율 시스템입니다. Andrej Karpathy의 자동 연구 패턴에서 영감을 받아, ML 최적화가 아닌 아이디어 생성에 '밤새 실험을 실행하고, 효과가 있는 것은 유지하며, 효과가 없는 것은 버리는' 동일한 접근 방식을 적용합니다.
작동 방식
이 시스템은 Reddit, Hacker News, GitHub, Twitter에서 사람들이 온라인에서 논의하는 실제 문제를 수집합니다. 각 잠재적 아이디어를 세 가지 기준(수요, 시장 격차, 실행 가능성)으로 평가합니다. 아이디어가 품질 기준을 통과하면, 시스템은 자동으로 독립형 AI 에이전트를 구축하고 작동을 검증한 후 커밋합니다. 기준은 각 구축마다 점진적으로 높아져 점점 더 나은 아이디어를 요구합니다.
실제 구현
이 프로젝트는 세 가지 핵심 파일로 구성됩니다:
program.md- Claude Code에게 어디서 연구할지와 어떤 품질 기준을 충족해야 하는지 알려줍니다seed/- 7개의 도구가 포함된 최소한의 Next.js 템플릿run.sh- Claude Code를 헤드리스 모드로 실행하고 컨텍스트 제한 시 자동 재시작합니다
이 시스템은 TypeScript로 구축되었으며, MIT 라이선스를 사용하고 OpenRouter 또는 Ollama에서 실행됩니다. 특히 LangChain 및 CrewAI 프레임워크를 피합니다. 생성된 각 에이전트는 독립적이며 복제하여 독립적으로 실행할 수 있습니다.
예시 출력
첫 번째 세션에서 시스템은 다음과 같은 20개의 에이전트를 생성했습니다:
freelancer-deduction-finder- 프리랜서가 놓친 세금 공제에 대해 질문하는 경우wage-rights-advisor- 초과 근무 면제에 대해 혼란스러워하는 사람들을 위한data-broker-opt-out- 데이터 브로커 옵트아웃에 압도된 사람들을 위한
품질 검증
시스템은 각 에이전트를 부팅하고 테스트 프롬프트를 전송한 후 출력이 유용한지 확인합니다. 그러나 창작자는 이들이 MVP이며 일부는 거칠다는 점을 인정합니다. 주요 목적은 아이디어 생성입니다. 창작자는 매일 아침 배송된 에이전트를 검토하고 가장 유망한 것을 실제 프로젝트로 추가 개발하기 위해 선택합니다.
📖 Read the full source: r/ClaudeAI
👀 See Also

메타, 뮤즈 스파크 1.2 모델과 함께 뮤즈 코드 출시
메타의 새로운 Muse Code 터미널 코딩 에이전트는 Muse Spark 1.2로 구동되며, 비동기 백그라운드 에이전트, 재생 가능한 런타임, 장기 코딩 기능을 제공합니다.

스킬스게이트: AI 코딩 에이전트 스킬을 위한 오픈소스 마켓플레이스
SkillsGate는 Claude Code, Cursor, Windsurf와 같은 AI 코딩 에이전트를 위한 45,000개 이상의 스킬을 인덱싱하는 오픈 소스 마켓플레이스입니다. 벡터 임베딩을 통한 의미론적 검색과 npx를 통한 원-커맨드 설치를 제공합니다.

Claude Code v2.1.176: 언어 인식 세션, Bedrock 자격 증명 캐싱, 수십 가지 수정 사항
세션 제목이 이제 대화 언어와 일치합니다. Bedrock 자격 증명이 만료될 때까지 캐시됩니다. /fast 및 환경 변수에 대한 모델 제한 우회가 수정되었습니다. tmux 클립보드 수정, 샌드박스 심볼릭 링크 수정.

클로드 코드 스킬은 딥마인드 알레테이아와 앤트로픽 하네스 접근법을 결합한 것입니다.
Claude Code 스킬은 Planner→Generator→Evaluator→Reviser 파이프라인을 구현하여 DeepMind의 Aletheia 수학 연구 에이전트와 Anthropic의 다중 에이전트 코딩 아키텍처를 결합합니다. 여기에 '블라인드 사전 분석'을 추가했는데, 평가자가 후보 코드를 보기 전에 올바른 접근 방식에 대해 추론하는 방식입니다.