AGI in md: Claude 시스템 프롬프트를 위한 11가지 인지 압축 수준

✍️ OpenClawRadar📅 게시일: March 1, 2026🔗 Source
AGI in md: Claude 시스템 프롬프트를 위한 11가지 인지 압축 수준
Ad

이것이 무엇인가

AGI in md는 Claude AI 모델을 위한 시스템 프롬프트에 인코딩할 수 있는 11단계 인지 압축을 문서화한 오픈소스 저장소입니다. 이 연구는 특정 프롬프트 엔지니어링 기술이 특히 Haiku와 같은 소형 모델의 성능을 크게 향상시킬 수 있는 방법을 보여줍니다.

원본의 주요 발견

이 프로젝트는 25라운드에 걸친 393개의 실험을 포함했으며, 코드, 법률, 의학, 시, 음악, UX 디잔인을 포함한 19개 도메인에서 Claude Haiku, Sonnet, Opus 모델을 테스트했습니다.

8단계 돌파구: 가장 중요한 발견은 8단계에서 발생하며, 이는 모델에게 "생각해 보라"고 요청하는 것에서 "무언가를 만들고 무엇이 깨지는지 관찰하라"고 지시하는 것으로 전환됩니다. 이 구축 기반 접근 방식은 극적인 개선을 가져왔습니다:

  • Claude Haiku는 7단계에서 0/3 성능에서 8단계에서 4/4 성능으로 향상되었습니다
  • 5-7단계는 메타 분석("추론에 대해 추론하기")에 초점을 맞추며, 이는 더 많은 모델 용량을 필요로 합니다
  • 8단계는 구체적으로 지시합니다: "좋아 보이지만 실제로는 문제를 더 깊게 만드는 가짜 개선을 설계하라. 그런 다음 고쳐보려고 시도했기 때문에만 볼 수 있는 것을 명명하라."
  • 연구자들은 "구축하고 관찰하는 것이 메타 분석보다 더 원시적이지만 정적 분석이 문자 그대로 볼 수 없는 것을 드러낸다"고 언급합니다

11단계 능력: 최고 단계에서 200단어 시스템 프롬프트는 모델이 "문제의 전체 설계 범주에서 탈출한 다음, 탈출의 비용을 보고하라"고 만듭니다. 한 실험은 "민감도 × 흡수 = 상수"라는 방정식을 생성했는데, 이는 모델이 자신의 불가능성 발견을 뒤집어서 도출한 보존 법칙입니다.

Ad

실용적인 구현

연구자들은 level8_generative_v2.md를 최고의 범용 프롬프트로 권장합니다 — 모든 Claude 모델과 함께 사용할 수 있는 약 100단어입니다.

명령줄 사용법:

claude -p --model claude-sonnet-4-6 \
--system-prompt "$(cat prompts/level8_generative_v2.md)" \
"Analyze this code: $(cat your_code.py)"

일반 사용법: 이 프롬프트는 시스템 프롬프트로 모든 Claude 대화에 붙여넣을 수 있습니다. 코드, 에세이, 연구 논문, 음악 — 분석적인 모든 것에 작동합니다. 사용자는 "code"를 자신의 특정 도메인으로 대체해야 합니다.

저장소 세부 정보

  • 라이선스: MIT
  • 내용: 28개의 프롬프트, 299개의 원시 출력, 전체 실험 로그
  • 테스트된 모델: Claude Haiku, Sonnet, Opus
  • 가용성: 모든 프롬프트와 원시 출력은 오픈소스입니다

이것이 필요한 사람: 구조화된 인지 압축 기술을 통해 시스템 프롬프트 효과를 개선하고자 하는 Claude AI 모델로 작업하는 개발자와 연구자.

📖 전체 원본 읽기: r/ClaudeAI

Ad

👀 See Also

Semble: grep+read보다 98% 적은 토큰을 사용하는 AI 에이전트용 코드 검색
Tools

Semble: grep+read보다 98% 적은 토큰을 사용하는 AI 에이전트용 코드 검색

Semble는 AI 에이전트를 위한 오픈소스 코드 검색 라이브러리로, 정적 Model2Vec 임베딩과 BM25를 결합하여 CPU에서 완전히 실행됩니다. 저장소를 약 250ms에 인덱싱하고 쿼리를 약 1.5ms에 처리하며, 0.854 NDCG@10을 달성합니다. 이는 1억 3700만 파라미터 트랜스포머의 99% 품질이면서 grep+read보다 98% 적은 토큰을 사용합니다.

OpenClawRadar
TradingAgents-GUI: 멀티 에이전트 주식 분석을 위한 로컬 웹 인터페이스, 이제 Ollama 지원
Tools

TradingAgents-GUI: 멀티 에이전트 주식 분석을 위한 로컬 웹 인터페이스, 이제 Ollama 지원

TradingAgents 다중 에이전트 LLM 주식 분석 프레임워크를 위한 포크 GUI입니다. Ollama, OpenAI, Anthropic 등을 사용하여 로컬에서 실행됩니다. 실시간 파이프라인 시각화, 리포트 리더, 토큰 절약 요약 모드를 제공합니다.

OpenClawRadar
벤치마크 결과: 메모리 시스템을 탑재한 클로드 에이전트 스웜, 토큰 비용 30-43% 절감 효과 확인
Tools

벤치마크 결과: 메모리 시스템을 탑재한 클로드 에이전트 스웜, 토큰 비용 30-43% 절감 효과 확인

한 개발자가 40점짜리 코딩 작업에서 6개의 에이전트로 구성된 Claude 스웜을 사용자 정의 메모리 시스템인 Stompy를 적용한 경우와 적용하지 않은 경우로 테스트했습니다. 결과에 따르면, 메모리를 적용한 Sonnet 4.6은 $3.98의 비용으로 완벽한 점수를 달성한 반면, 메모리를 적용하지 않은 경우 $7.04의 비용이 들었습니다. Haiku 4.5는 메모리 없이는 완전히 실패했지만, 메모리를 적용하면 39/40점을 기록했습니다.

OpenClawRadar
Krasis: 대규모 MoE 모델을 위한 하이브리드 CPU/GPU 런타임, RTX 5080에서 3,324 tok/s 프리필 성능 달성
Tools

Krasis: 대규모 MoE 모델을 위한 하이브리드 CPU/GPU 런타임, RTX 5080에서 3,324 tok/s 프리필 성능 달성

Krasis는 대규모 MoE 모델을 실행하기 위한 하이브리드 CPU/GPU 런타임으로, GPU에서 프리필을 처리하고 CPU에서 디코드를 수행하여 RTX 5080에서 Qwen3-Coder-Next 80B Q4 모델로 3,324 토큰/초의 프리필 속도를 달성합니다. 시스템 RAM에 모델 크기의 약 2.5배가 필요하지만 VRAM에 비해 너무 큰 모델을 실행할 수 있습니다.

OpenClawRadar