Kimi K2.6 대 Claude Opus 4.7: Minetest 현상금 게시판 모드 실제 테스트

두 모델을 이상한 코딩 작업(Minetest/Luanti 현상금 보드 게임 모드를 TypeScript 백엔드로 구축한 후 Composio를 통해 Google Sheets 로깅으로 확장)에서 비교한 흥미로운 실제 사례입니다. 두 모델 모두 동일한 프롬프트를 받았습니다. 자세한 내용은 원본 게시물에서 확인하세요.
설정
- Claude Opus 4.7: Claude Code 사용
- Kimi K2.6: OpenRouter의 OpenCode 사용
- 작업: 플레이어가 월드에 접속하여
/bounty를 실행하고, 작업을 받아 완료한 후 보상을 받고, 백엔드가 완료를 기록합니다. 두 번째 테스트: Composio를 통해 Google Sheets에 완료 기록을 로깅합니다.
가격
- Opus 4.7: 입력 $5/M, 출력 $25/M
- Kimi K2.6: 입력 $0.95/M, 출력 $4/M (캐시된 입력 $0.16/M)
테스트 1: 로컬 현상금 보드
Opus 4.7: 깔끔한 MVP. Express/Zod/Vitest 백엔드, Lua 모드, /bounty 흐름, 보상, 리더보드, 테스트 통과. 통계:
- 비용: ~$3.59
- 시간: API 12분, 실제 23분
- 코드: +1,688 / -0
- 출력 토큰: 54.8k
- 캐시 읽기: 2.8M
Kimi K2.6: 로컬 보드도 작동했지만 더 지저분했습니다. Opus의 1,688줄에 비해 4,671줄의 코드를 작성했습니다(+4,671 / -0). 비용: ~$0.39. 시간: ~9분 27초. 짜증난 부분은 Minetest 설정입니다. 전역 설정에 secure.http_mods = bountykimi를 썼지만, 다른 모드 이름으로 월드 레벨 설정을 만들어 실행 중인 모드에 HTTP API가 활성화되지 않았습니다. 테스터가 디버깅하는 데 30분 이상 걸렸습니다.
테스트 2: Composio + Google Sheets
Opus 4.7: Google Sheets 동기화가 작동했습니다. tsx watch와 환경 변수 로딩에 대한 몇 차례 시행착오 끝에 백엔드가 현상금을 완료하고 Sheets에 추가할 수 있었습니다. 통계:
- 비용: $16.03
- 시간: API 28분, 실제 1시간 17분
- 코드: +1,848 / -507
- 캐시 읽기: 22.3M
- 출력: 123.3k 토큰
Kimi K2.6: 실패했습니다. 개발 서버 문제, 테스트, 빌드 문제에 막혔습니다. Composio 통합을 작동 상태로 만들지 못했습니다. 약 25분과 135k+ 토큰 후 테스터가 중단했습니다. 비용: ~$5.03.
결론
- 최고의 로컬 MVP: Opus, 하지만 Kimi가 훨씬 더 가성비가 좋음
- 최고의 실제 통합: Opus가 월등히 앞섬
- 더 깔끔한 코드: Opus
- 더 저렴한 실험 모델: Kimi
테스트 결과 Kimi K2.6은 저렴한 로컬 코딩 작업에 흥미롭습니다. $0.39로 작동하는 Lua+TypeScript 모드를 얻는 것은 나쁘지 않습니다. 하지만 외부 도구, 설정 문제 및 실제 통합 작업이 포함되자 Opus 4.7이 확실히 앞섰습니다.
커밋, 스크린샷, 데모, 비용이 포함된 전체 분석은 원본 링크에서 확인하세요.
📖 전체 소스 읽기: r/ClaudeAI
👀 See Also

AI 물 사용량은 문제가 아니다: 국가, 지역, 개인 수준 분석
Andy Masley가 AI 데이터 센터의 물 사용량을 다른 산업과 비교해 계산한 결과 '가짜 문제'임을 발견했습니다. 세금 수익 대비 물 사용량이 높고, 1인당 사용량은 미미합니다.

Agora-1: 실시간 공유 시뮬레이션을 위한 오픈 소스 다중 에이전트 세계 모델
Odyssey가 Agora-1을 출시했습니다. 이는 최대 4명의 에이전트(인간 또는 AI)가 GoldenEye를 테스트 환경으로 사용하여 실시간으로 생성된 시뮬레이션을 공유할 수 있는 세계 모델입니다.

Anthropic, AI 제한으로 인한 국방부 블랙리스트 등재 방지를 위해 소송 제기
로이터 통신이 해커 뉴스에 공유한 보도에 따르면, Anthropic은 AI 사용 제한을 이유로 국방부가 회사를 블랙리스트에 올리는 것을 막기 위해 소송을 제기했습니다.

3월 16일 이후 전체 할당량이 남아있음에도 OpenAI Codex OAuth에서 429 오류 반환
OpenAI Codex OAuth가 3월 16일 이후로 지속적으로 429 "할당량을 초과했습니다" 오류를 반환하고 있으며, 대시보드에는 100% 할당량이 남아 있는 것으로 표시됩니다. 사용자들은 재인증, 토큰 취소, 완전한 재구성에도 불구하고 문제가 지속된다고 보고합니다.