HN 데이터가 arXiv 논문 점유율 하락을 확인하며, LLM 과대광고의 정점은 이미 지난 것일까?

Dylan Castillo는 Hacker News 프런트 페이지에서 arXiv 논문을 덜 보게 된 것이 맞는지 확인하고 싶었습니다. 그래서 그는 Claude를 사용하여 BigQuery HN 데이터셋에 대한 빠른 분석을 실행했습니다. 결과는 명확한 추세를 보여줍니다: HN에서 arXiv 스토리의 비율이 최근 몇 달간 급격히 감소하고 있다는 것입니다.
그는 또한 역사적 정점을 살펴보았습니다. 2019년의 첫 번째 정점은 딥러닝 논문에 의해 주도되었는데, 그 해에 가장 많은 투표를 받은 arXiv 상위 100개 게시물 중 41%가 딥러닝에 관한 것이었습니다. 2023~2026년 기간에는 AI에 대한 집중도가 더욱 높아져, 상위 100개 중 59%가 LLM 또는 AI에 관한 것이었습니다. 2019년의 주목할 만한 논문으로는 MuZero(161점), EfficientNet(119점), XLNet(79점), PyTorch NeurIPS 논문(113점), Chollet의 "On the Measure of Intelligence"(80점) 등이 있습니다.
2023~2026년 기간에 대해, Castillo는 Claude에게 어떤 논문이 오래도록 가치 있을지 추측해 달라고 요청했습니다. 선정된 논문은 다음과 같습니다: DeepSeek-R1(1,351점, RL을 통한 o1 스타일 추론의 공개 레시피), Generative Agents(391점, "Smallville" 논문), The Era of 1-bit LLMs / BitNet b1.58(1,040점), Differential Transformer(562점), 그리고 LK-99 클러스터(2,408 + 1,690점 합계, 오픈 사이언스 재현의 이정표). 전체 분석에는 주제 분포와 시간에 따른 arXiv 비율에 대한 차트가 포함되어 있습니다.
원문 읽기: HN LLM Tools
👀 See Also

클로드 코드 v2.1.232: 서브에이전트 포크, GitLab 지원 및 보안 수정
Claude Code v2.1.232는 서브에이전트 포크를 기본으로 활성화하고, 플러그인 마켓플레이스에 GitLab 지원을 추가하며, PowerShell 및 심볼릭 링크 우회를 포함한 여러 보안 취약점을 패치했습니다.

Granite 4.1: IBM의 8B 밀집 모델, 벤치마크에서 32B MoE와 동급 성능
IBM의 Granite 4.1 8B 밀집 모델은 향상된 학습 데이터 품질 덕분에 ArenaHard, BFCL V3, GSM8K 등에서 이전 32B MoE 모델과 동등하거나 더 나은 성능을 보입니다.

Anthropic 정책 시행: 구독 한도에 더 이상 제외되지 않는 제3자 Claude 활용
Anthropic은 4월 4일부터 OpenClaw와 같은 서드파티 하네스가 Claude 구독 사용량 한도에서 더 이상 차감되지 않도록 정책 변경을 시행하며, 사용자는 4월 9일까지 추가 사용량을 켜거나 환불을 위해 구독을 취소해야 합니다.

Opus 4.6 확장 사고 방식은 물리학 다이어그램 문제에서 더 낮은 성능을 보입니다
테스트 결과, 확장 사고 모드를 사용한 Claude Opus 4.6은 시각적 다이어그램 해석이 필요한 물리학 문제에서 지속적으로 실패하는 반면, Gemini 3.1 Pro는 성공했습니다. 확장 사고를 비활성화하면 Opus 4.6이 동일한 문제를 정확하고 더 빠르게 해결할 수 있습니다.