HN 데이터가 arXiv 논문 점유율 하락을 확인하며, LLM 과대광고의 정점은 이미 지난 것일까?

Dylan Castillo는 Hacker News 프런트 페이지에서 arXiv 논문을 덜 보게 된 것이 맞는지 확인하고 싶었습니다. 그래서 그는 Claude를 사용하여 BigQuery HN 데이터셋에 대한 빠른 분석을 실행했습니다. 결과는 명확한 추세를 보여줍니다: HN에서 arXiv 스토리의 비율이 최근 몇 달간 급격히 감소하고 있다는 것입니다.
그는 또한 역사적 정점을 살펴보았습니다. 2019년의 첫 번째 정점은 딥러닝 논문에 의해 주도되었는데, 그 해에 가장 많은 투표를 받은 arXiv 상위 100개 게시물 중 41%가 딥러닝에 관한 것이었습니다. 2023~2026년 기간에는 AI에 대한 집중도가 더욱 높아져, 상위 100개 중 59%가 LLM 또는 AI에 관한 것이었습니다. 2019년의 주목할 만한 논문으로는 MuZero(161점), EfficientNet(119점), XLNet(79점), PyTorch NeurIPS 논문(113점), Chollet의 "On the Measure of Intelligence"(80점) 등이 있습니다.
2023~2026년 기간에 대해, Castillo는 Claude에게 어떤 논문이 오래도록 가치 있을지 추측해 달라고 요청했습니다. 선정된 논문은 다음과 같습니다: DeepSeek-R1(1,351점, RL을 통한 o1 스타일 추론의 공개 레시피), Generative Agents(391점, "Smallville" 논문), The Era of 1-bit LLMs / BitNet b1.58(1,040점), Differential Transformer(562점), 그리고 LK-99 클러스터(2,408 + 1,690점 합계, 오픈 사이언스 재현의 이정표). 전체 분석에는 주제 분포와 시간에 따른 arXiv 비율에 대한 차트가 포함되어 있습니다.
원문 읽기: HN LLM Tools
👀 See Also

OpenClaw 게이트웨이 신뢰성 문제: 25일간의 집중 사용 후 침묵하는 고장
OpenClaw 사용자가 18개 이상의 크론 작업과 Telegram 통합을 통해 25일 동안 시스템을 운영한 상세 보고서는 게이트웨이가 '좀비화' 상태에 빠지는 중요한 패턴을 확인했습니다. 이 상태에서는 게이트웨이가 실행 중으로 표시되지만 모든 기능이 정지됩니다. 사용자는 세션 쓰기 잠금이 무기한 유지되고, 크론 작업이 유령 실행 상태에 갇히며, 잘못된 구성에서 조용히 실패하는 등의 구체적인 문제를 기록했습니다.

Claude Opus 4.5와 Sonnet 4.5가 /model 선택에서 제거되었으며, 실행 플래그가 필요합니다.
Claude Opus 4.5와 Sonnet 4.5는 세션 중 /model 선택 메뉴에서 더 이상 사용할 수 없습니다. 사용자는 이제 이전 버전에 접근하기 위해 --model 플래그로 전체 모델 ID를 지정하여 세션을 시작해야 합니다.

OpenRouter, 헌터/힐러 알파 모델들이 MiMo V2 변형임을 확인했습니다
OpenRouter의 이전에 비밀리에 공개된 Hunter Alpha와 Healer Alpha 모델이 MiMo V2 변종으로 확인되었습니다. Hunter Alpha는 1M 컨텍스트 윈도우를 가진 MiMo V2 Pro 텍스트 전용 추론 모델이고, Healer Alpha는 262K 컨텍스트 윈도우를 가진 MiMo V2 Omni 텍스트+이미지 추론 모델입니다.

Nemotron 3 4B, 까다로운 벤치마크에서 Qwen 3.5 4B에 비해 성능이 떨어집니다
레딧 사용자가 복잡한 수학 및 프로그래밍 작업에서 Nemotron 3 4B Q8과 Qwen 3.5 4B Q8을 비교 테스트한 결과, Nemotron은 올바른 추론과 구조화된 출력을 생성하지 못한 반면 Qwen은 모든 테스트를 통과했습니다.