Dados do HN confirmam que a participação de artigos do arXiv está caindo; o auge do hype em torno dos LLMs já passou?

Dylan Castillo queria confirmar se estava vendo menos artigos do arXiv nas primeiras páginas do Hacker News, então ele usou o Claude para realizar uma análise rápida no conjunto de dados do HN no BigQuery. Os resultados mostram uma tendência clara: a participação de histórias do arXiv no HN vem caindo drasticamente nos últimos meses.
Ele também analisou os picos históricos. O primeiro pico, em 2019, foi impulsionado por artigos de aprendizado profundo — 41% das 100 postagens do arXiv mais votadas naquele ano eram sobre aprendizado profundo. O período de 2023–2026 viu um foco ainda maior em IA: 59% das 100 histórias do arXiv mais votadas eram sobre LLMs ou IA. Em 2019, os artigos de destaque incluíam MuZero (161 pts), EfficientNet (119 pts), XLNet (79 pts), o artigo do PyTorch no NeurIPS (113 pts) e "On the Measure of Intelligence" de Chollet (80 pts).
Para o período de 2023–2026, Castillo pediu ao Claude que adivinhasse quais artigos envelheceriam bem. As escolhas: DeepSeek-R1 (1.351 pts, receita aberta para raciocínio estilo o1 via RL), Generative Agents (391 pts, o artigo "Smallville"), The Era of 1-bit LLMs / BitNet b1.58 (1.040 pts), Differential Transformer (562 pts) e o cluster LK-99 (2.408 + 1.690 pts combinados, um marco na replicação de ciência aberta). A análise completa inclui gráficos para distribuição de tópicos e a participação do arXiv ao longo do tempo.
📖 Leia a fonte completa: HN LLM Tools
👀 See Also

Tensões Aumentam Entre o Pentágono e a Empresa de IA Anthropic
O uso da IA da Anthropic pelo Pentágono em operações classificadas, como uma incursão na Venezuela, criou tensão sobre as políticas de segurança de IA da empresa.

Discussão no Reddit destaca desafios de depuração com código gerado por IA
Uma discussão no Reddit em r/ClaudeAI detalha problemas específicos que desenvolvedores enfrentam com código gerado por IA, incluindo vulnerabilidades de segurança, alucinações lógicas e depuração que pode levar mais tempo do que escrever o código manualmente.

Plataforma Polsia Mostra Padrões Repetitivos de SaaS em Lançamentos ao Vivo de Fundadores
Polsia é uma plataforma de negócios autônoma onde os usuários descrevem seu negócio, pagam dinheiro, e ela executa autonomamente. Um cientista comportamental observou 72 horas de lançamentos ao vivo de fundadores, identificando padrões repetitivos como soluções de automação de SDR com IA e mercados internacionais subatendidos.

Quando comentaristas online 'detectam' minha arte como IA: a frustração de David Revoy
O artista David Revoy compartilha capturas de tela de comentaristas online acusando falsamente sua arte desenhada à mão de ser gerada por IA, apesar de compartilhar timelapses. Ele explora o problema em sua história em quadrinhos 'Problema de Autenticidade'.