Modelo Subquadratic estreia janela de contexto de 12 milhões de tokens para modelos de IA

A Subquadratic anunciou uma janela de contexto de 12 milhões de tokens, afirmando um avanço nos mecanismos de atenção subquadrática. Isso se compara às janelas típicas de 128K-1M tokens em modelos atuais. A técnica permite que os modelos lidem com contextos vastamente maiores sem o escalonamento quadrático de computação ou memória.
Detalhes Principais
- Janela de contexto: 12 milhões de tokens (12x maior que os 128K tokens do GPT-4)
- Baseada em atenção subquadrática, provavelmente usando complexidade linear ou quase linear no comprimento da sequência
- Permite processar codebases grandes inteiras, documentos longos ou transcrições de vídeos de várias horas em uma única passagem direta
- Aplicações potenciais: revisão de código de repositórios inteiros, análise de documentos longos, diálogo de múltiplas voltas com histórico completo
- Compatível com LLMs existentes baseados em transformadores via substituição de atenção plug-and-play
A abordagem reduz a atenção O(n²) para quase O(n) usando técnicas como modelos de espaço de estados ou fatorações de baixo posto. Nenhum número de benchmark específico é fornecido na fonte, mas a alegação é que isso torna as janelas de 12M tokens práticas em uma única GPU.
Para Quem é
Engenheiros de IA que trabalham com análise de código, processamento de documentos ou qualquer tarefa que exija compreensão de contexto longo sem chunking ou recuperação caros.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Claude Code v2.1.199 Corrige Mais de 20 Bugs: SSL, Subagentes, Falhas do Daemon Corrigidas
Claude Code v2.1.199 corrige erros de certificado SSL, falhas silenciosas de subagentes, um loop de travamento do daemon Linux e mais de 20 outros bugs. As principais correções incluem dicas imediatas de erro SSL, retenção parcial de stream e propagação de erros de subagentes.

Limitações de reconhecimento de fala do Claude e solução alternativa do usuário com Spokenly e Parakeet TDT
Um usuário relata que a transcrição pelo microfone integrado do Claude é imprecisa em comparação com a do ChatGPT, criando mais trabalho do que economiza. Eles implementaram uma solução alternativa usando Spokenly no Mac com o modelo Parakeet TDT da NVIDIA para melhor desempenho.
O Risco Mundano: Por que as Maiores Ameaças da Segurança da IA são Entediantes, não Dramáticas
Um ensaio argumenta que falhas mundanas de IA já estão causando danos em escala, as abordagens atuais de alinhamento dependem excessivamente de ambientes isolados, e a convergência de capacidades torna a exposição acidental ao mundo real cada vez mais plausível.

A startup de IA de Yann LeCun levanta US$ 1 bilhão na maior rodada de semente da Europa
A startup de IA de Yann LeCun levantou US$ 1 bilhão no que é relatado como a maior rodada de seed da Europa. A notícia foi compartilhada no Hacker News com 186 pontos e 107 comentários.