Claude Opus 4.7 adiciona suporte a imagens de alta resolução, orçamentos de tarefas e remove o pensamento estendido.

O Claude Opus 4.7 é o modelo mais recente disponível geralmente da Anthropic, projetado para raciocínio complexo e codificação agentiva com suporte para uma janela de contexto de 1M de tokens e 128k de tokens de saída máxima.
Novos recursos
O modelo adiciona suporte a imagens de alta resolução com uma resolução máxima de 2576px/3,75MP, acima do limite anterior de 1568px/1,15MP. Isso deve melhorar o desempenho em cargas de trabalho intensivas em visão, particularmente para uso em computador e fluxos de trabalho de compreensão de documentos. As coordenadas agora mapeiam 1:1 com pixels reais, eliminando cálculos de fator de escala. Imagens de alta resolução consomem mais tokens, então a redução de resolução é recomendada quando fidelidade adicional não é necessária.
O Claude Opus 4.7 também introduz um novo nível de esforço xhigh para casos de uso de codificação e agentivos, com high recomendado como o mínimo para tarefas sensíveis à inteligência.
Orçamentos de tarefas (beta)
O modelo adiciona orçamentos de tarefas, que dão ao Claude uma estimativa de quantos tokens direcionar para um loop agentivo completo, incluindo pensamento, chamadas de ferramentas e saídas. O modelo vê uma contagem regressiva em execução e a usa para priorizar o trabalho. O orçamento mínimo de tarefa é de 20k tokens, e é distinto de max_tokens que permanece como um limite rígido por solicitação.
response = client.beta.messages.create(
model="claude-opus-4-7",
max_tokens=128000,
output_config={
"effort": "high",
"task_budget": {
"type": "tokens",
"total": 128000
}
},
messages=[{"role": "user", "content": "Revise a base de código e proponha um plano de refatoração."}],
betas=["task-budgets-2026-03-13"]
)Os orçamentos de tarefas são consultivos, não limites rígidos. Se definidos muito baixos, o modelo pode completar tarefas menos minuciosamente ou recusá-las completamente. Para tarefas agentivas abertas onde a qualidade importa mais que a velocidade, não defina um orçamento de tarefa.
Mudanças disruptivas
Os orçamentos de pensamento estendido são removidos no Claude Opus 4.7. Definir thinking: {"type": "enabled", "budget_tokens": N} retornará um erro 400. O pensamento adaptativo é agora o único modo de pensamento ativado, que em avaliações internas superou consistentemente o pensamento estendido.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Previsão Multi-Token MTP: Geração de Tokens 2x Mais Rápida no AMD Strix Halo & Radeon 9700 AI Pro
MTP acelera a inferência de LLMs em até 2x, especialmente para agentes de codificação. O vídeo aborda a mecânica do MTP e o desempenho no Qwen 3.6 com AMD Strix Halo e Dual Radeon 9700.

Agentes de codificação de IA podem fragmentar o fluxo de trabalho e drenar a atenção, alerta desenvolvedor
Um desenvolvedor web com 12 anos de experiência relata que usar Claude Code diariamente leva a micro interrupções, perda de foco e exaustão mental — sem ganhos mensuráveis de produtividade.

A BitNet da Microsoft Permite Inferência de LLM com 100 Bilhões de Parâmetros em uma Única CPU
O projeto BitNet de código aberto da Microsoft alcança inferência de LLM com 100B de parâmetros a 5-7 tokens/segundo em uma única CPU, com o modelo de 2B de parâmetros usando 0,4GB de memória e latência de 29ms, enquanto iguala modelos de precisão total em benchmarks.

A Microsoft lança o modelo multimodal Phi-4-reasoning-vision-15B com insights de treinamento.
A Microsoft Research lançou o Phi-4-reasoning-vision-15B, um modelo multimodal de raciocínio de 15 bilhões de parâmetros com pesos abertos, disponível através do Microsoft Foundry, HuggingFace e GitHub. O modelo equilibra poder de raciocínio com eficiência e se destaca em raciocínio matemático/científico e compreensão de interfaces.