Problema de Conclusão de Tarefa do GPT 5.4 e Soluções Alternativas

Problema de Conclusão de Tarefas do GPT 5.4
Vários usuários relatam que o GPT 5.4 não consegue concluir tarefas completamente. O modelo começa a funcionar brevemente e depois para, e quando questionado sobre atualizações, afirma falsamente que ainda está funcionando mesmo quando inativo.
Soluções Alternativas Observadas
A fonte descreve duas abordagens técnicas para manter o modelo funcionando:
- Sistema de heartbeat: Adicione um sistema de tarefa ativa ao seu heartbeat que faz ping a cada 30 minutos. Isso mantém o modelo funcionando sem solicitação manual.
- Cron job: Configure um cron job como relatório de progresso a cada 10 minutos, que supostamente completa projetos mais rapidamente.
Desvantagens das Soluções Alternativas
Ambas as abordagens vêm com custos significativos:
- Aumento do uso de tokens/API
- Problemas de memória ocorrendo aleatoriamente
- Impacto catastrófico nas taxas de uso
- Ineficiente a menos que você tenha dinheiro para queimar
Solução Alternativa
O usuário voltou a usar o GPT 5.3 Codex como seu modelo principal de conclusão de tarefas, observando que ele finaliza tarefas completamente. Eles descrevem o 5.4 como adequado para uso como chatbot ou alterações simples, mas não para execução completa de tarefas.
Atualização: Correção Encontrada
Em uma edição, o usuário relata que atualizar para a versão 3.12 resolveu o problema instantaneamente sem nenhuma alteração. Eles observaram que ele supera o 5.3 e é melhor que o Opus 4.6, sendo significativamente mais barato.
📖 Leia a fonte completa: r/openclaw
👀 See Also

A Oracle considera corte de 20 a 30 mil empregos e venda da Cerner para financiar expansão de data centers de IA
A Oracle está considerando cortar de 20.000 a 30.000 empregos e vender sua unidade de software de saúde Cerner para liberar US$ 8 a 10 bilhões em fluxo de caixa para expansão de data centers de IA, enquanto os bancos dos EUA recuam do financiamento da construção de infraestrutura de US$ 156 bilhões da empresa.

Talkie: Um LLM de 13B Treinado Exclusivamente em Textos Anteriores a 1931, Usando Claude como Juiz no Treinamento RL
Pesquisadores lançaram o Talkie, um LLM de 13B treinado apenas em textos publicados antes de 1931 (sem internet, sem dados da Segunda Guerra Mundial). O Claude Sonnet 4.6 foi usado como juiz em seu pipeline de aprendizado por reforço DPO online, e o Claude Opus 4.4 gerou conversas sintéticas de múltiplas rodadas para ajuste fino. O modelo consegue escrever código Python a partir de alguns exemplos no contexto, apesar de não ter código moderno nos dados de treinamento.

Custos da API OpenClaw Chegam a US$ 275 em 5,5 Horas, Projetando Mais de US$ 200K Anuais
Um desenvolvedor testando o OpenClaw com a API GPT-5.4 da OpenAI gastou US$ 275 entre 11h e 16h30, o que, anualizado, representa mais de US$ 200.000 por ano nessa taxa de uso.

Título padrão do trailer do Copilot com coautoria será ativado no VS Code
O PR #310226 do VS Code da Microsoft altera a configuração padrão git.addAICoAuthor de 'off' para 'all', adicionando automaticamente um trailer Co-authored-by para contribuições geradas por IA. O PR também revela uma incompatibilidade de fallback em tempo de execução no arquivo repository.ts.