
OpenAI confirma erro na faturação de contentores da Agents API
Um utilizador relatou uma fatura de 1 600 USD na Agents API. A OpenAI confirmou cobranças excessivas. Distingo o erro da gestão de sessões nas aplicações.
Lançamentos de modelos, benchmarks, experimentos e guias para quem programa com IA todos os dias. Escrito a partir do uso real, com fontes para cada afirmação.

Um utilizador relatou uma fatura de 1 600 USD na Agents API. A OpenAI confirmou cobranças excessivas. Distingo o erro da gestão de sessões nas aplicações.

A Z.ai relata um débito de inferência 3× maior com um agente GLM. Analiso o que melhorou, o papel dos engenheiros e o que aproveitaria no meu trabalho.

GPT-6 Sol e Luna baixam os preços da API, com ganhos menores nos testes. Comparo resultados, acesso no ChatGPT e as primeiras experiências no Reddit.

Opus 5.5 melhora nos testes independentes e reduz os preços dos tokens. Comparo custos por tarefa, níveis de raciocínio e os primeiros relatos no Reddit.

A Anthropic diz que Claude lidera um quarto da investigação em IA sob supervisão humana. Analiso o que o valor mede e quem continua a verificar os resultados.

O Codex CLI ganha voz experimental e limpeza de worktrees. Explico as correções que preservam prompts, recuperam sessões e evitam erros de compatibilidade.

Utilizadores do Reddit suspeitam de uma atualização oculta do Fable. Segui as fontes e verifiquei o que permitiria confirmar um novo modelo Claude.

A promoção do Claude Code terminou a 14 de setembro. Explico a redução da quota semanal e a diferença entre esse limite e a janela de cinco horas.

O DeepSeek V4.1 Flash ativa 8B parâmetros na entrada, mas os pesos são enormes. Explico preços da API, resultados de programação e requisitos de hardware.

A OpenAI aloja o ciclo do Codex para a sua aplicação. Explico as diferenças face ao SDK, a persistência das sessões e os custos que continuam a existir.

O GPT-6 Astra da OpenAI consome créditos a 2,5 vezes a tarifa do Sol e conversa de forma mais humana. Analisei os limites, os benchmarks e os relatos iniciais.

O Muse Spark 1.3 marcou 62 na Artificial Analysis, à frente do GPT-6 Astra, e caiu para nono numa reavaliação. Segui o rasto da pontuação e do preço.