
OpenAI confirma erro na faturação de contentores da Agents API
Um utilizador relatou uma fatura de 1 600 USD na Agents API. A OpenAI confirmou cobranças excessivas. Distingo o erro da gestão de sessões nas aplicações.
Quando um laboratório lança um modelo: o que muda de facto para quem desenvolve software.

Um utilizador relatou uma fatura de 1 600 USD na Agents API. A OpenAI confirmou cobranças excessivas. Distingo o erro da gestão de sessões nas aplicações.

A Z.ai relata um débito de inferência 3× maior com um agente GLM. Analiso o que melhorou, o papel dos engenheiros e o que aproveitaria no meu trabalho.

GPT-6 Sol e Luna baixam os preços da API, com ganhos menores nos testes. Comparo resultados, acesso no ChatGPT e as primeiras experiências no Reddit.

Opus 5.5 melhora nos testes independentes e reduz os preços dos tokens. Comparo custos por tarefa, níveis de raciocínio e os primeiros relatos no Reddit.

A Anthropic diz que Claude lidera um quarto da investigação em IA sob supervisão humana. Analiso o que o valor mede e quem continua a verificar os resultados.

O Codex CLI ganha voz experimental e limpeza de worktrees. Explico as correções que preservam prompts, recuperam sessões e evitam erros de compatibilidade.

Utilizadores do Reddit suspeitam de uma atualização oculta do Fable. Segui as fontes e verifiquei o que permitiria confirmar um novo modelo Claude.

O DeepSeek V4.1 Flash ativa 8B parâmetros na entrada, mas os pesos são enormes. Explico preços da API, resultados de programação e requisitos de hardware.

A OpenAI aloja o ciclo do Codex para a sua aplicação. Explico as diferenças face ao SDK, a persistência das sessões e os custos que continuam a existir.

O GPT-6 Astra da OpenAI consome créditos a 2,5 vezes a tarifa do Sol e conversa de forma mais humana. Analisei os limites, os benchmarks e os relatos iniciais.

Fable 5.1 supera o antecessor em tarefas longas de agentes, mas o Opus 5 mantém-se próximo e custa metade do preço base. Analisei benchmarks e relatos iniciais.

O limite de cinco horas pode interromper trabalho no Codex apesar da quota semanal. Limita quando você pode usar o Plus, não necessariamente a utilização total.

Os modelos Claude vão marcar o texto pelas palavras que escolhem, não com caracteres ocultos. A razão é o AI Act da UE, não a guerra da destilação.

A OpenAI confirmou o Astra e abrandou o trabalho por risco cibernético. A data do GPT-6 veio de uma alegação retirada no dia seguinte e de uma piada do Codex.

A OpenAI repôs a utilização do Codex 5 vezes em dez dias enquanto o Sol consumia os limites depressa demais. Para mim, os reforços esconderam o problema real.

O V4 Flash custa 0,14 dólares à entrada e 0,28 à saída por milhão de tokens. Verifiquei se o desconto de 97 a 99% compensa perder os benchmarks.

O Opus 5 iguala o Fable 5 nos benchmarks por metade do preço por token, mas é difícil de supervisionar. Explico quando cada modelo compensa.