
Opus 5.5 programa melhor. O custo por tarefa varia
Opus 5.5 melhora nos testes independentes e reduz os preços dos tokens. Comparo custos por tarefa, níveis de raciocínio e os primeiros relatos no Reddit.
Todos os artigos com a tag claude, do mais recente para o mais antigo.

Opus 5.5 melhora nos testes independentes e reduz os preços dos tokens. Comparo custos por tarefa, níveis de raciocínio e os primeiros relatos no Reddit.

A Anthropic diz que Claude lidera um quarto da investigação em IA sob supervisão humana. Analiso o que o valor mede e quem continua a verificar os resultados.

Utilizadores do Reddit suspeitam de uma atualização oculta do Fable. Segui as fontes e verifiquei o que permitiria confirmar um novo modelo Claude.

O Codex dá-me mais utilização, melhor frontend e uma aplicação mais simples. Mas o Claude conclui grandes funcionalidades multiagente muito mais depressa.

Os modelos Claude vão marcar o texto pelas palavras que escolhem, não com caracteres ocultos. A razão é o AI Act da UE, não a guerra da destilação.