
Agents API: OpenAI conferma un bug di fatturazione
Dopo una segnalazione da 1.600 dollari, OpenAI conferma addebiti errati per i container. Distinguo il bug risolto dalla gestione delle sessioni nelle app.
Release di modelli, benchmark, esperimenti e guide per sviluppatori che lavorano con l’IA ogni giorno. Scritto a partire dall’uso reale, con fonti per ogni affermazione.

Dopo una segnalazione da 1.600 dollari, OpenAI conferma addebiti errati per i container. Distinguo il bug risolto dalla gestione delle sessioni nelle app.

Z.ai dichiara un throughput triplicato grazie a un agente GLM. Esamino il risultato, le decisioni degli ingegneri e il metodo da riusare nei progetti.

GPT-6 Sol e Luna riducono i prezzi API, con progressi più piccoli nei test. Confronto risultati, accesso in ChatGPT e le prime esperienze degli utenti Reddit.

Opus 5.5 migliora nei test indipendenti e riduce i prezzi dei token. Confronto costi per compito, livelli di ragionamento e prime esperienze su Reddit.

Anthropic afferma che Claude guida un quarto della ricerca in IA sotto supervisione umana. Esamino cosa misura il dato e chi continua a verificare i risultati.

Codex CLI aggiunge voce sperimentale e pulizia dei worktree. Spiego le correzioni per conservare i prompt, riprendere le sessioni e risolvere incompatibilità.

Su Reddit alcuni utenti sospettano un aggiornamento nascosto di Fable. Ho verificato le fonti e cosa permetterebbe di confermare un nuovo modello Claude.

La promozione di Claude Code è finita il 14 settembre. Spiego la riduzione della quota settimanale e la differenza rispetto al limite di cinque ore.

DeepSeek V4.1 Flash attiva 8B parametri in input, ma i pesi completi sono enormi. Spiego prezzi API, risultati di programmazione e requisiti hardware.

OpenAI ospita il ciclo di Codex per la tua applicazione. Spiego le differenze rispetto all'SDK, la persistenza delle sessioni e i costi che rimangono.

GPT-6 Astra consuma crediti a 2,5 volte la tariffa di Sol e in chat sembra più umano. Ho verificato i limiti di utilizzo, i benchmark e le prime reazioni.

Muse Spark 1.3 ha segnato 62 su Artificial Analysis, sopra GPT-6 Astra, poi è finito nono. Ho ricostruito da dove veniva il punteggio e quanto costa.