Ultimo articolo
Ogni sessione parte da zero. Il mio agente riceve una mappa
La mia AI inizia ogni sessione senza memoria del repo. Ecco la mappa di file che ha risolto il problema: quattro livelli, un ordine di autorità, costi misurati.
Release di modelli, benchmark, esperimenti e guide per sviluppatori che lavorano con l’IA ogni giorno. Scritto a partire dall’uso reale, con fonti per ogni affermazione.
Ultimo articolo
La mia AI inizia ogni sessione senza memoria del repo. Ecco la mappa di file che ha risolto il problema: quattro livelli, un ordine di autorità, costi misurati.
Sol, Terra, Opus 5 e Fable 5 sullo stesso agente: pareggio in vetta, lo stesso punteggio a un quarto del costo e livelli di effort che possono nuocere.
Kimi K3 pareggia GPT-5.6 nell'indice indipendente di coding ma impiega 4,6 volte il tempo. I token di GLM-5.2 a 1,40 $ costano 6,51 $ a task. L'hype, misurato.
Quasi tutto ciò che rilascio con l'AI gira su Convex. Un giorno a cercare di meglio: otto rivali, prezzi verificati, trappola UE inclusa, e una classifica.
GPT-5.6 Sol ha restituito 400 finding di audit dove Fable 5 ne trovava 70, poi ha complicato le correzioni oltre misura. Ecco il contratto che lo tiene a freno.
Opus 5 eguaglia Fable 5 nei benchmark a metà prezzo per token, ma anche le lamentele della prima settimana sono reali. Dove brilla e dove gli serve un capo.