
Agents API: OpenAI bestätigt Container-Abrechnungsfehler
Ein Reddit-Nutzer meldet 1.600 Dollar Kosten. OpenAI bestätigt überhöhte Container-Gebühren. Was der behobene Fehler bedeutet und wie ich Sessions aufräume.
Modell-Releases, Benchmarks, Experimente und Anleitungen für Entwickler, die täglich mit KI arbeiten. Geschrieben aus der Praxis, mit Quellen für jede Aussage.

Ein Reddit-Nutzer meldet 1.600 Dollar Kosten. OpenAI bestätigt überhöhte Container-Gebühren. Was der behobene Fehler bedeutet und wie ich Sessions aufräume.

Z.ai meldet dreifachen Durchsatz mithilfe eines GLM-Agenten. Ich prüfe, was schneller wurde, was Menschen steuerten und was Entwickler übernehmen können.

GPT-6 Sol und Luna senken die API-Preise, die Benchmark-Gewinne fallen kleiner aus. Ich vergleiche Ergebnisse, ChatGPT-Zugang und erste Stimmen auf Reddit.

Opus 5.5 legt in unabhängigen Coding-Tests zu und senkt Tokenpreise. Ich vergleiche Aufgabenkosten, Denkaufwand und erste Reddit-Berichte aus dem Alltag.

Laut Anthropic leitet Claude ein Viertel seiner KI-Forschung unter menschlicher Aufsicht. Ich prüfe, was die Zahl misst und wer die Ergebnisse kontrolliert.

Codex CLI 0.155 bringt Sprachgespräche und sichereres Aufräumen von Worktrees. Ich erkläre die Korrekturen für verlorene Prompts, Neustarts und den Hotfix.

Reddit-Nutzer vermuten ein heimliches Fable-Upgrade. Ich habe die Aussagen zurückverfolgt und geprüft, was einen neuen Claude-Release tatsächlich belegen würde.

Die Claude-Code-Aktion endete am 14. September. Ich erkläre das kleinere Wochenkontingent, die Prozentrechnung und den Unterschied zum Fünf-Stunden-Limit.

DeepSeek V4.1 Flash nutzt 8B aktive Parameter beim Einlesen, doch die Gewichte sind riesig. Ich erkläre API-Preise, Coding-Scores und den Hardwarebedarf.

OpenAI betreibt die Codex-Agentenschleife für deine Anwendung. Ich erkläre den Unterschied zum SDK, die gespeicherten Daten und die verbleibenden Kosten.

OpenAI rechnet GPT-6 Astra mit dem 2,5-fachen Satz von Sol ab, und im Gespräch wirkt es menschlicher. Ich habe Limits, Benchmarks und erste Reaktionen geprüft.

Muse Spark 1.3 erreichte bei Artificial Analysis 62 Punkte, mehr als GPT-6 Astra, und fiel nach der Neuwertung auf Platz neun. Ich zeige, woher die Zahl kam.