
OpenAI confirma cobros de más por contenedores en Agents API
Un usuario de Reddit reportó un cobro de 1600 dólares en Agents API. Distingo el error confirmado por OpenAI de la limpieza que necesitan las apps.
Lanzamientos de modelos, benchmarks, experimentos y guías para desarrolladores que trabajan con IA a diario. Escrito desde el uso real, con fuentes para cada afirmación.

Un usuario de Reddit reportó un cobro de 1600 dólares en Agents API. Distingo el error confirmado por OpenAI de la limpieza que necesitan las apps.

Z.ai dice que un agente GLM ayudó a triplicar la tasa de procesamiento. Examino qué mejoró, qué decidían los humanos y qué podemos aplicar al programar.

GPT-6 Sol y Luna bajan los precios de la API, con avances menores en los tests. Comparo resultados, acceso en ChatGPT y primeras experiencias en Reddit.

Opus 5.5 mejora en pruebas independientes y baja el precio de los tokens. Comparo el coste por tarea, el esfuerzo y las primeras experiencias en Reddit.

Anthropic afirma que Claude lidera una cuarta parte de su investigación en IA bajo supervisión humana. Examino qué mide ese dato y quién revisa los resultados.

Codex CLI incorpora voz experimental y limpieza de worktrees. Explico las mejoras para conservar prompts, recuperar sesiones y evitar errores de compatibilidad.

Usuarios de Reddit sospechan una mejora oculta de Fable. Seguí el origen de sus afirmaciones y revisé qué permitiría confirmar un nuevo modelo de Claude.

La promoción de Claude Code terminó el 14 de septiembre. Explico cuánto baja la cuota semanal y por qué el límite de cinco horas es una restricción distinta.

DeepSeek V4.1 Flash usa 8.000 millones de parámetros al leer, pero sus pesos son enormes. Comparo precios de API, benchmarks y requisitos del servidor.

OpenAI aloja el ciclo de Codex para tu aplicación. Explico qué cambia frente al Agents SDK, cómo persisten las sesiones y qué costes siguen a tu cargo.

GPT-6 Astra gasta tu cuota 2,5 veces más rápido por token que Sol. Revisé los límites de cada plan, los benchmarks y las primeras reacciones de la comunidad.

Muse Spark 1.3 sacó 62 en Artificial Analysis, por encima de GPT-6 Astra, y cayó al noveno puesto al recalcular el índice. Revisé de dónde salía y qué cuesta.