En menos de una semana salieron los dos modelos más potentes del momento. Cobran lo mismo por token, manejan un millón de tokens de contexto y los dos dicen ser el mejor para programar. La respuesta corta: en calidad de código están empatados. La diferencia está en el costo por tarea y en cómo trabajan dentro de un agente.
Lo básico de cada modelo, con datos de la documentación oficial
| GPT-6 Astra | Claude Fable 5.1 | |
|---|---|---|
| Lanzamiento | 3 sept 2026 | 1 sept 2026 |
| ID en la API | gpt-6-astra | claude-fable-5-1 |
| Contexto | ~1,05M tokens | 1M tokens |
| Salida máxima | 128K tokens | 128K tokens |
| Entrada / salida (por millón) | $10 / $50 | $10 / $50 |
| Lectura de caché (por millón) | $1 | $0,254× más barato |
| Agente de código propio | Codex | Claude Code |
| Otras plataformas | ChatGPT, Amazon Bedrock | Bedrock, Google Cloud, Foundry, GitHub Copilot |
Separamos las mediciones independientes (Artificial Analysis) de las que publica cada empresa.
Si los dos cobran $10 / $50, ¿por qué uno sale más barato?
La salida es lo más caro y Astra escribe unos 27K tokens por tarea frente a 78K de Fable 5.1. En el Intelligence Index, Astra cuesta $3,26 por tarea y Fable 5.1 $7,63.
Fable 5.1 cobra la lectura de caché a $0,25 por millón, cuatro veces menos que antes. En sesiones de agente de horas, eso le ayuda bastante.
200K tokens de entrada nueva, 1,8M leídos de caché y la salida típica de cada modelo
| Concepto | GPT-6 Astra | Fable 5.1 |
|---|---|---|
| Entrada nueva (200K) | $2,00 | $2,00 |
| Lectura de caché (1,8M) | $1,80 | $0,45 |
| Salida | $1,35 (27K) | $3,90 (78K) |
| Total | $5,15 | $6,35 |
Estimación simplificada: no incluye escritura de caché. Muestra que la caché barata de Fable no alcanza a compensar que escribe casi tres veces más.
No hay un ganador absoluto: depende de cómo programas
La misma petición con el SDK oficial de cada empresa en Node.js
Con Fable 5.1, tool_choice de tipo "any" o "tool" devuelve un error 400. Usa "auto" con strict: true o salidas estructuradas.
Editar mensajes anteriores invalida los bloques de razonamiento. Claude Code y el Agent SDK lo manejan por ti; si armas el array de mensajes a mano, revísalo.
En cambios pequeños puede reescribir todo el archivo. Pídele ediciones puntuales y ahorrarás tokens de salida.
Puedes subir el nivel de esfuerzo para un paso difícil y bajarlo para los rutinarios sin perder la caché.
Para el día a día, muchas veces sobra con algo más barato
Anthropic recomienda empezar aquí y subir a Fable solo si hace falta.
Rápido para autocompletar y cambios pequeños.
30B parámetros, corre sin internet en una GPU de 24 GB.
Lo más útil es probar los dos con tu propio repositorio durante una semana. Los benchmarks marcan tendencia, pero tu código es el que decide.
Elegir el modelo es solo el primer paso. Aprende a darle contexto con skills para Claude Code y a trabajar con agentes de IA en tus proyectos.