El modelo premium no programa más rápido. Piensa.
Mike Codeur
![]()
Fable 5 estaba incluido en las suscripciones Claude Pro y Max. Esa ventana se cerró el 12 de julio: desde entonces funciona con créditos de pago.
Mejor así. Mientras estaba incluido, la pregunta no se planteaba y la mayoría lo malgastó programando un poco más rápido. Ahora que cuesta, llega la pregunta real: ¿cuándo vale su precio un modelo premium?
El error: creer que el modelo premium programa mejor
Es la lectura instintiva. Modelo más caro, luego mejor código, luego lo pongo en todas partes.
Es no entender nada.
Un modelo premium como Fable 5 no es el modelo que programa más rápido. Es el modelo que piensa: análisis profundo, tareas largas en autonomía, capacidad de funcionar horas verificando y corrigiendo su propio trabajo.
Usarlo para renombrar variables es pagar a un equipo de arquitectos para poner baldosas.
El principio: el premium hace de cerebro, el barato hace de brazos
Esta es la regla, y todo lo demás se deriva de ella.
El modelo premium hace lo que exige profundidad: encuadrar, analizar, planificar, sostener una ejecución larga. La ejecución repetitiva y secuencial la haces después, con un modelo más barato.
Mira la diferencia, justifica por sí sola el esfuerzo de separar:
| Modelo | Entrada / M tokens | Salida / M tokens |
|---|---|---|
| Fable 5 | 10 $ | 50 $ |
| Opus 4.8 | 5 $ | 25 $ |
| Sonnet 5 | 3 $ (2 $ de lanzamiento hasta el 31 de agosto) | 15 $ (10 $ de lanzamiento) |
Pagar tarifa premium por ejecución mecánica es una elección. Rara vez buena.
Modo A: la ejecución larga autónoma
El primer uso que justifica el precio es el trabajo que nunca lanzarías a mano.
Una migración masiva, por ejemplo. Pones el objetivo con /goal (un comando oficial de Claude Code, documentado por Anthropic) y lo dejas correr:
/goal migra todo el monorepo a [X], tests en verde, lint limpio
Lo que pasa después es la demostración real: trabaja horas, se corrige, converge. Un trabajo que estimabas en dos semanas a mano se hace en una sola ejecución.
Ahí el premium es insustituible, porque la competencia en juego no es generar código. Es mantener el rumbo a lo largo de cientos de pasos sin desviarse. Un modelo más barato se cae por el camino.
Una precaución, aprendida a mi costa: en rama dedicada. Nunca en producción. Una ejecución autónoma de varias horas es algo que quieres poder tirar a la basura.
Modo B: la planificación extrema
Es el modo más rentable, y el más ignorado.
Coge un pipeline clásico: Research → Plan → Execute → Review → Ship.
La intuición dice hacerlo todo con el mejor modelo. Haz lo contrario: solo Research y Plan pasan por el modelo premium. Execute, Review y Ship se ejecutarán después, con uno más barato.
Por qué funciona: el plan se convierte en un activo duradero. Un buen plan contiene los pasos, las trampas y los criterios de "hecho". Una vez que existe, ejecutarlo ya no exige inteligencia, exige rigor. Y rigor sí tiene un modelo más barato.
Cada ejecutor barato hereda la calidad del planificador sin pagar su precio. Pagas el cerebro una vez y lo reutilizas diez.
El combo
Los dos modos se mezclan, y ahí es cuando la cosa se pone seria.
El modelo premium hace ahora todo lo que exige profundidad: el encuadre y la gran ejecución. El resto se ejecuta solo después, por una fracción del coste.
Lo que hay que retener de verdad
Hay una frase que resume esto mejor que cualquier comparativa de benchmarks:
Lo que tienes que aprender no es el modelo. Es el trabajo al que lo apuntas.
Los modelos frontier se han vuelto tan buenos que el límite ya no es su capacidad. El límite es tu capacidad de encuadrar el trabajo que les das.
Y esa competencia no caduca en el próximo lanzamiento.
Muestro los dos modos en el vídeo, sobre mis repos reales: Las 2 cosas que valen la pena con un modelo premium
Y si quieres este tipo de método cada semana, está en The Agentic Dev.