Claude Opus, Sonnet o Haiku: coste por tarea de código

El precio por millón de tokens solo explica una parte del coste de programar con un agente. La otra es cuántos tokens necesita cada modelo para terminar el trabajo.

La factura de una tarea de código combina dos cifras: el precio de los tokens del modelo elegido y los tokens que consume hasta terminar. La tarifa publicada da la primera; la segunda depende de cómo trabaja el modelo.

Un modelo que cuesta el doble por token y termina usando la mitad cuesta lo mismo. Otro más barato que lee tres archivos adicionales, se equivoca y necesita un reintento puede salir más caro.

Precios de catálogo en septiembre de 2026

Anthropic cobra por millón de tokens, con tarifas distintas para entrada nueva, escritura y lectura de caché, y salida. Estos son sus precios públicos de API a septiembre de 2026.

ModeloEntradaSalidaLectura de cachéEscritura en caché 5 minEscritura en caché 1 hContexto
Claude Haiku 4.51,005,000,101,252,00200.000
Claude Sonnet 52,0010,000,202,504,001.000.000
Claude Sonnet 4.63,0015,000,303,756,001.000.000
Claude Opus 4.65,0025,000,506,2510,001.000.000
Claude Opus 4.75,0025,000,506,2510,001.000.000
Claude Opus 4.85,0025,000,506,2510,001.000.000
Claude Opus 55,0025,000,506,2510,001.000.000
Claude Opus 5.54,0020,000,205,008,001.000.000
Claude Fable 510,0050,001,0012,5020,001.000.000
Claude Fable 5.110,0050,000,2512,5020,001.000.000
Precios de lista de la API de Claude de Anthropic, en dólares estadounidenses por millón de tokens, verificados el 23 de septiembre de 2026.

Para un agente de código, tres detalles importan más que el precio principal de entrada:

  • Lecturas de caché. El agente reenvía el historial en cada turno y suele leerlo de la caché. La mayoría de modelos paga una décima parte de la entrada normal; Fable 5.1, una cuadragésima parte. Opus 5.5 paga una vigésima parte, 0,20 dólares por millón, lo mismo que Sonnet 5.
  • Salida, incluido el razonamiento. Cuesta cinco veces más que la entrada en todos los modelos y los tokens de razonamiento se facturan como salida.
  • El precio de Sonnet 5. Sus tarifas de 2 y 10 dólares se anunciaron como introductorias, pero Anthropic las hizo permanentes; la subida prevista para septiembre de 2026 no se produjo.

La otra mitad: tokens por tarea terminada

El consumo por tarea cambia con el modelo. Si explora más, lee más archivos, que siguen en el contexto durante los turnos siguientes. Una respuesta errónea gasta tokens y luego exige volver a gastar en el reintento. Un razonamiento más largo se cobra a tarifa de salida.

La guía de costes de Anthropic observa que un modelo más capaz puede completar un trabajo con menos turnos, búsquedas y rectificaciones. En un subconjunto de SWE-bench Pro, Fable 5.1 con esfuerzo bajo resolvió el 88,6 % a 0,54 dólares por tarea resuelta, frente al 77,4 % y 0,84 dólares de Sonnet 5 con su ajuste predeterminado, aunque Fable costaba cinco veces más por token. En otras tareas se invierte el orden.

Coste medido por pregunta y modelo

La tabla mide ambos factores en un repositorio real: las mismas preguntas breves, formuladas a Claude Code con cada modelo y repetidas tres veces, con el coste equivalente de API que informa el propio agente. Los tokens ponderados cuentan las lecturas de caché a una décima parte. También aparecen las mismas preguntas enviadas con capsul; la página del banco de pruebas explica el método.

ModeloEntrada, sin capsulEntrada, con capsulCoste, sin capsulCoste, con capsulMenos entrada
Claude Haiku 4.555.50019.3000,0812 US$0,0265 US$x2.88
Claude Sonnet 554.20018.9000,153 US$0,0487 US$x2.86
Claude Sonnet 4.631.40016.6000,139 US$0,0613 US$x1.89
Claude Opus 4.645.70016.4000,332 US$0,101 US$x2.78
Claude Opus 4.738.70020.1000,28 US$0,126 US$x1.92
Claude Opus 4.865.80013.8000,498 US$0,0825 US$x4.75
Claude Opus 545.30016.2000,343 US$0,101 US$x2.80
Claude Opus 5.542.30015.9000,222 US$0,0696 US$x2.66
Claude Fable 541.40017.6000,633 US$0,219 US$x2.35
Claude Fable 5.149.70023.4000,636 US$0,279 US$x2.12
Modelos Claude en Claude Code: tokens de entrada ponderados por caché y coste equivalente de API por pregunta de programación de una línea, agente solo o con capsul. Calculado a partir de los conjuntos publicados: campaña de Claude del 22 de septiembre de 2026, campaña de Codex del 4 de septiembre de 2026.

Cómo leer la tabla:

  • Empieza por la columna de Claude Code solo: cuánto gastó cada modelo para responder a su precio de catálogo.
  • Compara modelos con las mismas tarifas. Opus 4.6, 4.7, 4.8 y 5 cuestan 5 y 25 dólares por millón; las diferencias entre ellos proceden del consumo de tokens, que en estas mediciones es amplio.
  • Entre generaciones, compara dólares antes que tokens. Los modelos 4.7 y posteriores cuentan más tokens para el mismo texto, lo que favorece artificialmente en un recuento bruto a Haiku 4.5, Sonnet 4.6 y Opus 4.6.
  • Lee el coste junto a las comprobaciones de respuesta. Una pregunta barata que no contiene la respuesta esperada no es barata por respuesta correcta.
  • El precio por token no predice el ganador. Aquí Sonnet 5 no sale más barato por pregunta que Sonnet 4.6 en Claude Code solo, porque consumió más tokens. En el banco de Anthropic ocurre lo contrario. La tarea cambia el resultado.

El tokenizador cambió con Claude 4.7

La página de precios de Anthropic indica que Claude 4.7 y posteriores usan un tokenizador que produce aproximadamente un 30 % más de tokens para el mismo texto, según el contenido. En la tabla afecta a Opus 4.7, 4.8, 5 y 5.5, Sonnet 5 y los Fable; Opus 4.6, Sonnet 4.6 y Haiku 4.5 usan el anterior.

Así, dos precios por token de generaciones distintas no son directamente comparables. El mismo prompt ya contiene más tokens en los modelos nuevos antes de que hagan trabajo alguno. Anthropic recomienda comparar el coste por tarea resuelta.

El esfuerzo es el segundo ajuste

Dentro de un modelo, el esfuerzo influye en cuánto razona, cuántas llamadas a herramientas hace y cuánto escribe. Los niveles van de low a max, pasando por medium, high y xhigh. El razonamiento se cobra como salida.

A septiembre de 2026, Claude Code usa high por defecto en los modelos compatibles, salvo Opus 5.5 en medium y Opus 4.7 en xhigh. Haiku 4.5 no tiene ajuste de esfuerzo. Opus 5.5 y Fable siempre razonan, por lo que el esfuerzo es su principal control de profundidad.

Anthropic considera Sonnet 5 en medium comparable a Sonnet 4.6 en high. Un esfuerzo alto puede mejorar tareas de código largas; en trabajos sencillos paga una profundidad que no se necesita.

/effort medium

Fija el esfuerzo en Claude Code; /effort sin argumento abre el control.

Qué modelo elegir para cada trabajo

  • Haiku 4.5 para cambios mecánicos y comprobables: renombrar, formatear, editar un archivo o localizar un dato. Es el más barato por token y tiene una ventana de 200.000 tokens, frente al millón de los modelos mayores. Consulta las fechas de retirada antes de basar un flujo duradero en él.
  • Sonnet 5 para el trabajo cotidiano. Anthropic indica que resuelve bien la mayoría de tareas de programación y cuesta menos que Opus. Por token, cobra la mitad que Opus 5.5 salvo en lecturas de caché, donde empatan.
  • Opus para problemas difíciles: refactorizaciones amplias, depuración compleja y decisiones de arquitectura. A septiembre de 2026, Opus 5.5 es el modelo predeterminado de Claude Code en Pro, Max, Team, Enterprise y API.
  • Fable para tareas especialmente difíciles o prolongadas. Es el más caro por token; Anthropic sugiere comenzar trabajo de agente con Fable 5.1 en esfuerzo low y aumentarlo si falla. Según el plan, su uso puede cobrarse con créditos; /model lo indica.

Cambiar de modelo en Claude Code

Dentro de una sesión, /model seguido de un alias cambia inmediatamente. /model solo abre un selector que permite ajustar el esfuerzo. claude --model elige el modelo al arrancar; también puedes fijarlo en la configuración o con ANTHROPIC_MODEL. Los alias principales son haiku, sonnet, opus, fable y opusplan, que usa Opus para planificar y Sonnet para ejecutar.

/model sonnet

Cambia la sesión actual al Sonnet más reciente.

claude --model haiku

Inicia una sesión nueva en Haiku.

Cambia al empezar la tarea. Cada modelo tiene su propia caché, así que tras un cambio la siguiente petición relee la conversación sin aciertos, un coste alto en sesiones largas. Cada alternancia de modo bajo opusplan provoca ese cambio; en la mayoría de modelos, cambiar el esfuerzo a mitad de sesión también rompe la caché. Para subagentes sencillos, Anthropic recomienda model: haiku.

Si buscas reducir lo que acompaña a cada pregunta, capsul admite los mismos nombres de modelo y envía fragmentos breves, lo que pide la tarea en vez del repositorio. Su columna de la tabla muestra el resultado medido.

capsul ask 'rename userId to accountId in the auth module' --model haiku

Usa la CLI de Claude con la sesión ya iniciada y el modelo indicado.

Preguntas

¿Merece la pena usar Opus en Claude Code?

En problemas difíciles, a menudo sí: terminar con menos turnos y rectificaciones puede compensar su precio por token. Para ediciones rutinarias suele pagar profundidad innecesaria. A septiembre de 2026, Opus 5.5 es el modelo predeterminado de Claude Code en Pro, Max, Team, Enterprise y API; comprueba /model antes de asumir que usas otro.

¿Cuál es el modelo Claude más barato para programar?

Por token, Haiku 4.5: a septiembre de 2026 cuesta 1 dólar por millón de tokens de entrada y 5 por millón de salida en la API de Anthropic. Por tarea depende del consumo y de si acierta. Es una buena opción para cambios mecánicos que puedas comprobar, no necesariamente para trabajos de agente largos.

¿Es Sonnet 5 más barato que Opus 5.5?

A septiembre de 2026, Sonnet 5 cuesta la mitad por token de entrada nueva, escritura de caché y salida. Ambos cobran 0,20 dólares por millón en lecturas de caché, una parte importante de las peticiones de un agente. El coste por tarea depende además de cuántos turnos y tokens necesite cada uno.

¿Por qué un mismo prompt usa más tokens en los Claude nuevos?

Según Anthropic, Claude 4.7 y posteriores usan un tokenizador que produce aproximadamente un 30 % más de tokens para el mismo texto, aunque depende del contenido. Opus 4.6, Sonnet 4.6 y Haiku 4.5 usan el anterior. Compara el coste por tarea, no solo el recuento.

¿El nivel de esfuerzo cambia el coste de una tarea?

Sí. Controla cuánto razona el modelo y puede cambiar sus llamadas a herramientas y la longitud de salida; el razonamiento se cobra como salida. En Claude Code se ajusta con /effort o desde /model. A septiembre de 2026, la mayoría usa high por defecto, Opus 5.5 usa medium y Haiku 4.5 no tiene ese ajuste.

$ npm i -g @penra/capsul

← Todas las guías