Anthropic bajó el costo real por tarea de Claude Sonnet 5.5 hasta 30% sin mover un centavo el precio de lista, pero si actualizas el model ID sin leer el changelog, tu agente en producción se cae con un error 400 en la cara.
El truco no es un descuento: el modelo usa menos tokens y hace menos tool calls para llegar al mismo resultado. Eso es bueno para tu factura y malo para tu código, porque la migración viene con cinco cambios de API que rompen integraciones existentes.
Mi postura, corta: el ahorro es real pero condicional, y el costo de migrar no lo paga Anthropic, lo pagas tú. Si tienes agentes corriendo, esto no es un update de una línea.
Qué pasó
Anthropic lanzó Claude Sonnet 5.5 el 28 de septiembre de 2026, una semana después de Opus 5.5 y justo en la víspera del DevDay de OpenAI. El precio de lista queda idéntico al de Sonnet 5: $2 por millón de tokens de entrada y $10 por millón de salida, con cache read a $0.20/M y cache write a $2.50/M.
Lo que cambia es la eficiencia. Anthropic afirma output más de 30% más rápido y hasta 30% menos costo por tarea, atribuido a menos tokens generados y menos llamadas a herramientas, no a un recorte de precio. En Terminal-Bench 4.0 el modelo marca 70.6% contra 10.3% de Sonnet 5, y en OSWorld 2.1 (computer use) salta a 80.1% desde 57.0%. Contexto de 1M tokens, salida máxima de 128K y cutoff de conocimiento en junio de 2026.
Disponible bajo el ID claude-sonnet-5-5 vía API de Anthropic, AWS Bedrock, Google Cloud y Microsoft Azure, con retención cero de datos. El Batch API mantiene 50% de descuento a $1/$5.
Qué significa
El número de marketing es 30%. El número que te importa depende de cómo lo configures. CodeRabbit midió $0.47 por review con Sonnet 5.5 contra $1.16 de Sonnet 5, casi 60% de ahorro. Pero Slack reportó apenas ~14% menos output tokens en sus evaluaciones de Slackbot, y Balyasny habla de 121.000 tokens contra 497.000 en su caso. El rango real va de 14% a 60% según la carga.
Y ojo con esto: Artificial Analysis sitúa a Sonnet 5.5 a máximo esfuerzo en $7.60 por tarea, más caro que Opus 5.5 ($5.98) y muy por encima de GPT-6 Sol ($1.06). Traducción: el ahorro vive en el nivel de esfuerzo medio, no en el techo. Si dejas el default en medium y no lo fijas explícitamente, estás jugando a la ruleta con tu presupuesto.
La estrategia de Anthropic es clara: hacer que el tier medio rinda casi como el premium para que dejes de escalar a Opus. Es el patrón de model routing que ya domina el mercado: modelo caro para lo ambiguo, modelo barato para ejecución repetida. Sonnet 5.5 es la pieza de ejecución.
Los benchmarks son vendor-published y Anthropic admite que Opus 5.5 sigue siendo superior en trabajo difícil y abierto. Trata el 30% como hipótesis a validar en tu pipeline, no como promesa.
Qué hacer al respecto
Antes de tocar el model ID, corre esta lista:
- Audita el código de thinking: thinking: disabled ahora devuelve error 400; usa between_tools. El tool_choice forzado ya no existe y el tool computer_20251124 es rechazado en Claude API y Google Cloud. Migra a computer_toolset_20260801.
- Revisa las UIs de progreso: el texto entre tool calls ahora llega en bloques de thinking ocultos por defecto. Sin configurar thinking.display a updates o summarized, tus tareas largas parecen congeladas sin lanzar error. Tus usuarios van a creer que se rompió.
- Re-corre el barrido de effort: el default bajó a medium. Fíjalo explícitamente por caso de uso, porque a max effort el costo por tarea puede superar a Opus 5.5.
- Revisa los pairings de advisor: Opus 4.8, Opus 4.7 y Sonnet 5 ya no pueden asesorar a un ejecutor Sonnet 5.5. Usa Opus 5/5.5, Fable o Sonnet 5.5.
- Presupuesta una regresión completa antes de mover agentes en producción, y arma routing: Sonnet 5.5 para ejecución repetida, Opus 5.5 solo para lo ambiguo de alto valor.
Si tu producto depende de computer use, la migración del tool es obligatoria, no opcional. Y si tienes dashboards que muestran progreso en vivo, esa UI se rompe silenciosamente: es el cambio más traicionero de los cinco.
Cierre
Claude Sonnet 5.5 es un buen modelo con un mal onboarding. El ahorro de costo por tarea es real si controlas el effort, y el dolor de migración también es real si actualizas a ciegas. La pregunta no es si migras, es cuándo y con cuánta regresión pagada por adelantado.
Cuéntame en los comentarios: ¿ya corriste tu barrido de effort con Sonnet 5.5 o seguís asumiendo que el default te está ahorrando plata? Si tienes un número de costo por tarea medido en tu propio pipeline, súbelo. Los benchmarks de laboratorio no pagan tus facturas.
Preguntas frecuentes
¿Claude Sonnet 5.5 bajó el precio?
No. El precio de lista es idéntico a Sonnet 5: $2 por millón de tokens de entrada y $10 por millón de salida. El ahorro de hasta 30% por tarea viene de menos tokens y menos tool calls, no de un descuento.
¿Qué cambios de API rompen el código al migrar a Claude Sonnet 5.5?
Cinco: thinking disabled devuelve error 400, el tool_choice forzado desaparece, el tool computer_20251124 es rechazado, los bloques de thinking quedan ocultos por defecto y los pairings de advisor cambian (Opus 4.8, 4.7 y Sonnet 5 ya no asesoran a Sonnet 5.5).
¿Sonnet 5.5 es más barato que Opus 5.5 en la práctica?
Depende del effort. Artificial Analysis mide $7.60 por tarea a máximo esfuerzo para Sonnet 5.5 contra $5.98 de Opus 5.5. A effort medio el ahorro aparece; a max effort puede salir más caro.
¿Dónde está disponible Claude Sonnet 5.5?
Vía API de Anthropic, AWS Bedrock, Google Cloud y Microsoft Azure bajo el ID claude-sonnet-5-5, con retención cero de datos y Batch API con 50% de descuento.
Fuentes
- Anthropic launches Claude Sonnet 5.5 with 30% cost reduction per-task — VentureBeat
- Anthropic Releases Claude Sonnet 5.5 at Unchanged Sonnet 5 Pricing — Unite.AI
- Claude Sonnet 5.5 Review: Specs, Benchmarks, Pricing and Cost per Task — Kingy AI
- Sonnet 5.5 vs Opus 5.5 Code Review Benchmarks — CodeRabbit
- Introducing Claude Sonnet 5.5 on AWS — Amazon Web Services