Claude Sonnet 5.5 llega 30% más rápido y sin subir el precio
Claude Sonnet 5.5 salió el 28 de septiembre con el mismo precio de su antecesor: US$2 por millón de tokens de entrada y US$10 de salida. Anthropic afirma que corre un 30% más rápido y que cuesta hasta un 30% menos por tarea, con 70,6% en Terminal-Bench 4.0. Es su segundo lanzamiento en menos de una semana.
Qué cambió y qué no
La tarifa no se movió. Eso es lo primero que hay que fijar, porque el titular de «30% más barato» se presta a confusión.
El ahorro que anuncia Anthropic no viene de un precio menor por token. Viene de dos cosas distintas: el modelo responde más rápido y necesita menos llamadas a herramientas para terminar la misma tarea. Menos llamadas significa menos tokens gastados en ida y vuelta, y de ahí sale la cuenta.
En rendimiento, la cifra que la empresa destaca es 70,6% en Terminal-Bench 4.0, una prueba de tareas de terminal. Además, Anthropic indicó que no añadió barreras de seguridad nuevas respecto al modelo anterior.
Por qué Claude Sonnet 5.5 llega tan pronto
Opus 5.5 había salido apenas el 22 de septiembre. Dos modelos en siete días es un ritmo que dice más del mercado que del laboratorio.
Por otro lado, el momento no es neutro: OpenAI presentó GPT-6.1 Sol al día siguiente, con un recorte de precio agresivo. Los dos anuncios compiten por la misma decisión de compra, y los dos escogieron hablar de costo antes que de capacidad.
Qué significa para América Latina
Ojo con el 30%: es por tarea, no por token. Ese ahorro solo se materializa si su flujo usa muchas llamadas a herramientas. Si su caso es generación de contenido en lote, clasificación simple o resumen —sin herramientas de por medio—, la factura no baja ni un peso. Es la letra pequeña más importante del anuncio.
La forma de comprobarlo es medir, no leer. Antes de migrar, corra veinte entregables reales de su operación con el modelo actual y anote tokens totales por entregable. Repita con el nuevo. Esa comparación de quince minutos vale más que cualquier prueba publicada, porque mide su caso y no el promedio.
Y la velocidad sí importa si atiende clientes. En un chat de atención o en un agente de voz, 30% más rápido se nota en la conversación. En un proceso por lotes que corre de madrugada, no cambia nada. Sepa en cuál de los dos está antes de pagar por migrar.
Claude Sonnet 5.5 y una pelea por precio
Lo interesante de esta semana no es ningún modelo en particular. Es que los dos grandes anuncios —este y el de OpenAI— tuvieron el mismo eje: rendimiento por dólar.
Eso pasa cuando las capacidades se parecen lo suficiente como para que el comprador deje de escoger por calidad. Para el usuario es la mejor fase posible del mercado.
Ahora bien, no dura para siempre. Los mismos documentos financieros que se conocieron esta semana muestran compromisos de infraestructura enormes detrás de estos precios. Conviene aprovechar la etapa barata sin firmar contratos largos que la asuman permanente.
Sitio oficial:
Anuncios de Anthropic
Reportado por: VentureBeat — MarkTechPost — Simon Willison
Lee también:
Grok 4.7: mismo precio, mejor rendimiento
Los límites de uso de la IA empezaron a bajar
