Claude Sonnet 5.5 es el modelo de enfoque en eficiencia de Anthropic para el trabajo profesional cotidiano. Lanzado el 28 de septiembre de 2026, se sitúa por debajo de Opus 5.5 para los problemas abiertos más difíciles, pero aporta mejoras significativas en programación, creación de documentos, comprensión de imágenes y tareas de larga duración. Los cambios más prácticos son directos: Anthropic afirma que genera salidas con más de un 30% de rapidez que Sonnet 5, mantiene los mismos precios de tokens de la API y puede costar hasta un 30% menos por tarea completada porque a menudo utiliza menos tokens.
Está diseñado para personas que quieren un modelo capaz para trabajos bien definidos sin pagar Opus en cada solicitud. Elegir el modelo rara vez se trata solo de lograr el puntaje máximo del benchmark; la latencia, los reintentos, el uso de tokens y la revisión humana pueden influir más en el costo real de un flujo de trabajo.
Claude Sonnet 5.5 en un vistazo
| Detalle | Claude Sonnet 5.5 |
|---|---|
| Fecha de lanzamiento | 28 de septiembre de 2026 |
| Nombre del modelo de API | claude-sonnet-5-5 |
| Precio de entrada estándar | $2 por 1M de tokens |
| Precio de salida estándar | $10 por 1M de tokens |
| Precio de lectura de caché | $0.20 por 1M de tokens |
| Precio de escritura de caché | $2.50 por 1M de tokens |
| Mejor para | Programación bien delimitada y tareas profesionales |
| Disponibilidad | Productos de Claude, Claude Platform, AWS, Google Cloud y Microsoft Azure |
Estas cifras provienen del anuncio de Sonnet 5.5 de Anthropic. Los precios y condiciones de acceso de los proveedores en la nube pueden variar, así que los equipos deberían revisar la plataforma que realmente usan antes de estimar costos de producción.
¿Qué cambió respecto a Sonnet 5?
La actualización es más fuerte cuando un modelo debe realizar trabajo en lugar de simplemente responder una pregunta. Anthropic destaca la corrección de errores, documentos pulidos, presentaciones, hojas de cálculo, diseño visual y tareas más largas. Sonnet 5.5 también admite un esfuerzo ajustable: configuraciones más bajas priorizan la velocidad y el menor uso de tokens, mientras que configuraciones más altas permiten más razonamiento y verificación. Anthropic configura Medium como predeterminado en Claude Code y en sus aplicaciones, mientras que Claude Platform usa High por defecto.
Las afirmaciones principales sobre velocidad y costo requieren una redacción cuidadosa. “30%+ más rápido” se refiere a la generación de salida en comparación con Sonnet 5. “Hasta un 30% menos” se refiere al costo por tarea observado por Anthropic, no a un descuento en cada token. El precio de API indicado se mantiene en $2 por un millón de tokens de entrada y $10 por un millón de tokens de salida; por lo tanto, el ahorro real depende de si el nuevo modelo termina tu trabajo con respuestas más breves, menos reintentos o menos llamadas a herramientas.

Benchmarks de Claude Sonnet 5.5
Anthropic publicó varias evaluaciones que abarcan programación orientada a agentes y trabajo de conocimiento. Muestran una mejora grande sobre Sonnet 5 en algunos entornos y resultados cercanos a Opus en otros.
| Benchmark | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% | No reportado |
| FrontierCode 1.1 Main | 46.2% en Max | 42.4% | 54.4% | 49.3%; 52.1% en Xhigh |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | No reportado |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
La tabla es útil, pero no es un ranking universal. Los ajustes de esfuerzo, los entornos de agentes, las herramientas, las salvaguardas y los métodos de puntuación varían. Anthropic también señala que más razonamiento no siempre mejora los resultados: en FrontierCode, a veces Sonnet 5.5 en Max hizo cambios fuera del alcance solicitado. La mejor configuración produce un resultado aceptable con ediciones controladas, no necesariamente la que consume más cómputo.
Programación y trabajo con agentes
El resultado de 70.6% de Sonnet 5.5 en Terminal-Bench 4.0 es el dato más llamativo del lanzamiento, pero el flujo de trabajo que lo rodea importa más que el titular. Para un desarrollador, un modelo de programación útil debe entender el repositorio, realizar un cambio específico, ejecutar las verificaciones adecuadas y detenerse antes de ampliar la tarea. La velocidad solo es valiosa cuando la salida sigue siendo fácil de revisar.
Eso convierte a Sonnet 5.5 en un candidato sensato para trabajos acotados, como diagnosticar un bug, implementar una función definida con claridad, revisar una pull request o refactorizar un componente conocido. Las migraciones grandes y las decisiones arquitectónicas ambiguas aún podrían beneficiarse de Opus 5.5, que Anthropic posiciona explícitamente para el juicio sostenido. Por lo tanto, una evaluación justa debería usar tareas reales del repositorio y medir la corrección, las ediciones innecesarias, el tiempo transcurrido, los tokens totales y el tiempo de revisión humana.
Documentos, hojas de cálculo y trabajo de conocimiento
El lanzamiento es igual de relevante fuera del desarrollo de software. Anthropic describe a Sonnet 5.5 como fuerte para crear documentos, diapositivas y hojas de cálculo, mientras que los resultados de GDPval-AA y AA-Briefcase están pensados para reflejar trabajo profesional de conocimiento. Esas puntuaciones no demuestran que cada informe vaya a ser preciso, pero respaldan probar el modelo en tareas estructuradas con material de origen claro y un entregable verificable.
Un flujo de trabajo práctico podría comenzar con varios informes, notas de reuniones y una hoja de cálculo, y luego pedirle al modelo que identifique acuerdos y contradicciones, extraiga cifras con referencias de fuente y redacte un resumen ejecutivo. La salvaguarda clave es la verificación: las afirmaciones numéricas deben comprobarse con la fuente, y las conclusiones con impacto aún necesitan revisión humana calificada. Si el primer desafío es organizar material de fuentes mixtas, el AI Summarizer de iWeaver puede ayudar a convertir PDFs, documentos, páginas web, audio, imágenes y video en resúmenes o notas estructuradas antes de un análisis más profundo.
Precios en contexto
Sonnet 5.5 y GPT-6 Sol comparten el mismo precio de lista estándar: $2 por un millón de tokens de entrada y $10 por un millón de tokens de salida. Opus 5.5 cuesta $4 y $20, respectivamente. Estas cifras hacen que Sonnet sea atractivo para tareas repetidas y bien definidas, pero una comparación por tasa de tokens es incompleta. El tamaño del contexto, el caché, los cargos por herramientas, el esfuerzo de razonamiento, los intentos fallidos y la longitud de la salida afectan la factura final.
Para la evaluación en producción, elige un conjunto representativo de tareas y registra el costo total de cada tarea, en lugar del precio por token únicamente. Un modelo más barato que requiere correcciones repetidas puede costar más de lo esperado, mientras que un modelo más caro puede resultar económico si completa una tarea de alto valor en una sola pasada. El mismo conjunto de pruebas también debería repetirse después de actualizaciones del modelo, porque el comportamiento del proveedor y las configuraciones de servicio pueden cambiar.
¿Vale la pena usar Claude Sonnet 5.5?
Sonnet 5.5 vale la pena probarlo si la mayor parte de tu trabajo está claramente delimitado y valoras la capacidad de respuesta, el precio de API predecible y un desempeño sólido en programación o documentos. Es menos evidente que sea la opción predeterminada correcta cuando el problema es ambiguo, el costo de un error sutil es alto o la tarea depende de un juicio sostenido a través de muchas etapas; en esos casos, el rol encaja más con el que Anthropic declara para Opus 5.5.
La conclusión más fuerte no es que Sonnet 5.5 “supere” todas las alternativas. Es que Anthropic ha reducido la brecha entre sus niveles cotidiano y premium, manteniendo una diferencia de precio significativa. Usa los benchmarks para decidir qué merece una prueba y luego elige según tus propias fuentes, tus prompts, tus estándares de revisión y el costo total de las tareas. Para una decisión directa por nivel, consulta Claude Sonnet 5.5 vs Opus 5.5; para ideas de configuración, continúa con How to Use Claude Sonnet 5.5.
