Última actualización: Septiembre 2026
¿Qué cambia en Claude Sonnet 5.5 y le conviene a tu equipo dejar Sonnet 5?
Claude Sonnet 5.5 es el nuevo modelo de gama media de Anthropic, lanzado el 28 de septiembre de 2026. Mantiene el precio de Sonnet 5 (2 $ / 10 $ por millón de tokens), genera salidas más de un 30 % más rápido y cuesta hasta un 30 % menos por tarea al usar menos tokens y herramientas. También es el primer Sonnet con salvaguardas de ciberseguridad de nivel frontera y clasificadores anti-destilación.
La letra pequeña está en la seguridad y la integración: ciertas peticiones pasan a Sonnet 5, el thinking queda ligado a tu cuenta y la API cambia. Esta guía cubre solo lo nuevo. Para Sonnet 5, lee nuestro análisis de seguridad de Claude Sonnet 5.
TL;DR: puntos clave
- Mismo precio, más velocidad: 2 $ / 10 $ por millón de tokens, como Sonnet 5, con salidas "un 30 % más rápidas", según la página de lanzamiento de Anthropic.
- Menor coste por tarea: hasta un 30 % menos. CodeRabbit midió 0,47 $ por revisión frente a 1,16 $ con Sonnet 5 en su análisis independiente.
- Benchmarks casi de Opus: Sonnet 5.5 logra un 70,6 % en Terminal-Bench 4.0 (Sonnet 5: 10,3 %; Opus 5.5: 66,4 %), según datos de Anthropic.
- Ciberseguridad: las peticiones de mayor riesgo pasan de forma visible a Sonnet 5, según la tarjeta del sistema de Sonnet 5.5.
- Anti-destilación: primer Sonnet que bloquea la extracción del razonamiento; el thinking solo funciona en la cuenta que lo generó, según la documentación de preserved thinking.
Sonnet 5 vs Sonnet 5.5: qué ha cambiado
Sonnet 5.5 mejora velocidad, eficiencia, capacidad y salvaguardas, y conserva el precio, el contexto y el límite de salida de Sonnet 5.
| Claude Sonnet 5 | Claude Sonnet 5.5 | |
|---|---|---|
| Lanzamiento | 30/06/2026 (legacy) | 28/09/2026 |
| Precio API (entrada / salida por 1M) | 2 $ / 10 $ | 2 $ / 10 $ (sin cambios) |
| Caché: lectura / escritura 5 min | 0,20 $ / 2,50 $ | 0,20 $ / 2,50 $ |
| Prompt mínimo cacheable | 1.024 tokens | 512 tokens |
| Velocidad de salida | Referencia | +30 % |
| Coste por tarea | Referencia | Hasta -30 % (fabricante) |
| Contexto / salida máxima | 1M / 128K | 1M / 128K |
| Corte de conocimiento | Enero 2026 | Junio 2026 |
| Terminal-Bench 4.0 | 10,3 % | 70,6 % |
| Salvaguardas de ciberseguridad | Nivel Sonnet | Tipo Opus, con fallback a Sonnet 5 |
| Bloqueo de extracción del razonamiento | No | Sí, sin fallback |
| Thinking ligado a la cuenta | No | Sí |
Fuentes: Sonnet 5.5; Sonnet 5; novedades de Sonnet 5.5; Anthropic.
Velocidad: salidas un 30 % más rápidas y esfuerzo recalibrado
Sonnet 5.5 genera salidas más de un 30 % más rápido que Sonnet 5 y es, según Anthropic, su Sonnet más rápido. Además resuelve en menos pasos, así que los agentes terminan antes.
Dónde se nota la velocidad
En el anuncio de Anthropic, Box habla de "2,4 veces más rápido" y Zendesk de tickets procesados "un 20 % más rápido". En la prueba de CodeRabbit, el tiempo medio de revisión bajó de 9:55 a 5:27, según CodeRabbit (2026).
Niveles de esfuerzo que debes volver a probar
Claude Code y las apps usan esfuerzo Medium por defecto; la API usa High. La guía de migración indica que los niveles "están recalibrados" y recomienda Medium para agentes sensibles a la latencia. Repite tus pruebas antes de producción.
Precio de Claude Sonnet 5.5 y coste por tarea
El precio de Claude Sonnet 5.5 es idéntico al de Sonnet 5: 2 $ de entrada, 10 $ de salida y 0,20 $ en lecturas de caché por millón de tokens. El ahorro depende de tu carga de trabajo.
Tarifas de la API
| Por 1M de tokens | Sonnet 5 | Sonnet 5.5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Entrada | 2 $ | 2 $ | 4 $ | 2 $ |
| Salida | 10 $ | 10 $ | 20 $ | 10 $ |
| Lectura de caché | 0,20 $ | 0,20 $ | 0,20 $ | 0,20 $ |
| Escritura de caché (5 min) | 2,50 $ | 2,50 $ | 5 $ | 2,50 $ |
| Descuento batch | 50 % | 50 % | 50 % | 50 % |
Fuentes: precios de Claude; ficha del modelo; documentación de GPT-6 Sol. Precios de lista en EE. UU., septiembre de 2026.
El prompt mínimo cacheable baja a 512 tokens. GPT-6 Sol cobra el doble en entrada por encima de 272K tokens, según OpenAI.
Cuánto baja el coste por tarea
Con esfuerzo Medium, Sonnet 5.5 supera la mejor puntuación de Sonnet 5 en Terminal-Bench 4.0 por menos de una décima parte del coste por tarea, según Anthropic.
| Fuente | Sonnet 5 | Sonnet 5.5 | Cambio |
|---|---|---|---|
| CodeRabbit, coste por revisión | 1,16 $ | 0,47 $ | Un 60 % menos, aprox. |
| CodeRabbit, tokens de salida por llamada | 21,6K | 5,8K | Un 73 % menos, aprox. |
| Balyasny, tokens por respuesta financiera | 497K | 121K | Un 76 % menos, aprox. |
Fuentes: CodeRabbit; Anthropic. Cifras autodeclaradas.
Según VentureBeat (2026), el modelo "usa menos tokens y menos llamadas a herramientas", como detalla su crónica. Para el presupuesto, consulta nuestra guía de optimización de tokens.
Benchmarks de Claude Sonnet 5.5 frente a Sonnet 5, Opus 5.5 y GPT-6 Sol
Claude Sonnet 5.5 queda a pocos puntos de Opus 5.5 en casi todos los benchmarks de Anthropic y lo supera en Terminal-Bench 4.0. Son cifras del fabricante, aún sin verificación independiente.
| Benchmark | Sonnet 5 | Sonnet 5.5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 10,3 % | 70,6 % | 66,4 % | No publicado |
| CursorBench 4.0 | 34,1 % | 55,5 % | 57,8 % | No publicado |
| FrontierCode 1.1 (Max) | 42,4 % | 46,2 % (52,1 % en Xhigh) | 54,4 % | 49,3 % |
| GDPval-AA v2.1 (Elo) | 1449 | 1844 | 1846 | 1487 |
| OSWorld 2.1 (crédito parcial) | 57,0 % | 80,1 % | 81,8 % | No publicado |
| Humanity's Last Exam (con herramientas) | 54,9 % | 64,5 % | 67,7 % | No publicado |
| Chartography (sin herramientas) | 15,6 % | 61,6 % | 64,4 % | 53,6 % |
Fuente: Anthropic (28/09/2026). Cifras del fabricante.
Según The Decoder (2026), "las pruebas independientes aún tienen que confirmar estas afirmaciones", y el 10,3 % de Sonnet 5 parece anormalmente bajo. El mismo medio atribuye a timeouts que Max puntúe menos que Xhigh en FrontierCode.
Comparación con GPT-6 Sol
OpenAI lanzó GPT-6 Sol el 22 de septiembre de 2026 al mismo precio, 2 $ / 10 $, según VentureBeat. OpenAI declara un 68,8 % en DeepSWE 1.1 y un 60,5 % en OSWorld 2.0 para Sol en su anuncio. Son versiones distintas a las de Anthropic y no se comparan directamente.
Cómo hemos hecho la comparación
Usamos solo fuentes publicadas y fechadas, y señalamos las cifras del fabricante. No hicimos pruebas propias.
Las nuevas salvaguardas de ciberseguridad y anti-destilación
Sonnet 5.5 es el primer Sonnet que Anthropic lanza con bloqueos de ciberseguridad al estilo Opus. Lo de mayor riesgo pasa a Sonnet 5, la extracción del razonamiento se bloquea y el thinking no funciona fuera de su cuenta.
Por qué llegan ahora
En CyScenarioBench, Sonnet 5.5 completó el 46,1 % de los retos frente al 0,7 % de Sonnet 5, y logró 50 secuestros del flujo de control en explotación binaria frente a 3, según la tarjeta del sistema. Por eso Anthropic aplica "salvaguardas similares a las de Opus 5.5".
Cómo funciona el fallback
La corrección rutinaria de bugs sigue en Sonnet 5.5. Lo que los clasificadores marcan como de mayor riesgo pasa a Sonnet 5, y los bloqueos son transparentes.
| Categoría de rechazo | Qué la activa | Fallback automático |
|---|---|---|
cyber | Posible daño de ciberseguridad | Sí, a Sonnet 5 (opcional en la API) |
frontier_llm | Ayuda a modelos de IA competidores | Sí, a Sonnet 5 (opcional en la API) |
reasoning_extraction | Pide reproducir el razonamiento interno | No |
bio y general_harms | Daño biológico y otros usos prohibidos | No |
Fuente: novedades de Claude Sonnet 5.5 (septiembre de 2026).
En la API, un bloqueo devuelve stop_reason: "refusal" con su categoría en stop_details. El fallback es una beta opcional (fallbacks: "default") solo en la API de Claude. La tarjeta avisa de que otras plataformas pueden comportarse distinto, así que prueba aparte en Amazon Bedrock, Google Cloud o Microsoft Foundry.
Los equipos de defensa podrán pedir más margen en el Cyber Verification Program, al que Sonnet 5.5 se sumará pronto. Las cuentas con retención de datos cero no pueden acceder, según el centro de ayuda de Anthropic.
Anti-destilación y thinking ligado a la cuenta
La destilación usa "miles de cuentas falsas para extraer las capacidades de un modelo a escala industrial", según Anthropic. Sonnet 5.5 es el primer Sonnet que la bloquea con clasificadores, sin fallback.
Su thinking queda además ligado a la cuenta: solo funciona en la cuenta que lo generó o en una vinculada, y si otra cuenta lo envía, la API lo descarta. En agosto de 2026, unos investigadores descifraron 315.320 bloques de thinking de 6.708 trazas públicas de agentes y recuperaron 62 claves de API y 7 claves privadas, según The Hacker News.
Qué deben cambiar los desarrolladores al migrar
Migrar no es solo cambiar el ID del modelo. Prueba antes estos cambios incompatibles.
| Cambio | Impacto | Qué hacer |
|---|---|---|
| Sin uso forzado de herramientas | tool_choice "any" o una herramienta concreta da 400 | Usa auto con strict: true |
| Sin parámetros de muestreo | temperature, top_p y top_k dan 400 | Elimínalos |
| Historial append-only | Editarlo invalida el thinking | No lo edites o usa drop_block |
| Streaming más silencioso | El texto entre herramientas llega como thinking | Revisa tus interfaces |
Fuentes: guía de migración; novedades de Sonnet 5.5.
Un proxy que reescriba mensajes anteriores rompe el thinking: tenlo en cuenta en tu enrutamiento de modelos LLM.
Seguridad y gobernanza: cómo ejecutar agentes con Sonnet 5.5
Sonnet 5.5 es más difícil de secuestrar que Sonnet 5, pero las defensas del modelo no sustituyen tus controles. La fuga de datos y el mal uso de herramientas siguen siendo cosa tuya.
Qué muestra la tarjeta del sistema
| Prueba de prompt injection | Sonnet 5 | Sonnet 5.5 |
|---|---|---|
| Gray Swan, inyección indirecta (1 / 10 / 15 intentos) | 0,7 % / 5,1 % / 6,7 % | 0,4 % / 2,7 % / 3,4 % |
| Código, atacante adaptativo | 19,47 % | 3,01 % |
| Uso del ordenador | 2,25 % | 0,07 % |
| Rechazos de peticiones legítimas (API / claude.ai) | 0,59 % / 1,54 % | 0,02 % / 0,20 % |
Fuente: tarjeta del sistema de Sonnet 5.5 (28/09/2026), sin salvaguardas activadas. La prueba de código se rehízo en agosto de 2026.
Anthropic sitúa a Sonnet 5.5 en sus umbrales CB-1 y Autonomy-1. Nuestro análisis de Sonnet 5 cubre el punto de partida: menos del 1 % de inyección en navegador y cero exploits completos en ExploitBench.
Los riesgos que siguen siendo tuyos
- Prompt injection (OWASP LLM01): prompts que alteran el comportamiento del LLM de forma no prevista, incluidas instrucciones ocultas en archivos y webs, según OWASP LLM01:2025. Un 3,4 % es poco, pero no cero; nuestra guía de prompt injection indirecta explica el ataque.
- Fuga de datos y mal uso de herramientas: según Gartner (2026), en 2028 el 25 % de las aplicaciones empresariales de IA generativa sufrirá al menos cinco incidentes menores al año, frente al 9 % en 2025 (nota de abril).
- Brechas de gobernanza: Gartner prevé que en 2027 el 40 % de las empresas degradará o retirará agentes autónomos por fallos de gobernanza detectados tras un incidente (nota de mayo).
Cómo protege NeuralTrust los despliegues de Sonnet 5.5
El Runtime Security Mesh de NeuralTrust añade controles que no dependen de la versión de Claude que uses:
- Agent Gateway (TrustGate): enruta Sonnet 5.5, su fallback a Sonnet 5 y otros modelos por un único punto de políticas, con control de acceso por identidad y un solo registro de auditoría. TrustGate incluye más de 200 servidores MCP preconfigurados.
- Agent Runtime Security (TrustGuard): inspecciona prompts, llamadas a herramientas y respuestas en tiempo real para bloquear inyecciones, fugas de secretos y comandos destructivos.
- AI Red Teaming (TrustTest): ataca tus propios agentes con Sonnet 5.5 antes de lanzarlos, para medir tu exposición real y no cifras de laboratorio.
Sonnet 5.5, Opus 5.5 o GPT-6 Sol: ¿cuál elegir?
Elige Sonnet 5.5 para casi todos los agentes en producción: se acerca a Opus 5.5 a mitad de precio por token. Reserva Opus 5.5 para lo más difícil; nuestra guía de Opus 5.5 para empresas lo analiza. Evalúa GPT-6 Sol si quieres un segundo proveedor al mismo precio.
| Caso | Elige | Por qué |
|---|---|---|
| Agentes de alto volumen en Sonnet 5 | Sonnet 5.5 | Mismo precio, más rápido y menos tokens |
| Revisión de código compleja | Opus 5.5 | 8 de 13 casos difíciles frente a 6 (CodeRabbit) |
| Desarrollo centrado en la terminal | Sonnet 5.5 | 70,6 % en Terminal-Bench 4.0 (fabricante) |
| Seguridad ofensiva | Cyber Verification Program | Sin verificar, lo de mayor riesgo pasa a Sonnet 5 |
| Un CISO con varios modelos | Cualquiera, tras una gateway | Una política y una auditoría para todos |
Conclusión
Claude Sonnet 5.5 es una mejora clara en coste: mismo precio, salidas más de un 30 % más rápidas y hasta un 30 % menos por tarea, con benchmarks cercanos a Opus 5.5. Los cambios de verdad están en la seguridad y la integración: el fallback de ciberseguridad, la anti-destilación y el thinking ligado a la cuenta cambian rechazos, registros y enrutamiento. Prueba el esfuerzo y los cambios incompatibles, y después migra.
Protege tus agentes con Sonnet 5.5 en producción con NeuralTrust
Ejecuta Sonnet 5.5, su fallback y cualquier otro modelo tras una sola capa de políticas, con protección en tiempo real en cada prompt y herramienta.
Comparativas relacionadas
- Claude vs ChatGPT: comparativa de benchmarks 2026
- Claude Code vs Cursor: comparativa de benchmarks 2026
Preguntas frecuentes sobre Claude Sonnet 5.5
1. ¿Cuándo se lanzó Claude Sonnet 5.5?
Anthropic lanzó Claude Sonnet 5.5 el 28 de septiembre de 2026. Está en todos los planes de Claude, incluido el gratuito, en Claude Code, en la API como claude-sonnet-5-5 y en Amazon Bedrock, Google Cloud y Microsoft Foundry.
2. ¿Cuánto cuesta Claude Sonnet 5.5?
Cuesta 2 $ por millón de tokens de entrada y 10 $ por millón de salida, igual que Sonnet 5. La lectura de caché cuesta 0,20 $, la escritura de 5 minutos 2,50 $ y el batch tiene un 50 % de descuento. Anthropic calcula hasta un 30 % menos por tarea.
3. ¿Es Sonnet 5.5 mejor que Sonnet 5?
Según Anthropic, sí, y por mucho: 70,6 % frente a 10,3 % en Terminal-Bench 4.0 y 80,1 % frente a 57,0 % en OSWorld 2.1. En la prueba independiente de CodeRabbit encontró más bugs difíciles con un coste por revisión un 60 % menor.
4. ¿Es Sonnet 5.5 mejor que Opus 5.5?
En general no, aunque se acerca. Opus 5.5 gana en CursorBench 4.0 (57,8 % frente a 55,5 %) y FrontierCode, y Sonnet 5.5 gana en Terminal-Bench 4.0 (70,6 % frente a 66,4 %). Sonnet 5.5 cuesta la mitad por token: 2 $ / 10 $ frente a 4 $ / 20 $.
5. ¿Cuáles son las nuevas salvaguardas de ciberseguridad de Sonnet 5.5?
Usa clasificadores de bloqueo similares a los de los modelos Opus. La corrección rutinaria de bugs funciona con normalidad, pero las peticiones de mayor riesgo pasan de forma visible a Sonnet 5. En la API, ese fallback es una beta opcional, y los equipos verificados tendrán más acceso vía el Cyber Verification Program.
6. ¿Qué significa anti-destilación en Sonnet 5.5?
La destilación usa muchas cuentas para copiar las capacidades de un modelo, a menudo extrayendo su razonamiento oculto. Sonnet 5.5 es el primer Sonnet que bloquea esa extracción, sin fallback. Además, su thinking solo funciona en la cuenta que lo generó.
7. ¿Cómo se compara Sonnet 5.5 con GPT-6 Sol?
Ambos cuestan 2 $ / 10 $ por millón de tokens. Anthropic sitúa a Sonnet 5.5 por delante en GDPval-AA (1844 frente a 1487) y FrontierCode (52,1 % frente a 49,3 %). OpenAI declara un 68,8 % en DeepSWE 1.1 para Sol, que Anthropic no ha medido.
Sobre el autor
Roger Howroyd es Head of Global SEO and AI en NeuralTrust, donde dirige la estrategia de búsqueda de la compañía en SEO, AEO, GEO y optimización para LLM. Está especializado en búsqueda impulsada por IA, estrategia de contenidos y SEM. Conecta con él en LinkedIn.
NeuralTrust es la plataforma líder para proteger y escalar agentes de IA. Reconocida como Pioneer en el Gartner Emerging Market Quadrant for AI Application Security 2026, destacada en cuatro informes Gartner Hype Cycle de 2026 e incluida en la Gartner Market Guide for Guardian Agents 2026, la Gartner Market Guide for AI Gateways 2025 y el KuppingerCole Leadership Compass for Generative AI Defense 2025. Con sede en Barcelona y oficinas en Londres y Nueva York. Certificada en ISO 27001.
Fuentes
- Anthropic: Introducing Claude Sonnet 5.5 (28/09/2026)
- Anthropic: Claude Sonnet 5.5 System Card (28/09/2026)
- Claude Docs: Claude Sonnet 5.5 (09/2026)
- Claude Docs: What's new in Claude Sonnet 5.5 (09/2026)
- Claude Docs: guía de migración a Sonnet 5.5 (09/2026)
- Claude Docs: Preserved thinking (09/2026)
- Claude Docs: Claude Sonnet 5 (09/2026)
- Claude: precios (09/2026)
- Claude Help Center: salvaguardas de ciberseguridad en tiempo real (09/2026)
- Anthropic: Introducing Claude Opus 5.5 (22/09/2026)
)
)
)