GPT-6 Sol, GPT-6 Luna, and Claude Opus 5.5 are now live on CometAPI →
ai-model/Investigación de CometAPI

¿Qué es Claude Sonnet 5.5? Pruebas de referencia, precios y acceso a la API

Explora las especificaciones de Claude Sonnet 5.5, la ventana de contexto de 1M, los benchmarks, los precios, las funciones de programación, las comparaciones y el acceso a la API.

CometAPI
Deon GoodwinEquipo de investigación de modelos de IA y API
Actualizado Sep 29, 2026 14 min de lectura
¿Qué es Claude Sonnet 5.5? Pruebas de referencia, precios y acceso a la API
Usa este patrón

Haz la primera llamada a la API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Claude Sonnet 5.5 es el modelo más reciente de la clase Sonnet de Anthropic, lanzado el 28 de septiembre de 2026. Está posicionado como el complemento más rápido y de menor costo de Claude Opus 5.5 para programación, trabajo agentivo bien delimitado, producción de documentos, uso de computadoras y análisis multimodal.

El modelo mantiene precios estándar de $2 por millón de tokens de entrada y $10 por millón de tokens de salida. Anthropic informa que la generación de salida es más de un 30% más rápida que Sonnet 5 y que los costos a nivel de tarea pueden ser hasta un 30% menores porque el modelo más nuevo a menudo completa el trabajo con menos tokens y pasos.

Los resultados publicados incluyen 70.6% en Terminal-Bench 4.0, 55.5% en CursorBench 4.0, 1844 en GDPval-AA v2.1 y 80.1% en OSWorld 2.1. El valor práctico no es una puntuación aislada: Sonnet 5.5 se acerca a Opus 5.5 en varias evaluaciones de trabajo profesional, manteniendo precios estándar de tokens más bajos.

Puntos clave

  • Claude Sonnet 5.5 es el segundo modelo de la familia Claude 5.5 de Anthropic y está optimizado para trabajo de producción rápido en lugar de tareas más ambiguas y abiertas.
  • Admite una ventana de contexto de 1M tokens, hasta 128K tokens de salida, entrada de texto e imagen, pensamiento adaptativo, uso de herramientas y respuestas estructuradas.
  • La tarificación estándar de la API de Claude es $2/M de entrada, $10/M de salida, $0.20/M lecturas de caché y $2.50/M escrituras de caché de cinco minutos.
  • Anthropic informa que la salida es más de un 30% más rápida que Sonnet 5 y que hay mejoras sólidas en programación, uso de computadoras, comprensión de gráficos y trabajo de conocimiento de largo horizonte.
  • El ID del modelo en la API de Claude es claude-sonnet-5-5; los desarrolladores también pueden acceder al Claude Sonnet 5.5 API en CometAPI.

¿Qué es Claude Sonnet 5.5?

Claude Sonnet 5.5 es el modelo Sonnet de propósito general más reciente de Anthropic y el segundo lanzamiento en la familia Claude 5.5 después de Claude Opus 5.5. Anthropic lo posiciona como un complemento más rápido y de menor costo de Opus, en lugar de un reemplazo directo del buque insignia.

La distinción es práctica: Opus 5.5 está orientado a trabajo complejo y ambiguo que requiere juicio sostenido, mientras que Sonnet 5.5 está optimizado para tareas bien delimitadas, corrección de errores, iteración rápida, programación, producción de documentos y flujos de trabajo profesionales de alto volumen.

¿Cuáles son las características más importantes de Claude Sonnet 5.5?

El modelo combina una ventana de contexto de 1M tokens, hasta 128K tokens de salida, entrada de texto e imagen, pensamiento adaptativo, esfuerzo ajustable, uso de herramientas, salidas estructuradas, caché de prompts, procesamiento por lotes y disponibilidad en la API de Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry y Claude Platform en AWS. Para equipos de producción, la combinación definitoria no es una característica única, sino una generación rápida, menor uso de tokens a nivel de tarea y un rendimiento cercano a Opus en varios trabajos profesionales bien delimitados.

Benchmarks de Claude Sonnet 5.5

Anthropic informa ganancias sustanciales en programación, trabajo profesional de largo horizonte, uso de computadoras y comprensión visual. La tabla siguiente resume los resultados de evaluación publicados por la empresa.

Benchmark y fuente oficialClaude Sonnet 5.5Claude Sonnet 5Claude Opus 5.5GPT-6 Sol
Terminal-Bench 4.070.6%10.3%66.4% en XhighNo divulgado públicamente
FrontierCode 1.1 Main46.2% en Max42.4%54.4%49.3% / 52.1% en Xhigh
CursorBench 4.055.5%34.1%57.8%No divulgado públicamente
GDPval-AA v2.11844144918461487
AA-Briefcase v1.11811135918221483
Humanity's Last Exam64.5% con tools54.9%67.7%No informado en la tabla fuente
OSWorld 2.180.1%57.0%81.8%No informado en la tabla fuente
Chartography61.6%15.6%64.4%53.6%

Condiciones de evaluación y salvedades: Las puntuaciones no se midieron todas con el mismo nivel de esfuerzo. El 66.4% de Opus 5.5 en Terminal-Bench se informa en Xhigh. Anthropic señala que Sonnet 5.5 puede puntuar más bajo en Max que en Xhigh en FrontierCode porque los pasos de revisión adicionales pueden introducir vencimientos de tiempo o ediciones fuera de alcance. Artificial Analysis ejecutó GDPval-AA y AA-Briefcase en una implementación previa al lanzamiento de Sonnet 5.5 afectada por un error de salidas estructuradas que, según Anthropic, ya se corrigió. Las cifras cruzadas de GPT-6 Sol también deben tratarse como observaciones desactualizadas porque OpenAI corrigió un problema de codificación de imágenes el 25 de septiembre de 2026.

Qué significan los resultados: Sonnet 5.5 no está simplemente por delante de Sonnet 5 en puntuaciones aisladas. Se acerca mucho más a Opus 5.5 en programación, trabajo profesional, uso de computadoras y reconocimiento de gráficos, manteniendo precios de la categoría Sonnet. Anthropic también informa que, en esfuerzos Low o Medium, Sonnet 5.5 puede superar la mejor puntuación de Sonnet 5 en varias evaluaciones a aproximadamente una décima parte del costo por tarea. Esa combinación de capacidad, velocidad y eficiencia a nivel de tarea es su principal ventaja competitiva.

¿Qué tan bueno es Claude Sonnet 5.5?

Programación

La mejora también es operativa. Anthropic informa que Sonnet 5.5 entiende bases de código más rápido, agrupa llamadas a herramientas con mayor eficiencia, usa menos pasos y reduce el costo por tarea completada. FrontierCode prueba si los cambios de código propuestos son integrables, mientras que CursorBench utiliza tareas ambiguas y de múltiples archivos extraídas de sesiones reales de programación; por lo tanto, las mejoras reflejan ejecución y juicio a nivel de repositorio, no solo generación de código corta. Estos cambios importan para corrección de errores, revisión de código, ejecución de pruebas y agentes de programación de larga duración.

¿Qué es Claude Sonnet 5.5? Pruebas de referencia, precios y acceso a la API

Trabajo del conocimiento

Las mejoras se extienden más allá de la programación. GDPval-AA evalúa tareas profesionales reales en 44 ocupaciones y nueve industrias principales, por lo que la puntuación de Sonnet 5.5 de 1844, frente a 1449 de Sonnet 5 y 1846 de Opus 5.5, sugiere que sus ganancias se trasladan a análisis prácticos, producción de documentos y trabajo de apoyo a decisiones, en lugar de quedar confinadas a pruebas de razonamiento de laboratorio.

Anthropic destaca el análisis financiero, la síntesis de documentos, la creación de diapositivas, el trabajo con hojas de cálculo, la interpretación de gráficos, la verificación de fuentes, la recuperación de información y la redacción profesional como áreas donde el modelo mejora.

Los primeros evaluadores también informaron mejoras menos cuantificables: colaboración más clara, juicio conversacional más natural y un mejor ojo para el diseño. Anthropic afirma que el modelo puede añadir pulido a interfaces de usuario y seguir plantillas de diapositivas lo suficientemente de cerca como para producir presentaciones que requieran una edición mínima; en una prueba interna de revisión operativa, dos expertos juzgaron que el primer borrador estaba listo para enviar sin cambios.

La implicación más amplia es que Sonnet 5.5 debe entenderse como un modelo para trabajo profesional, no simplemente un modelo de programación más barato.

Uso de la computadora

Sonnet 5.5 obtiene 80.1% en OSWorld 2.1, comparado con 57.0% para Sonnet 5 y 81.8% para Opus 5.5. OSWorld evalúa la capacidad de operar entornos gráficos de computadora, por lo que el resultado indica una gran mejora generacional y un rendimiento cercano a Opus para flujos de trabajo que involucran navegadores, herramientas de escritorio y comprensión de interfaces multimodales. Los resultados de Chartography muestran un patrón similar en reconocimiento visual de gráficos: 61.6% para Sonnet 5.5 frente a 15.6% para Sonnet 5.

Velocidad

Anthropic informa que Sonnet 5.5 genera salida más de un 30% más rápido que Sonnet 5, convirtiéndolo en el Sonnet más rápido en su lanzamiento. La salida más rápida se combina con menos llamadas a herramientas y menor uso de tokens para acortar los bucles de agentes, reducir el tiempo de espera durante la programación iterativa y mejorar el rendimiento en soporte y otros flujos de alto volumen.

¿Cuánto cuesta Claude Sonnet 5.5?

Precios y fuente oficialClaude Sonnet 5.5CometAPI: Sonnet 5.5Claude Opus 5.5
Lecturas de caché$0.20 / 1M$0.16 / 1M$0.20 / 1M
Escrituras de caché de cinco minutos$2.50 / 1M$2 / 1M$5 / 1M
Tokens de entrada$2 / 1M$1.60/M$4 / 1M
Tokens de salida$10 / 1M$8.00/M$20 / 1M

A tarifas estándar por token, Sonnet 5.5 cuesta la mitad que Opus 5.5 para entrada y salida. Anthropic también dice que el nuevo Sonnet a menudo necesita menos tokens para terminar el mismo trabajo que Sonnet 5, lo que reduce el costo por tarea completada.

Estos son precios estándar de la API de Claude. Los precios de proveedores en la nube, el procesamiento regional, la duración de la caché, los descuentos por lotes y las reglas de contexto largo pueden cambiar el costo efectivo.

¿Qué cambios de seguridad introduce Claude Sonnet 5.5?

Anthropic dice que su auditoría automática de comportamiento cubrió aproximadamente 1,850 escenarios y encontró que Sonnet 5.5 mejoró o igualó a Sonnet 5 en la mayoría de las medidas probadas de alineación, resistencia al abuso y honestidad.

Salvaguardas de ciberseguridad

Debido a que Sonnet 5.5 tiene capacidades cibernéticas más fuertes que su predecesor, Anthropic está implementando salvaguardas similares a las utilizadas para modelos más capaces. El desarrollo rutinario de software y la corrección de errores ordinaria siguen siendo compatibles, mientras que algunas tareas de ciberseguridad de mayor riesgo pueden retroceder a una ruta de modelo más segura.

Salvaguardas de biología

El modelo utiliza las mismas salvaguardas biológicas que Sonnet 5, apuntando a un conjunto estrecho de solicitudes potencialmente dañinas mientras deja la mayoría del trabajo de investigación, educación y clínico sin afectar.

Protecciones contra la destilación

Anthropic afirma que Sonnet 5.5 es el primer modelo Sonnet que se lanza con clasificadores de seguridad diseñados para prevenir la extracción de razonamiento mediante ataques de destilación a escala industrial. También amplía el pensamiento preservado, vinculando el contenido de pensamiento a la cuenta y conversación que lo crearon para que el razonamiento no pueda separarse libremente y reproducirse en otro lugar. La mayoría de los desarrolladores no notarán este cambio, pero los sistemas que mueven conversaciones entre cuentas o alteran el estado de conversación anterior deben revisar la guía de migración.

Estas declaraciones describen las salvaguardas reportadas por Anthropic, no una garantía independiente de seguridad para cada implementación. Los equipos deben evaluar el modelo en función de su propio modelo de amenazas, políticas y flujos de trabajo de alto riesgo.

Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol

Claude Sonnet 5.5 está posicionado como el modelo de producción rápido y eficiente de este grupo. Anthropic informa que genera salidas más de un 30% más rápido que Claude Sonnet 5 manteniendo el mismo precio titular por token. Claude Opus 5.5 se orienta a trabajo más difícil y ambiguo, mientras que GPT-6 Sol es la comparación más cercana de OpenAI para programación de largo contexto y flujos de trabajo con agentes.

DimensiónClaude Sonnet 5Claude Sonnet 5.5Claude Opus 5.5GPT-6 Sol
PosicionamientoModelo de producción Sonnet previoCaballo de batalla de producción rápido y eficienteRazonamiento complejo de gama altaFlujos de trabajo complejos de programación y agentes
Ventana de contexto1M1M1M1.05M
Salida máxima128K128K128K128K
Controles de razonamientoAdaptive effortAdaptive effortAdaptive thinking, always onnone, low, medium, high, xhigh, and max
Entrada multimodalTexto e imágenesTexto e imágenesTexto e imágenesTexto e imágenes
Disponibilidad en APIAPI de Claude y principales nubesAPI de Claude y principales nubesAPI de Claude y principales nubesResponses API and Chat Completions
Precio estándar entrada/salida por 1M$2 / $10$2 / $10$4 / $20$2 / $10 para prompts de hasta 272K tokens de entrada
VelocidadLínea baseMás de un 30% más rápido que Sonnet 5Optimizado para trabajo más difícil y de mayor duraciónVaría según el esfuerzo de razonamiento
FrontierCode 1.142.4%46.2% en Max54.4%49.3% / 52.1% en Xhigh
GDPval-AA v2.11449184418461487
Más adecuado paraCargas existentes de SonnetProgramación de alto volumen y agentes profesionalesTareas difíciles, ambiguas y de larga duraciónProgramación, agentes, herramientas y flujos de largo contexto nativos de OpenAI

Estas cifras de benchmark son observaciones reportadas entre proveedores, no clasificaciones controladas y permanentes. Los resultados dependen de los ajustes de esfuerzo y las condiciones de implementación.

¿Cómo acceder y llamar a Claude Sonnet 5.5 a través de CometAPI?

Claude Sonnet 5.5 está disponible a través de Claude, la Claude Platform, Amazon Web Services, Google Cloud y Microsoft Azure. Los desarrolladores que desean una interfaz compatible con OpenAI para múltiples proveedores pueden invocar el modelo a través del Claude Sonnet 5.5 API en CometAPI con el identificador de modelo claude-sonnet-5-5.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="claude-sonnet-5-5",
    messages=[
        {
            "role": "user",
            "content": "Analiza esta base de código e identifica los tres errores de mayor impacto.",
        }
    ],
    max_tokens=2048,
)

print(response.choices[0].message.content)

Para producción, guarda la clave de API en una variable de entorno y evalúa los ajustes de esfuerzo, caché, llamadas a herramientas, comportamiento de reintentos y el consumo de tokens a nivel de tarea.

¿Qué es el ajuste de esfuerzo en Claude Sonnet 5.5?

Claude Sonnet 5.5 admite niveles de esfuerzo ajustables que equilibran velocidad y uso de tokens frente a profundidad de razonamiento. Anthropic establece Medium como esfuerzo predeterminado en las apps de Claude y Claude Code, mientras que la Claude Platform usa High por defecto.

Los ajustes de esfuerzo más bajos se adaptan a trabajo rutinario o altamente estructurado. Los ajustes más altos permiten más razonamiento y verificación para tareas de programación, análisis y agentes más difíciles. Por lo tanto, la presupuestación de producción debe considerar esfuerzo, uso de herramientas y costo total de finalización de la tarea, en lugar de solo el precio por token.

API: ¿Qué hay de nuevo en comparación con Sonnet 5?

Cinco cambios pueden romper o alterar integraciones existentes de Sonnet 5:

  1. Thinking-off migrations: las integraciones que deshabilitaron el pensamiento deben cambiar a thinking: {"type": "between_tools"}. Este ajuste desactiva el pensamiento inicial y preserva el razonamiento entre herramientas.
  2. Forced tool use: las elecciones forzadas de herramientas ahora devuelven un error; usa selección automática de herramientas con esquemas estrictos cuando corresponda.
  3. Thinking-block preservation: los bloques de pensamiento están vinculados al modelo y a la conversación. Reenvíalos sin cambios y no asumas que pueden reproducirse después de cambiar mensajes de sistema anteriores, herramientas o el contexto de la cuenta.
  4. Computer-use tool version: en la API de Claude y Google Cloud, la herramienta antigua computer_20251124 ya no es aceptada; migra al conjunto de herramientas de computadora documentado actualmente.
  5. Advisor compatibility: la herramienta advisor rechaza a Claude Opus 4.8, Opus 4.7 y Sonnet 5 como asesores.

Un cambio adicional en la forma de la respuesta puede fallar silenciosamente: el texto generado entre llamadas a herramientas puede aparecer en bloques de pensamiento en lugar de bloques de texto. Las aplicaciones que transmiten mensajes de progreso deben procesar las respuestas por tipo de bloque y establecer un modo de visualización adecuado. Sonnet 5.5 también añade esfuerzo por mensaje en beta, mensajes de sistema a mitad de conversación, cambios de herramientas a mitad de conversación en beta, una longitud mínima de prompt cacheable de 512 tokens, procesamiento por lotes, compatibilidad con Files API, entrada de PDF y visión, y herramientas tanto del lado del servidor como del cliente.

¿Qué significa Claude Sonnet 5.5 para la familia Claude 5.5?

  • Claude Opus 5.5: trabajo complejo, de alto juicio y largo horizonte.
  • Claude Sonnet 5.5: producción eficiente, programación, agentes y trabajo profesional.
  • Claude Haiku 5.5: anunciado como el próximo miembro de alto rendimiento y costo sensible de la familia.

El cambio más amplio es hacia medir el costo por tarea exitosa, la velocidad de inferencia y el enrutamiento de modelos, en lugar de enfocarse solo en el precio bruto por token o en un único benchmark.

Conclusión

Claude Sonnet 5.5 es una mejora enfocada en eficiencia para la capa de producción de Anthropic. Mantiene el precio estándar de tokens de Sonnet 5 de $2/$10 mientras añade una ventana de contexto de 1M tokens, hasta 128K tokens de salida, generación sustancialmente más rápida y mejoras sólidas en programación, uso de computadoras, comprensión visual y trabajo del conocimiento.

El argumento más sólido para el modelo es la economía del trabajo: con qué fiabilidad y rapidez completa una tarea, cuántas llamadas a herramientas y tokens consume y con qué frecuencia un flujo de trabajo aún requiere escalado a Opus 5.5. Los equipos deben validar esos factores en sus propias tareas y tratar los benchmarks entre proveedores como observaciones desactualizadas en lugar de clasificaciones permanentes.

Seguir aprendiendo

Conecta este artículo con la siguiente decisión.

Ver todos los temas
Publicado el Sep 29, 2026
Última actualización Sep 29, 2026
0 visitas
Revisado para mayor claridad, atribución de fuentes y terminología API actual.

¿Listo para reducir los costos de desarrollo de IA en un 20%?

Comienza gratis en minutos. Créditos de prueba gratuitos incluidos. No se requiere tarjeta de crédito.

Leer Más