Claude Opus 5.2 ha entrado discretamente en pruebas grises en Claude Code. Desde el 14 de septiembre de 2026, los usuarios han informado que funciona significativamente mejor que Opus 5 en la web, con respuestas más rápidas, salida más limpia y mayor persistencia en tareas de codificación largas.
Las pruebas públicas aún son incipientes: gran parte del debate se remonta a las mismas pruebas iniciales y a un pequeño conjunto de comparaciones lado a lado. El comportamiento de la prueba en gris es visible, pero Anthropic aún no ha publicado el endpoint estable y la documentación técnica que los desarrolladores necesitan para el uso en producción.
Estado:
Pruebas grises en Claude Code
Disponibilidad oficial de la API:
No anunciada
ID del modelo de API pública:
Aún no publicado
Precios y especificaciones públicas:
Aún no publicado
Última verificación:
15 de septiembre de 2026
¿Qué es Claude Opus 5.2?
Claude Opus 5.2 es el siguiente checkpoint de Opus de Anthropic que ahora aparece mediante enrutamiento selectivo en Claude Code. Algunas solicitudes hechas a "Opus 5" en Claude Code están llegando a la nueva ruta 5.2, mientras que Claude en la web y algunos entornos de terceros siguen sirviendo el modelo Opus 5 existente. Eso explica por qué la UI puede mostrar el mismo nombre de modelo mientras los resultados se ven muy diferentes.
Dado que las pruebas en gris cambian el tráfico de forma selectiva, no todas las cuentas o sesiones recibirán el mismo modelo. Las diferencias también pueden amplificarse por los prompts del sistema, la configuración de herramientas y los ajustes de esfuerzo de razonamiento. Por lo tanto, las señales más útiles son la combinación de información de la ruta y cambios de comportamiento repetibles:
- generación más rápida bajo la ruta de Claude Code;
- implementaciones iniciales más limpias y completas;
- trabajo autónomo más prolongado sin repetidos prompts de "continue"; y
- bucles repetidos de revisión y pruebas en tareas de codificación.
El slug 5.2 y la señal de enrutamiento
Algunos evaluadores informan que la etiqueta visible de Claude Code sigue siendo "Opus 5" mientras que una vista de estado o el slug de la solicitud apunta a 5.2.
Esto sería una evidencia mucho más sólida si una respuesta en crudo, un registro de solicitud o una salida reproducible de /status mostrara el identificador y pudiera verificarse de forma independiente. Por el momento, las publicaciones públicas principalmente repiten la afirmación; el artefacto subyacente no ha sido autenticado.
Principales características observadas en las pruebas grises de Claude Opus 5.2
Los primeros evaluadores se centran de forma consistente en el comportamiento más que en las especificaciones formales.
Respuestas más rápidas
El modelo enroutado es notablemente más rápido que la experiencia documentada de Opus 5 en las primeras pruebas de usuarios. La latencia final aún necesita medirse cuando llegue el acceso público a la API, porque los ajustes de esfuerzo, la carga del sistema y la infraestructura de enrutamiento también afectan la velocidad.
Salida más limpia y completa
Las comparaciones de la comunidad afirman que la nueva ruta produce SVGs más pulidos e implementaciones más completas a partir de un solo prompt. En pruebas anecdóticas de codificación, supuestamente requiere menos idas y vueltas para llegar a un resultado utilizable.
Menos comportamiento "perezoso"
Varios evaluadores dicen que el modelo es menos propenso a devolver solo un esqueleto, pedir al usuario que continúe o detenerse antes de terminar una tarea compleja. En su lugar, supuestamente trabaja a través de secuencias más largas y realiza pasadas adicionales sobre su propia salida.
Bucles de codificación autónomos más largos
Una observación ampliamente repetida es que el modelo inició un "gauntlet loop": continuó probando, revisando y mejorando el código sin necesidad de instrucciones repetidas. Si es reproducible, esto sería especialmente relevante para agentes de codificación a escala de repositorio y tareas de software de largo horizonte.
Conocimiento más reciente
Los usuarios propusieron una "prueba Tibo": con la búsqueda web desactivada, preguntarle al modelo si conoce a "Tibo, the reset guy". La documentación existente de Opus 5 proporciona un corte de conocimiento confiable en mayo de 2026, por lo que el conocimiento de una referencia en línea posterior podría sugerir un checkpoint más nuevo.
La prueba no puede identificar una versión del modelo por sí sola. Una respuesta correcta también podría provenir de recuperación oculta, memoria de la conversación, un prompt del sistema u otra fuente de contexto. Es una sonda de conocimiento, no una prueba del nombre "Opus 5.2".
Rendimiento en benchmarks de Claude Opus 5.2
No hay resultados verificados de benchmarks para Claude Opus 5.2, ya que Anthropic no ha publicado una system card ni una tabla de evaluación.
La puntuación reportada de 62.8% en CoBench v2 pertenece a un modelo interno separado de Anthropic conocido como "Model 2", que supuestamente superó a Mythos 5 por 12.5 puntos y se usa ampliamente para codificación interna. También se ha discutido un sistema RSI más capaz.
Claude Opus 5.2 vs Claude Opus 5 vs Claude Fable 5.1
Los tres modelos apuntan a necesidades adyacentes pero diferentes. Opus 5 es la opción predeterminada de menor costo de Anthropic para codificación compleja y trabajo empresarial. Fable 5.1 es la opción de alta gama establecida para el razonamiento más difícil y tareas de agentes de largo horizonte. Opus 5.2 es la nueva ruta en pruebas grises que parece acercar a Opus—o potencialmente superarlo—a esa frontera al mismo tiempo que mejora la velocidad y la persistencia que los usuarios experimentan en Claude Code.
| Categoría | Claude Opus 5.2 | Claude Opus 5 | Claude Fable 5.1 |
|---|---|---|---|
| Estado actual | Pruebas grises en Claude Code | Disponible públicamente | Disponible públicamente |
| Cometapi ID | claude-opus-5-2 | claude-opus-5 | claude-fable-5-1 |
| Mejor adecuación | Codificación agentic de nueva generación, iteración autónoma, salida pulida de un solo intento | Codificación compleja general y cargas de trabajo empresariales con un costo equilibrado | El razonamiento más difícil, investigación y trabajo agentic de largo horizonte |
| Comportamiento observado | Más rápido, más limpio, más dispuesto a iterar y terminar tareas largas | Capaz y económico, pero los usuarios reportan comportamiento más lento o menos persistente en algunas tareas largas | Los resultados publicados más fuertes de Claude en benchmarks exigentes de investigación y agentes; puede ser verboso |
| Ventana de contexto | Aún no publicado | 1M tokens | 1M tokens |
| Salida máxima | Aún no publicado | 128K tokens | 128K tokens |
| Fecha de corte de conocimiento confiable | Conocimiento más reciente observado en pruebas; fecha no publicada | mayo de 2026 | junio de 2026 |
| Precio oficial de entrada/salida | Aún no publicado | $5 / $25 por MTok | $10 / $50 por MTok |
| AA Intelligence Index independiente | Aún no probado | 51 | 53 |
| Velocidad de salida observada de forma independiente | Aún no probado | 51.7 tokens/s | 65.1 tokens/s |
Las cifras independientes anteriores provienen de Artificial Analysis en las variantes de razonamiento adaptativo evaluadas. Muestran que Fable 5.1 supera a Opus 5 por dos puntos en su Intelligence Index y genera salida aproximadamente un 26% más rápido en la configuración medida, pero su precio de lista es el doble. Estos resultados aún no incluyen Opus 5.2 porque la ruta en pruebas grises no expone un endpoint público estable para la evaluación independiente.
Opus 5.2 cambia la comparación práctica. Las primeras sesiones de Claude Code sugieren un modelo que responde más rápido que Opus 5, ofrece diseños más completos con el mismo prompt y continúa probando y refinando el código sin ser impulsado. Una vez que su API pública esté disponible, la pregunta más importante será si esas mejoras también superan a Fable 5.1 en benchmarks agentic controlados —y a qué precio—.
Para qué es mejor Claude Opus 5.2
Basado en el comportamiento ya visible en las pruebas grises, Claude Opus 5.2 es particularmente prometedor para:
- codificación a escala de repositorio y modernización de bases de código;
- agentes de larga duración que planifican, ejecutan, prueban y revisan a lo largo de muchos pasos;
- depuración compleja y bucles autónomos de QA;
- generación de interfaces, SVG y artefactos estructurados de alta calidad;
- investigación y análisis que requieren atención sostenida sobre contextos grandes; y
- flujos de trabajo empresariales donde la calidad de finalización importa más que el costo mínimo.
Para implementaciones en producción hoy, los equipos deberían seguir usando un endpoint público estable y mantener la capa de modelo reemplazable hasta que se publiquen el acceso a la API y las condiciones de servicio de Opus 5.2.
¿Cómo proporciona CometAPI acceso a la API de Claude Opus 5.2?
Cuando Claude Opus 5.2 esté oficialmente disponible a través de CometAPI, los desarrolladores podrán usar el mismo flujo de trabajo de API unificada utilizado para otros modelos de Anthropic compatibles:
- Crear una cuenta en CometAPI y generar una clave de API.
- Añadir crédito a la cuenta o seleccionar la opción de facturación adecuada.
- Consultar el catálogo de modelos de CometAPI para el ID de modelo exacto publicado y el precio.
- Enviar solicitudes a través de Anthropic Messages o del endpoint de chat compatible.
- Validar la calidad de salida, latencia y costo con una pequeña carga de prueba antes del despliegue en producción.
Mientras tanto, CometAPI ya admite el modelo más reciente de Claude, Fable 5.1. Los desarrolladores pueden acceder a los modelos de Claude usando el formato nativo de solicitud de la API de Claude, lo que facilita probar los modelos actuales y migrar a Opus 5.2 tras su lanzamiento.
¿Por qué elegir CometAPI para Claude Opus 5.2?
Una vez que el modelo esté oficialmente soportado, CometAPI puede reducir el trabajo operativo necesario para añadirlo a una pila de IA existente. Una cuenta y capa de API unificadas permiten a los equipos evaluar múltiples proveedores de modelos sin mantener una integración e infraestructura de facturación separadas para cada modelo.
Las posibles ventajas incluyen:
- una sola clave de API y flujo de facturación para un amplio catálogo de modelos;
- pruebas lado a lado más rápidas frente a modelos alternativos de codificación y razonamiento;
- un patrón de integración consistente a medida que cambian las versiones del modelo;
- acceso basado en uso sin rediseñar la aplicación alrededor de un único proveedor; y
- documentación centralizada y descubrimiento de modelos.
La información real de precios, disponibilidad, rendimiento y descuentos de Opus 5.2 solo debe indicarse después de que el modelo aparezca en el catálogo en vivo de CometAPI.