Especificaciones técnicas de GPT-5.4-2026-03-05
| Elemento | GPT-5.4-2026-03-05 |
|---|---|
| Familia del modelo | GPT-5 |
| Proveedor | OpenAI |
| Fecha de lanzamiento | March 5, 2026 |
| Ventana de contexto | 1,050,000 tokens |
| Máximo de tokens de salida | 128,000 |
| Tipos de entrada | Text, Image |
| Tipos de salida | Text |
| Audio | Not supported |
| Controles de razonamiento | none, low, medium, high, muy alto |
| Compatibilidad con herramientas | Web search, File search, Code interpreter, Image generation |
| Fecha de corte de conocimiento | Aug 31, 2025 |
| Estabilidad de la instantánea | Locked model behavior |
¿Qué es GPT-5.4?
GPT-5.4 es un lanzamiento unificador de vanguardia que fusiona mejoras recientes en las líneas de razonamiento y coding (incluido el trabajo GPT-5.3-Codex) en un único modelo dirigido al trabajo profesional de conocimiento. Se posiciona como un modelo “Thinking” para un razonamiento más profundo y direccionable y como una variante “Pro” para clientes que buscan el máximo rendimiento/throughput. Los temas clave del lanzamiento son: (1) comprensión de contexto más largo y a escala de documentos, (2) capacidades mejoradas de herramientas y “uso de computadora” (control de apps, edición de hojas de cálculo/presentaciones), y (3) menos errores fácticos y planificación multi‑paso más sólida.
Funciones principales de GPT-5.4
- Enorme capacidad de contexto largo (experimental 1M+ tokens): GPT-5.4 admite sesiones experimentales de 1.05M tokens (con precios/límites) que habilitan razonamiento sobre libros completos/código completo y síntesis multi‑documento. Para disponibilidad general, la ventana estándar sigue siendo ≈272K tokens.
- Uso de herramientas multi‑paso mejorado y “uso de computadora” nativo: mejor control de escritorio/navegador para flujos de trabajo agentivos (teclado/ratón mediante una interfaz de computer‑use), búsqueda web que persiste entre rondas y un nuevo mecanismo de Tool Search para encontrar conectores/herramientas de forma eficiente. OpenAI reporta estado del arte en múltiples benchmarks de uso de computadora y agentes web.
- Generación/edición de hojas de cálculo, documentos y presentaciones: ajuste específico para flujos de trabajo de oficina; benchmarks internos muestran grandes avances en modelado de hojas de cálculo y calidad de presentaciones. OpenAI también lanzó un ChatGPT for Excel add‑in junto con el lanzamiento.
- Direccionabilidad y modos de razonamiento: el modo “Thinking” produce un plan/preámbulo explícito para tareas largas y admite direccionamiento a mitad de respuesta (ajustar instrucciones durante la generación). Los niveles de esfuerzo de razonamiento permiten a los usuarios intercambiar latencia por razonamiento de cadena de pensamiento más profundo.
- Comprensión multimodal mejorada: mejor interpretación de imágenes y gráficos de alta resolución (entrada de imagen), usada para comprensión de documentos y presentaciones.
- Postura de seguridad: OpenAI trata a GPT-5.4 como un modelo con alta capacidad cibernética y despliega salvaguardas mejoradas similares a las mitigaciones de GPT-5.3-Codex.
Rendimiento en benchmarks
| GPT-5.4 | GPT-5.3-Codex | GPT-5.2 | |
|---|---|---|---|
| GDPval (victorias o empates) | 83.0% | 70.9% | 70.9% |
| SWE-Bench Pro (Public) | 57.7% | 56.8% | 55.6% |
| OSWorld-Verified | 75.0% | 74.0%* | 47.3% |
| Toolathlon | 54.6% | 51.9% | 46.3% |
| BrowseComp | 82.7% | 77.3% | 65.8% |
GPT-5.4 vs. modelos comparables
| Modelo | Ventana de contexto | Fortaleza clave |
|---|---|---|
| GPT-5.4-2026-03-05 | 1,050,000 tokens | Razonamiento de frontera + flujos de trabajo con agentes |
| GPT-5.3 Instant | Más pequeña | Tareas cotidianas más rápidas |
| Claude Opus / Sonnet | ~200k tokens | Razonamiento de formato largo |
| Gemini 3 Pro | ~1M tokens | Razonamiento multimodal |
Diferencia clave: GPT-5.4 se centra fuertemente en los flujos de trabajo de productividad profesional y las capacidades de agentes, particularmente cuando se integra con herramientas externas.
Casos de uso representativos en producción
- Flujos de trabajo empresariales de documentos y cumplimiento: procesar contratos largos, extraer obligaciones y redactar comentarios entre corpus multi‑documento (se beneficia de las opciones de contexto de 272K→1M para síntesis en una sola sesión).
- Automatización de hojas de cálculo y modelado financiero: generar fórmulas, crear modelos multi‑hoja a partir de especificaciones en inglés sencillo, reconciliar entradas — OpenAI reporta grandes avances en tareas al estilo de banca de inversión junior.
- Automatización agentiva y “uso de computadora”: flujos de trabajo automatizados de navegador/escritorio (instalación, QA, orquestación de herramientas) y cadenas de herramientas multi‑paso (Zapier citado como socio de uso).
- Ingeniería de software y mantenimiento de código: generación de código, refactorizaciones y tareas de agente en terminal/CLI (se reportan mejoras en Terminal‑Bench). Para grandes bases de código, la ventana de contexto larga ayuda, pero debe validarse según heurísticas de la tarea.
- Aumento del trabajador del conocimiento: síntesis de investigación (mejoras en BrowseComp), generación de diapositivas y diseño visual para presentaciones.
Cómo acceder a la API de GPT-5.4
Paso 1: Regístrate para obtener una clave de API
Inicia sesión en cometapi.com. Si aún no eres nuestro usuario, regístrate primero. Inicia sesión en tu Consola de CometAPI. Obtén la clave de API de acceso de la interfaz. Haz clic en “Add Token” en el token de API en el centro personal, obtén la clave del token: sk-xxxxx y envíala.

Paso 2: Envía solicitudes a la API de GPT-5.4
Selecciona el endpoint “gpt-5.4” para enviar la solicitud a la API y configura el cuerpo de la solicitud. El método y el cuerpo de la solicitud se obtienen de la documentación de la API en nuestro sitio web. Nuestro sitio web también proporciona prueba en Apifox para tu comodidad. Reemplaza <YOUR_API_KEY> con tu clave real de CometAPI de tu cuenta. La URL base es Chat Completions y Responses.
Inserta tu pregunta o solicitud en el campo content — esto es a lo que el modelo responderá. Procesa la respuesta de la API para obtener la respuesta generada.
Paso 3: Recupera y verifica los resultados
Procesa la respuesta de la API para obtener la respuesta generada. Tras el procesamiento, la API responde con el estado de la tarea y los datos de salida.