FLUX 3 and Gemini 3.7 Flash are now live on CometAPI →
Frameworks, agentes y herramientas para desarrolladores

Vercel AI SDK + CometAPI: crea una ruta de chat multimodelo

Crea un único endpoint de chat con streaming que pueda cambiar los ID de modelo sin reemplazar la integración de la aplicación.

Módulos conectados de código, nube y mensajería que forman un flujo de trabajo de integración de AI
CA
Investigación de CometAPI
Ingeniería de modelos de IA y API
6 de agosto de 2026 7 min de lectura

Puntos clave

Mantén la clave de CometAPI en el servidor y expón al cliente únicamente un alias de modelo aprobado.
Usa una única configuración del proveedor y cambia el ID del modelo según la carga de trabajo.
Transmite las respuestas para mejorar la latencia percibida.
Añade presupuestos por solicitud, validación y una alternativa de respaldo antes del lanzamiento en producción.

Instala y configura el proveedor

Vercel AI SDK puede utilizar un proveedor compatible con OpenAI. Configura una vez la URL base de CometAPI y mantén la clave de API en una variable de entorno del servidor.

import { createOpenAI } from '@ai-sdk/openai';

export const cometapi = createOpenAI({
  apiKey: process.env.COMETAPI_KEY,
  baseURL: 'https://api.cometapi.com/v1',
});

Crea una ruta de chat con streaming

Elige el modelo en el servidor a partir de una lista de permitidos. Esto evita que los clientes seleccionen un modelo inesperadamente costoso, al tiempo que conserva la flexibilidad multimodelo.

import { streamText } from 'ai';
import { cometapi } from '@/lib/cometapi';

const allowedModels = {
  fast: 'your-fast-model-id',
  quality: 'your-quality-model-id',
};

export async function POST(request: Request) {
  const { messages, route = 'fast' } = await request.json();
  const modelId = allowedModels[route as keyof typeof allowedModels];

  const result = streamText({
    model: cometapi(modelId),
    messages,
  });

  return result.toDataStreamResponse();
}

Cambia de modelo según la carga de trabajo

Usa la ruta más rápida para los turnos conversacionales y la ruta orientada a la calidad para análisis complejos, cambios extensos de código o revisiones de alto valor. Mantén observable la lógica de enrutamiento para poder comparar posteriormente el coste y la calidad.

  • Enruta según un modo explícito del producto antes de intentar una clasificación automática.
  • Registra la ruta seleccionada, el ID del modelo, los tokens, la latencia y el resultado de la solicitud.
  • Aplica límites de gasto por cuenta y por solicitud.

Lista de comprobación para producción

Antes del lanzamiento, añade validación de esquemas, gestión de tiempos de espera, reintentos para fallos transitorios y una ruta de respaldo compatible. Nunca expongas la clave de API del proveedor ascendente en el código del navegador.

Preguntas frecuentes

¿Puede Vercel AI SDK utilizar una API compatible con OpenAI?

Sí. Configura un proveedor compatible con la URL base alternativa y la clave de API; después, proporciona el ID del modelo al crear la solicitud.

¿Deberían los usuarios poder elegir cualquier ID de modelo desde el navegador?

No. Las aplicaciones de producción deberían asignar los nombres de las rutas visibles para el cliente a una lista de permitidos en el servidor, para mantener bajo control el coste, las capacidades y la seguridad.

Continuar con Integraciones y flujos de trabajo
Vuelve al resumen de la sección y a futuros artículos.
Ver sección