FLUX 3 and Gemini 3.7 Flash are now live on CometAPI →
프레임워크, 에이전트 및 개발자 도구

Vercel AI SDK + CometAPI: 멀티 모델 채팅 라우트 구축

애플리케이션 통합을 교체하지 않고도 모델 ID를 전환할 수 있는 하나의 스트리밍 채팅 엔드포인트를 생성합니다.

AI 통합 워크플로를 형성하는 연결된 코드, 클라우드 및 메시징 모듈
CA
CometAPI 리서치
AI 모델 및 API 엔지니어링
2026년 8월 6일 7 분 읽기

핵심 요점

CometAPI key는 서버에 보관하고, 클라이언트에는 승인된 model alias만 노출하세요.
하나의 provider 구성을 사용하고 워크로드별로 model ID를 변경하세요.
인지되는 지연 시간을 개선하려면 응답을 스트리밍하세요.
프로덕션 출시 전에 요청 예산, 검증, 폴백을 추가하세요.

provider 설치 및 구성

Vercel AI SDK는 OpenAI 호환 provider를 사용할 수 있습니다. CometAPI base URL을 한 번 구성하고 API key는 서버 측 환경 변수에 보관하세요.

import { createOpenAI } from '@ai-sdk/openai';

export const cometapi = createOpenAI({
  apiKey: process.env.COMETAPI_KEY,
  baseURL: 'https://api.cometapi.com/v1',
});

스트리밍 채팅 라우트 생성

서버에서 allowlist를 기반으로 model을 선택하세요. 이렇게 하면 다중 model 유연성을 유지하면서 클라이언트가 예상치 못한 고비용 model을 선택하는 것을 방지할 수 있습니다.

import { streamText } from 'ai';
import { cometapi } from '@/lib/cometapi';

const allowedModels = {
  fast: 'your-fast-model-id',
  quality: 'your-quality-model-id',
};

export async function POST(request: Request) {
  const { messages, route = 'fast' } = await request.json();
  const modelId = allowedModels[route as keyof typeof allowedModels];

  const result = streamText({
    model: cometapi(modelId),
    messages,
  });

  return result.toDataStreamResponse();
}

워크로드별 model 전환

대화형 응답에는 더 빠른 route를, 복잡한 분석, 대규모 코드 변경, 고가치 검토에는 더 높은 품질의 route를 사용하세요. 이후 비용과 품질을 비교할 수 있도록 routing logic을 관찰 가능하게 유지하세요.

  • 자동 분류를 시도하기 전에 명시적인 제품 모드로 route하세요.
  • 선택된 route, model ID, token, latency 및 요청 결과를 기록하세요.
  • 계정 수준 및 요청 수준의 지출 제한을 적용하세요.

프로덕션 체크리스트

출시 전에 스키마 검증, timeout 처리, 일시적 실패에 대한 retry, 호환 가능한 fallback route를 추가하세요. 브라우저 코드에 상위 API key를 절대 노출하지 마세요.

자주 묻는 질문

Vercel AI SDK는 OpenAI 호환 API를 사용할 수 있나요?

예. 대체 base URL과 API key로 호환 provider를 구성한 다음, 요청을 생성할 때 model ID를 제공하면 됩니다.

사용자가 브라우저에서 임의의 model ID를 선택하게 해야 하나요?

아니요. 프로덕션 애플리케이션은 클라이언트에 노출되는 route 이름을 서버 측 allowlist에 매핑하여 비용, 기능, 보안을 통제해야 합니다.

통합 및 워크플로 계속 보기
섹션 개요와 향후 글로 돌아가기.
섹션 보기