Black Friday Recharge Offer, offer ends on November 30
Frameworks, Agents und Entwicklerwerkzeuge

Vercel AI SDK + CometAPI: Eine Chat-Route mit mehreren Modellen erstellen

Erstellen Sie einen Streaming-Chat-Endpunkt, der Modell-IDs wechseln kann, ohne die Anwendungsintegration auszutauschen.

Verbundene Code-, Cloud- und Messaging-Module als Teil eines AI-Integrationsworkflows
CA
CometAPI Research
Engineering für KI-Modelle und API
6. August 2026 7 Min. Lesezeit

Wichtigste Erkenntnisse

Bewahren Sie den CometAPI-Schlüssel auf dem Server auf und stellen Sie dem Client nur einen freigegebenen Modellalias zur Verfügung.
Verwenden Sie eine einzige Provider-Konfiguration und ändern Sie die Modell-ID je nach Workload.
Streamen Sie Antworten, um die wahrgenommene Latenz zu verbessern.
Fügen Sie vor dem Produktionsstart Anfragebudgets, Validierung und einen Fallback hinzu.

Provider installieren und konfigurieren

Das Vercel AI SDK kann einen OpenAI-kompatiblen Provider verwenden. Konfigurieren Sie die CometAPI-Basis-URL einmalig und speichern Sie den API-Schlüssel in einer serverseitigen Umgebungsvariablen.

import { createOpenAI } from '@ai-sdk/openai';

export const cometapi = createOpenAI({
  apiKey: process.env.COMETAPI_KEY,
  baseURL: 'https://api.cometapi.com/v1',
});

Eine Streaming-Chat-Route erstellen

Wählen Sie das Modell auf dem Server aus einer Allowlist aus. Dadurch wird verhindert, dass Clients ein unerwartet teures Modell auswählen, während die Flexibilität mehrerer Modelle erhalten bleibt.

import { streamText } from 'ai';
import { cometapi } from '@/lib/cometapi';

const allowedModels = {
  fast: 'your-fast-model-id',
  quality: 'your-quality-model-id',
};

export async function POST(request: Request) {
  const { messages, route = 'fast' } = await request.json();
  const modelId = allowedModels[route as keyof typeof allowedModels];

  const result = streamText({
    model: cometapi(modelId),
    messages,
  });

  return result.toDataStreamResponse();
}

Modelle nach Workload wechseln

Verwenden Sie die schnellere Route für dialogorientierte Eingaben und die Qualitätsroute für komplexe Analysen, umfangreiche Codeänderungen oder hochwertige Reviews. Sorgen Sie dafür, dass die Routing-Logik observierbar bleibt, damit Kosten und Qualität später verglichen werden können.

  • Routen Sie anhand eines expliziten Produktmodus, bevor Sie eine automatische Klassifizierung versuchen.
  • Erfassen Sie die ausgewählte Route, die Modell-ID, die Tokenanzahl, die Latenz und das Ergebnis der Anfrage.
  • Wenden Sie Ausgabenlimits auf Konto- und Anfrageebene an.

Checkliste für den Produktionseinsatz

Fügen Sie vor dem Start eine Schema-Validierung, eine Behandlung von Timeouts, Wiederholungsversuche bei vorübergehenden Fehlern und eine kompatible Fallback-Route hinzu. Geben Sie den API-Schlüssel des Upstream-Dienstes niemals in Browser-Code preis.

Häufig gestellte Fragen

Kann das Vercel AI SDK eine OpenAI-kompatible API verwenden?

Ja. Konfigurieren Sie einen kompatiblen Provider mit der alternativen Basis-URL und dem API-Schlüssel und geben Sie anschließend beim Erstellen der Anfrage die Modell-ID an.

Sollten Benutzer im Browser eine beliebige Modell-ID auswählen können?

Nein. Produktionsanwendungen sollten clientseitige Routennamen auf eine serverseitige Allowlist abbilden, damit Kosten, Fähigkeiten und Sicherheit kontrolliert bleiben.

Mit Integrationen & Workflows fortfahren
Zur Übersicht des Bereichs und zu zukünftigen Artikeln zurückkehren.
Bereich anzeigen