GPT-6 Astra is now live on CometAPI →
technology/CometAPI Research

August 2026 KI-Modell-Launch-Radar: Was ist neu bei CometAPI

Review 15 AI models CometAPI added in August 2026, verified via official Changelog: priority picks, exact model IDs, native/compatible endpoints, pricing.

CometAPI
Bobby SpencerForschungsteam für KI-Modelle und API
Aktualisiert Sep 4, 2026 9 Min. Lesezeit
August 2026 KI-Modell-Launch-Radar: Was ist neu bei CometAPI
Dieses Muster verwenden

Den ersten API-Aufruf ausführen.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR: Das CometAPI Changelog verzeichnet 15 neue Modell-IDs im August 2026 über Text-, multimodale, Bild- und Video-Workloads. Starten Sie mit Seedance 2.5 oder Wan3.0 für Video, GLM 5.3 Flash für kostensensitive multimodale Aufgaben sowie Gemini 3.7 Flash für Coding und Langkontext; verifizieren Sie anschließend vor dem Deployment die Live-Modellseite, den Endpoint und den Preis.

Welche neuen KI-Modelle hat CometAPI im August 2026 hinzugefügt?

Die Übersicht zu CometAPIs August-Release ist hilfreich, weil jedes Modell unter einem API-Schlüssel und einem Billing-Workflow verfügbar ist – mit stabilen Katalog-IDs, dokumentierten Endpoints und modellbezogener Preisgestaltung. Entwickelnde können eine Modell-ID wechseln, ohne die gesamte Integration neu aufzubauen, und dennoch das native oder kompatible Request-Format nutzen, das am besten zum jeweiligen Provider passt.

Mit Stand vom 1. September 2026 ist das offizielle CometAPI Changelog die Quelle für den Veröffentlichungszeitpunkt im August und verzeichnet 15 neue Modell-IDs in den Bereichen textuelles Reasoning, visuelles Verständnis, Bildgenerierung und Video. Der Models Catalog und die individuellen Modellseiten bleiben die Quelle für aktuelle Verfügbarkeit und Preise. Die vorrangig zu testenden Modelle sind Seedance 2.5 für multimodales Video, Wan3.0 für produktive Videoworkflows, GLM 5.3 Flash für kostensensitives multimodales Reasoning und Gemini 3.7 Flash für Coding und Langkontext-Arbeit.

Zusammenfassung der CometAPI-Modelle vom August 2026

Model / IDModalityCurrent CometAPI Price (as of Sep 3, 2026)Recommended Endpoint
Gemini 3.7 Flash
gemini-3.7-flash
Multimodal → Text$0.60 input / $3.00 output pro 1M TokensPOST /v1beta/models/{model}:generateContent
Grok 4.6
grok-4.6
Text, Bild → Text$1.60 input / $4.80 output pro 1M TokensPOST /v1/chat/completions
POST /v1/responses
GLM 5.3
glm-5.3
Text → Text$1.12 input / $3.528 output pro 1M TokensPOST /v1/chat/completions
DeepSeek V4 Flash Vision
deepseek-v4-flash-vision
Text, Bild → Text$0.352 input / $1.056 output pro 1M TokensPOST /v1/chat/completions
Grok Imagine Image 2.0
grok-imagine-image-2.0
Text, Bild → Bild$0.032 pro RequestPOST /v1/images/generations
GLM 5.3 Flash
glm-5.3-flash
Text, Bild, Video → Text$0.06 input / $0.20 output pro 1M TokensPOST /v1/chat/completions
Seedance 2.5
seedance-2-5
Multimodal → VideoAb $0.0824/s; detaillierte Abrechnung: $0.103/s (480p), $0.231/s (720p)POST /v1/videos
Qwen3.8 Max
qwen3.8-max
Multimodal → Text$1.60 input / $4.80 output pro 1M TokensPOST /v1/chat/completions
POST /v1/responses
MiniMax H3
minimax-h3
Text, Bild, Video, Audio → VideoAb $0.064/s; aufgeführte Tarife: $0.08/s (768p), $0.13/s (2K)POST /v1/videos
GET /v1/videos/{task_id}
DeepSeek V4 Pro 0813
deepseek-v4-pro-0813
Text → Text$0.528 input / $1.584 output / $0.0176 cache read pro 1M Tokens; 2× in den angegebenen UTC-ZeitfensternPOST /v1/chat/completions
FLUX 3
flux-3
Multimodal → Video$0.136/s (720p); $0.232/s (1080p)POST /v1/videos
GET /v1/videos/{task_id}
Qwen3.8 2.4T A95B
qwen3.8-2.4t-a95b
Text → Text$1.60 input / $4.80 output pro 1M TokensPOST /v1/chat/completions
Grok Imagine Video 1.5
grok-imagine-video-1.5
Text, Bild → VideoBildeingabe $0.008; Ausgabe $0.064/s (480p), $0.112/s (720p), $0.20/s (1080p)POST /grok/v1/videos/generations
GET /grok/v1/videos/{request_id}
Wan3.0
wan3.0
Text, Bild → VideoAb $0.04/s; aufgeführte Tarife: $0.05/s (480p), $0.10/s (720p), $0.20/s (1080p)POST /v1/videos
Qwen3.8 Flash
qwen3.8-flash
Multimodal → Text$0.12 input / $0.376001 output pro 1M TokensPOST /v1/chat/completions

Diese Tabelle hebt priorisierte Modelle aus den 15 Ergänzungen im CometAPI August Changelog hervor, einschließlich zeitlich begrenzter Rabattpreise, soweit von CometAPI angegeben. Da Benchmarks von unterschiedlichen Anbietern und Veröffentlichungsterminen stammen, sollte der Katalog für Discovery und Integrationsplanung genutzt werden – nicht als universelle Head-to-Head-Bestenliste.

Reine Preisaktualisierungen für gpt-5.6-sol und minimax-m3 sowie Serviceanpassungen für bestehende DeepSeek-Modelle zählen nicht als neue Releases.

4 August-Modelle, die ich empfehle

Der August-Katalog ist breit, doch vier Modelle stechen für unterschiedliche Workloads hervor. Die folgenden Empfehlungen konzentrieren sich auf den praktischen Fit statt auf die Wiederholung der Preistabelle; bestätigen Sie vor dem produktiven Einsatz den Live-Preis und das Request-Format auf der jeweiligen Modellseite.

Seedance 2.5: Längere multimodale Videos

Da Videopreise pro Sekunde abgerechnet werden und je nach Auflösung variieren, halten Sie das Snapshot-Datum fest und verlinken zurück auf die Live-Modellseite. Für Seedance 2.5 kostet ein 480p-Clip $0.103 pro Sekunde, während ein 720p-Clip $0.231 pro Sekunde kostet – mehr als doppelt so viel. Planen Sie das Budget anhand der Auflösung, die Ihr Workload tatsächlich nutzt.

Wan3.0: Produktionstaugliches Video mit niedriger Einstiegskosten

Wan3.0 ist jetzt für Text-zu-Video- und Bild-zu-Video-Workflows live. Es ist eine praktische Option, wenn Teams einen asynchronen Produktions-Endpoint, vorhersehbare Abrechnung pro Sekunde und Spielraum für den Vergleich von Geschwindigkeit, Bewegungsqualität und Auflösung mit anderen Videomodellen benötigen.

GLM 5.3 Flash: Günstiges multimodales Reasoning

GLM 5.3 Flash ist die kostenorientierte Wahl für großvolumiges Text- und Bildverständnis. Testen Sie es für Extraktion, visuelle Fragebeantwortung, Coding-Unterstützung und Agent-Schritte, bei denen Latenz und Kosten stärker zählen als maximale Benchmark-Leistung.

Kimi K3: Langkontext-Coding und Wissensarbeit

Kimi K3 wurde im Juli eingeführt, blieb aber eines der relevantesten Modelle zur Adoption im August. Sein Kontextfenster von einer Million Tokens und die OpenAI-kompatible Chat-Route machen es nützlich für große Repositories, Forschungssynthese und langlaufende Coding-Workflows.

Welches neue KI-Modell sollten Sie je Use Case nutzen?

Gemini 3.7 Flash: Coding und Langkontext-Arbeit

Veröffentlichte Signale betonen Software-Engineering und Wissensarbeit, aber der nützliche Produktionstest ist Ihr eigenes Repository oder Dokumentenset. Führen Sie ein festes Prompt-Paket aus, zeichnen Sie Akzeptanzquote, Latenz und abgerechnete Tokens auf und vergleichen Sie das Ergebnis mit dem Modell, das Sie bereits nutzen.

Videomodelle: Bewegung, Referenztreue und Kosten pro akzeptiertem Clip

Für Seedance 2.5, Wan3.0 und MiniMax H3 verwenden Sie dieselben Prompts, Dauer, Seitenverhältnis und Referenzbild. Bewerten Sie Bewegungs­konsistenz, Prompt-Treue, visuelle Artefakte, Generierungszeit und Kosten pro Clip, der die Prüfung besteht.

Multimodale Modelle: Genauigkeit vor maximalem Kontext

Für GLM 5.3 Flash, DeepSeek V4 Flash Vision und Gemini 3.7 Flash testen Sie Screenshots, Diagramme, PDFs und gemischte Text-Bild-Eingaben. Ein großes Kontextfenster zählt nur, wenn das Modell die richtigen Belege findet und eine stabile Antwort liefert.

DeepSeek V4 Flash Vision: Nutzen Sie es für visuelle Coding-Agenten, Diagramm-Analyse, Screenshots und Browser-Automation. Benchmarken Sie es mit Ihren eigenen gemischten Text-Bild-Aufgaben und vergleichen Sie Genauigkeit, Latenz und abgerechnete Tokens, bevor Sie es produktiv übernehmen.

Grok Imagine Image 2.0: Nutzen Sie es für Generierungs-plus-Editing-Pipelines, mehrere Seitenverhältnisse, produktives Creative und referenzbasierte Iteration. Budgetieren Sie nach der Qualität und Auflösung, die Ihr Workload erfordert – nicht nur nach dem niedrigsten Einstiegspreis.

Demnächst auf CometAPI: Watchlist

Mit Stand vom 3. September 2026 umfasst diese Watchlist nur Modelle, deren CometAPI-Seiten mit Coming Soon markiert sind. Behandeln Sie deren Modell-IDs, Routen und Preise als vorläufig, bis der Katalog den Live-Produktionszugang bestätigt.

ModelModel IDStatusEntscheidung
Qwen-Image-3.0qwen-image-3.0Coming SoonWatchlist; noch keinen Produktionstraffic einplanen.
Veo 4veo4Coming SoonAuf bestätigte Live-Route und Abrechnung warten, bevor produziert wird.

Wie rufen Sie OpenAI‑kompatible und native APIs mit CometAPI auf?

CometAPI nutzt einen API-Schlüssel und einen Billing-Workflow, zwingt aber nicht jeden Provider in ein einheitliches Request-Format. Nutzen Sie die Modellseite, um die passendste Route zu wählen: native Gemini-Content-Generation für Gemini, OpenAI‑kompatible Chat-Route für viele LLMs, Image-Endpoints für Bildmodelle und die asynchrone Video-API für Videomodelle. Die kurzen POST-Beispiele unten zeigen nur Route und model-Feld; die vollständigen Parameter finden Sie in der API documentation.

Die POST-Route variiert je nach Modalität. Gemini unterstützt die native /v1beta/models/{model}:generateContent-Route ebenso wie kompatible Muster; Grok Imagine Image 2.0 nutzt /v1/images/generations; und Seedance 2.5 nutzt /v1/videos, gefolgt von Task-Status-Polling. Verwenden Sie die Text API, Image API und Video API als maßgebliche Referenz.

FAQ

Was sind die besten Aggregatoren für KI-APIs für Entwickler?

Die beste Wahl hängt davon ab, ob Sie nur Text-LLMs oder einen breiteren Stack aus Text, Bild, Audio und Video benötigen. Bewerten Sie jeden Aggregator nach Live-Modell-IDs, Endpoint-Kompatibilität, Nutzungs­transparenz, Fallback-Unterstützung, Abrechnungs­transparenz und Aktualität des Katalogs. CometAPI lohnt sich, wenn ein Key und ein Billing-Workflow über mehrere Modalitäten Priorität haben.

Welche Modelle aus August 2026 sind tatsächlich auf CometAPI live?

Mit Stand 1. September verzeichnet das August-Changelog 15 neue Modell-IDs. Die vollständige Liste, unterstützte Formate und Preisnotizen sind in der obigen Tabelle zusammengefasst. Prüfen Sie den Models Catalog vor dem Deployment erneut, da Verfügbarkeit, Aliasse und Preise sich ändern können.

Kann ich den Provider wechseln, ohne mein gesamtes SDK anzupassen?

Oft, aber nicht immer. Viele Textmodelle unterstützen /v1/chat/completions, während Gemini auch seine native Content-Generation-Route nutzen kann und Medienmodelle Image-, Realtime- oder Video-Endpoints verwenden. CometAPI führt einen Key und einen Billing-Workflow über diese Formate, sodass der Providerwechsel einfacher ist, auch wenn der Request-Body nicht identisch ist.

Wie funktioniert die Videogenerierung?

Die Videogenerierung ist asynchron. Erstellen Sie den Task, persistieren Sie die zurückgegebene Task-ID und pollen Sie oder erhalten Sie einen Webhook, bis der Task erfolgreich ist oder fehlschlägt. Erst nach Abschluss sollte die Anwendung das Ergebnis abrufen und speichern.

Wie oft sollte ich Modell-IDs und Preise erneut prüfen?

Vor der Integration, vor einem Produktions-Rollout und vor jeder großen Batch. Automatisierte Systeme sollten außerdem die genaue Modell-ID und den zum Zeitpunkt der Kostenschätzung genutzten Preissnapshot protokollieren, damit spätere Katalogänderungen die Historie einer Deployment-Entscheidung nicht verfälschen.

Fazit

Die 15 August-Ergänzungen bei CometAPI erweitern die praktischen Optionen in Coding, Vision, Bild und Video – mit einem Key und einem Billing-Workflow. Starten Sie je nach Workload mit Seedance 2.5, Wan3.0, GLM 5.3 Flash oder Gemini 3.7 Flash und befördern Sie ein Modell erst dann in die Produktion, wenn feste Prompt-Tests Qualität, Latenz, Zuverlässigkeit und abgerechnete Kosten messen.

Weiterlernen

Diesen Artikel mit der nächsten Entscheidung verknüpfen.

Alle Themen anzeigen
Veröffentlicht am Sep 3, 2026
Zuletzt aktualisiert Sep 4, 2026
2 Aufrufe
Auf Klarheit, Quellenangabe und aktuelle API-Terminologie geprüft.

Bereit, die KI-Entwicklungskosten um 20 % zu senken?

In wenigen Minuten kostenlos starten. Inklusive kostenlosem Testguthaben. Keine Kreditkarte erforderlich.

Mehr lesen