TL;DR: Das CometAPI Changelog verzeichnet 15 neue Modell-IDs im August 2026 über Text-, multimodale, Bild- und Video-Workloads. Starten Sie mit Seedance 2.5 oder Wan3.0 für Video, GLM 5.3 Flash für kostensensitive multimodale Aufgaben sowie Gemini 3.7 Flash für Coding und Langkontext; verifizieren Sie anschließend vor dem Deployment die Live-Modellseite, den Endpoint und den Preis.
Welche neuen KI-Modelle hat CometAPI im August 2026 hinzugefügt?
Die Übersicht zu CometAPIs August-Release ist hilfreich, weil jedes Modell unter einem API-Schlüssel und einem Billing-Workflow verfügbar ist – mit stabilen Katalog-IDs, dokumentierten Endpoints und modellbezogener Preisgestaltung. Entwickelnde können eine Modell-ID wechseln, ohne die gesamte Integration neu aufzubauen, und dennoch das native oder kompatible Request-Format nutzen, das am besten zum jeweiligen Provider passt.
Mit Stand vom 1. September 2026 ist das offizielle CometAPI Changelog die Quelle für den Veröffentlichungszeitpunkt im August und verzeichnet 15 neue Modell-IDs in den Bereichen textuelles Reasoning, visuelles Verständnis, Bildgenerierung und Video. Der Models Catalog und die individuellen Modellseiten bleiben die Quelle für aktuelle Verfügbarkeit und Preise. Die vorrangig zu testenden Modelle sind Seedance 2.5 für multimodales Video, Wan3.0 für produktive Videoworkflows, GLM 5.3 Flash für kostensensitives multimodales Reasoning und Gemini 3.7 Flash für Coding und Langkontext-Arbeit.
Zusammenfassung der CometAPI-Modelle vom August 2026
| Model / ID | Modality | Current CometAPI Price (as of Sep 3, 2026) | Recommended Endpoint |
|---|---|---|---|
| Gemini 3.7 Flash gemini-3.7-flash | Multimodal → Text | $0.60 input / $3.00 output pro 1M Tokens | POST /v1beta/models/{model}:generateContent |
| Grok 4.6 grok-4.6 | Text, Bild → Text | $1.60 input / $4.80 output pro 1M Tokens | POST /v1/chat/completions POST /v1/responses |
| GLM 5.3 glm-5.3 | Text → Text | $1.12 input / $3.528 output pro 1M Tokens | POST /v1/chat/completions |
| DeepSeek V4 Flash Vision deepseek-v4-flash-vision | Text, Bild → Text | $0.352 input / $1.056 output pro 1M Tokens | POST /v1/chat/completions |
| Grok Imagine Image 2.0 grok-imagine-image-2.0 | Text, Bild → Bild | $0.032 pro Request | POST /v1/images/generations |
| GLM 5.3 Flash glm-5.3-flash | Text, Bild, Video → Text | $0.06 input / $0.20 output pro 1M Tokens | POST /v1/chat/completions |
| Seedance 2.5 seedance-2-5 | Multimodal → Video | Ab $0.0824/s; detaillierte Abrechnung: $0.103/s (480p), $0.231/s (720p) | POST /v1/videos |
| Qwen3.8 Max qwen3.8-max | Multimodal → Text | $1.60 input / $4.80 output pro 1M Tokens | POST /v1/chat/completions POST /v1/responses |
| MiniMax H3 minimax-h3 | Text, Bild, Video, Audio → Video | Ab $0.064/s; aufgeführte Tarife: $0.08/s (768p), $0.13/s (2K) | POST /v1/videos GET /v1/videos/{task_id} |
| DeepSeek V4 Pro 0813 deepseek-v4-pro-0813 | Text → Text | $0.528 input / $1.584 output / $0.0176 cache read pro 1M Tokens; 2× in den angegebenen UTC-Zeitfenstern | POST /v1/chat/completions |
| FLUX 3 flux-3 | Multimodal → Video | $0.136/s (720p); $0.232/s (1080p) | POST /v1/videos GET /v1/videos/{task_id} |
| Qwen3.8 2.4T A95B qwen3.8-2.4t-a95b | Text → Text | $1.60 input / $4.80 output pro 1M Tokens | POST /v1/chat/completions |
| Grok Imagine Video 1.5 grok-imagine-video-1.5 | Text, Bild → Video | Bildeingabe $0.008; Ausgabe $0.064/s (480p), $0.112/s (720p), $0.20/s (1080p) | POST /grok/v1/videos/generations GET /grok/v1/videos/{request_id} |
| Wan3.0 wan3.0 | Text, Bild → Video | Ab $0.04/s; aufgeführte Tarife: $0.05/s (480p), $0.10/s (720p), $0.20/s (1080p) | POST /v1/videos |
| Qwen3.8 Flash qwen3.8-flash | Multimodal → Text | $0.12 input / $0.376001 output pro 1M Tokens | POST /v1/chat/completions |
Diese Tabelle hebt priorisierte Modelle aus den 15 Ergänzungen im CometAPI August Changelog hervor, einschließlich zeitlich begrenzter Rabattpreise, soweit von CometAPI angegeben. Da Benchmarks von unterschiedlichen Anbietern und Veröffentlichungsterminen stammen, sollte der Katalog für Discovery und Integrationsplanung genutzt werden – nicht als universelle Head-to-Head-Bestenliste.
Reine Preisaktualisierungen für gpt-5.6-sol und minimax-m3 sowie Serviceanpassungen für bestehende DeepSeek-Modelle zählen nicht als neue Releases.
4 August-Modelle, die ich empfehle
Der August-Katalog ist breit, doch vier Modelle stechen für unterschiedliche Workloads hervor. Die folgenden Empfehlungen konzentrieren sich auf den praktischen Fit statt auf die Wiederholung der Preistabelle; bestätigen Sie vor dem produktiven Einsatz den Live-Preis und das Request-Format auf der jeweiligen Modellseite.
Seedance 2.5: Längere multimodale Videos
Da Videopreise pro Sekunde abgerechnet werden und je nach Auflösung variieren, halten Sie das Snapshot-Datum fest und verlinken zurück auf die Live-Modellseite. Für Seedance 2.5 kostet ein 480p-Clip $0.103 pro Sekunde, während ein 720p-Clip $0.231 pro Sekunde kostet – mehr als doppelt so viel. Planen Sie das Budget anhand der Auflösung, die Ihr Workload tatsächlich nutzt.
Wan3.0: Produktionstaugliches Video mit niedriger Einstiegskosten
Wan3.0 ist jetzt für Text-zu-Video- und Bild-zu-Video-Workflows live. Es ist eine praktische Option, wenn Teams einen asynchronen Produktions-Endpoint, vorhersehbare Abrechnung pro Sekunde und Spielraum für den Vergleich von Geschwindigkeit, Bewegungsqualität und Auflösung mit anderen Videomodellen benötigen.
GLM 5.3 Flash: Günstiges multimodales Reasoning
GLM 5.3 Flash ist die kostenorientierte Wahl für großvolumiges Text- und Bildverständnis. Testen Sie es für Extraktion, visuelle Fragebeantwortung, Coding-Unterstützung und Agent-Schritte, bei denen Latenz und Kosten stärker zählen als maximale Benchmark-Leistung.
Kimi K3: Langkontext-Coding und Wissensarbeit
Kimi K3 wurde im Juli eingeführt, blieb aber eines der relevantesten Modelle zur Adoption im August. Sein Kontextfenster von einer Million Tokens und die OpenAI-kompatible Chat-Route machen es nützlich für große Repositories, Forschungssynthese und langlaufende Coding-Workflows.
Welches neue KI-Modell sollten Sie je Use Case nutzen?
Gemini 3.7 Flash: Coding und Langkontext-Arbeit
Veröffentlichte Signale betonen Software-Engineering und Wissensarbeit, aber der nützliche Produktionstest ist Ihr eigenes Repository oder Dokumentenset. Führen Sie ein festes Prompt-Paket aus, zeichnen Sie Akzeptanzquote, Latenz und abgerechnete Tokens auf und vergleichen Sie das Ergebnis mit dem Modell, das Sie bereits nutzen.
Videomodelle: Bewegung, Referenztreue und Kosten pro akzeptiertem Clip
Für Seedance 2.5, Wan3.0 und MiniMax H3 verwenden Sie dieselben Prompts, Dauer, Seitenverhältnis und Referenzbild. Bewerten Sie Bewegungskonsistenz, Prompt-Treue, visuelle Artefakte, Generierungszeit und Kosten pro Clip, der die Prüfung besteht.
Multimodale Modelle: Genauigkeit vor maximalem Kontext
Für GLM 5.3 Flash, DeepSeek V4 Flash Vision und Gemini 3.7 Flash testen Sie Screenshots, Diagramme, PDFs und gemischte Text-Bild-Eingaben. Ein großes Kontextfenster zählt nur, wenn das Modell die richtigen Belege findet und eine stabile Antwort liefert.
DeepSeek V4 Flash Vision: Nutzen Sie es für visuelle Coding-Agenten, Diagramm-Analyse, Screenshots und Browser-Automation. Benchmarken Sie es mit Ihren eigenen gemischten Text-Bild-Aufgaben und vergleichen Sie Genauigkeit, Latenz und abgerechnete Tokens, bevor Sie es produktiv übernehmen.
Grok Imagine Image 2.0: Nutzen Sie es für Generierungs-plus-Editing-Pipelines, mehrere Seitenverhältnisse, produktives Creative und referenzbasierte Iteration. Budgetieren Sie nach der Qualität und Auflösung, die Ihr Workload erfordert – nicht nur nach dem niedrigsten Einstiegspreis.
Demnächst auf CometAPI: Watchlist
Mit Stand vom 3. September 2026 umfasst diese Watchlist nur Modelle, deren CometAPI-Seiten mit Coming Soon markiert sind. Behandeln Sie deren Modell-IDs, Routen und Preise als vorläufig, bis der Katalog den Live-Produktionszugang bestätigt.
| Model | Model ID | Status | Entscheidung |
|---|---|---|---|
| Qwen-Image-3.0 | qwen-image-3.0 | Coming Soon | Watchlist; noch keinen Produktionstraffic einplanen. |
| Veo 4 | veo4 | Coming Soon | Auf bestätigte Live-Route und Abrechnung warten, bevor produziert wird. |
Wie rufen Sie OpenAI‑kompatible und native APIs mit CometAPI auf?
CometAPI nutzt einen API-Schlüssel und einen Billing-Workflow, zwingt aber nicht jeden Provider in ein einheitliches Request-Format. Nutzen Sie die Modellseite, um die passendste Route zu wählen: native Gemini-Content-Generation für Gemini, OpenAI‑kompatible Chat-Route für viele LLMs, Image-Endpoints für Bildmodelle und die asynchrone Video-API für Videomodelle. Die kurzen POST-Beispiele unten zeigen nur Route und model-Feld; die vollständigen Parameter finden Sie in der API documentation.
- Beispiel für Text- und multimodale LLMs: POST https://api.cometapi.com/v1beta/models/gemini-3.7-flash:generateContent
- Bildgenerierung: POST
https://api.cometapi.com/v1/images/generations - Videogenerierung: POST
https://api.cometapi.com/v1/videos
Die POST-Route variiert je nach Modalität. Gemini unterstützt die native /v1beta/models/{model}:generateContent-Route ebenso wie kompatible Muster; Grok Imagine Image 2.0 nutzt /v1/images/generations; und Seedance 2.5 nutzt /v1/videos, gefolgt von Task-Status-Polling. Verwenden Sie die Text API, Image API und Video API als maßgebliche Referenz.
FAQ
Was sind die besten Aggregatoren für KI-APIs für Entwickler?
Die beste Wahl hängt davon ab, ob Sie nur Text-LLMs oder einen breiteren Stack aus Text, Bild, Audio und Video benötigen. Bewerten Sie jeden Aggregator nach Live-Modell-IDs, Endpoint-Kompatibilität, Nutzungstransparenz, Fallback-Unterstützung, Abrechnungstransparenz und Aktualität des Katalogs. CometAPI lohnt sich, wenn ein Key und ein Billing-Workflow über mehrere Modalitäten Priorität haben.
Welche Modelle aus August 2026 sind tatsächlich auf CometAPI live?
Mit Stand 1. September verzeichnet das August-Changelog 15 neue Modell-IDs. Die vollständige Liste, unterstützte Formate und Preisnotizen sind in der obigen Tabelle zusammengefasst. Prüfen Sie den Models Catalog vor dem Deployment erneut, da Verfügbarkeit, Aliasse und Preise sich ändern können.
Kann ich den Provider wechseln, ohne mein gesamtes SDK anzupassen?
Oft, aber nicht immer. Viele Textmodelle unterstützen /v1/chat/completions, während Gemini auch seine native Content-Generation-Route nutzen kann und Medienmodelle Image-, Realtime- oder Video-Endpoints verwenden. CometAPI führt einen Key und einen Billing-Workflow über diese Formate, sodass der Providerwechsel einfacher ist, auch wenn der Request-Body nicht identisch ist.
Wie funktioniert die Videogenerierung?
Die Videogenerierung ist asynchron. Erstellen Sie den Task, persistieren Sie die zurückgegebene Task-ID und pollen Sie oder erhalten Sie einen Webhook, bis der Task erfolgreich ist oder fehlschlägt. Erst nach Abschluss sollte die Anwendung das Ergebnis abrufen und speichern.
Wie oft sollte ich Modell-IDs und Preise erneut prüfen?
Vor der Integration, vor einem Produktions-Rollout und vor jeder großen Batch. Automatisierte Systeme sollten außerdem die genaue Modell-ID und den zum Zeitpunkt der Kostenschätzung genutzten Preissnapshot protokollieren, damit spätere Katalogänderungen die Historie einer Deployment-Entscheidung nicht verfälschen.
Fazit
Die 15 August-Ergänzungen bei CometAPI erweitern die praktischen Optionen in Coding, Vision, Bild und Video – mit einem Key und einem Billing-Workflow. Starten Sie je nach Workload mit Seedance 2.5, Wan3.0, GLM 5.3 Flash oder Gemini 3.7 Flash und befördern Sie ein Modell erst dann in die Produktion, wenn feste Prompt-Tests Qualität, Latenz, Zuverlässigkeit und abgerechnete Kosten messen.
