
AUTO
CometAPI Auto API is an intelligent model routing feature that allows developers to access the appropriate AI model without specifying a specific model ID for each request.
Wählen Sie Ihren Plan
Wählen Sie Ihren Plan
Durchsuchen und vergleichen Sie Text-, Bild-, Video- und Audiomodelle führender Anbieter. Funktionen und Preise prüfen und mit einem einzigen API-Schlüssel integrieren.

CometAPI Auto API is an intelligent model routing feature that allows developers to access the appropriate AI model without specifying a specific model ID for each request.

MiniMax-M3.1-Flash-Preview-API entdecken.

MiMo-V2.6-Pro-UltraSpeed ist Xiaomis latenzarme Serving-Variante von MiMo-V2.6-Pro, konzipiert für Anwendungen, bei denen die Reasoning-Fähigkeit des Pro-Modells mit deutlich schnellerer Ausgabegenerierung kombiniert werden muss.

GPT-6 Sol (gpt-6-sol) ist ein GPT-6-Reasoning-Modell von OpenAI, das für komplexe Programmierung, Agenten-Workflows und anspruchsvolle Wissensarbeit entwickelt wurde. OpenAI beschreibt es als ein Modell für komplexe Programmierung und Agenten-Workflows, mit adaptivem Reasoning, Verarbeitung langer Kontexte, Bildeingabe und Zugriff auf eine breite Palette an Tools über die Responses API.

GPT-6 Luna (gpt-6-luna) ist OpenAIs effizientes GPT-6-Modell für zielgerichtete, hochvolumige Workloads. OpenAI positioniert Luna in der GPT-6-Familie unterhalb von GPT-6 Sol und legt dabei den Schwerpunkt auf Effizienz, Reproduzierbarkeit und kostensensitiven Produktionseinsatz.

MiMo-V2.6-Flash ist Xiaomis effizienzfokussiertes Modell innerhalb der MiMo-V2.6-Familie. Es ist ein natives multimodales Reasoning-Modell, das für hochfrequente Aufrufe, großskalige Workloads, Programmierung, Automatisierung und Agentenaufgaben mit langem Zeithorizont ausgelegt ist.

MiMo-V2.6-Pro ist das Flaggschiff-Reasoning-Modell von Xiaomi MiMo innerhalb der MiMo-V2.6-Familie. Es ist ein natives Modell mit voller Modalitätsunterstützung, das für komplexe, langfristige Aufgaben in den Bereichen Softwareentwicklung, Forschung, Cybersicherheit, agentenbasierte Workflows, multimodale Analyse und Inhaltserstellung entwickelt wurde.

Hy-Image 3.5 Preview (hy-image-v3.5-preview) ist das professionelle Bildgenerierungsmodell von Tencent Hunyuan, fokussiert auf Text-zu-Bild-Generierung, referenzgestützte Generierung und mehrstufige Bildbearbeitung.

Grok Build 0.1 ist xAIs spezialisiertes Modell für agentenbasiertes Programmieren und Softwareentwicklung.

Claude Opus 5.5 wurde am 22. September 2026 veröffentlicht und ist für langandauernde agentische Programmierung und Wissensarbeit konzipiert.

Intelligenz der nächsten Generation für dauerhaft aktive Agenten

MiniMax H3 Max ist eine High-End-Variante der H3-Produktfamilie von MiniMax für Videogenerierung. Die dokumentierten H3-Max-Integrationen unterstützen die Text-zu-Video- und Bild-zu-Video-Generierung. Die offiziellen H3-Unterlagen von MiniMax beschreiben das umfassendere H3-System als ein omnimodales Videomodell mit nativem Stereoton.

Demnächst

Grok 4.7 ist das Frontier-Modell von SpaceXAI für Programmierung, Agentenaufgaben und Wissensarbeit. Es löst Grok 4.6 ab und nutzt ein größeres Basismodell sowie längeres Reinforcement-Learning-Training, das auf schwierige, mehrstündige Aufgaben ausgerichtet ist.

Claude Opus 5.2 könnte derzeit in Claude Code in begrenzten Tests erprobt werden. Hier ist, was die Leaks behaupten, was noch unbestätigt ist und wie der Zugriff auf die CometAPI nach der Veröffentlichung funktionieren würde.

Gemini 4 Pro-API entdecken.

Das Release Grok 4.20 führt eine Multi-Agenten-Architektur (mehrere spezialisierte Agenten, die in Echtzeit koordiniert werden), erweiterte Kontextmodi sowie gezielte Verbesserungen beim Befolgen von Anweisungen, bei der Reduzierung von Halluzinationen und bei strukturierten/werkzeuggestützten Ausgaben ein.

GPT-6 Astra, das Flaggschiffmodell für komplexes Schlussfolgern und Programmieren. Wählen Sie GPT-5.6 Terra, um Intelligenz und Kosten in Einklang zu bringen,

Generieren Sie Videos aus Text-Prompts, animieren Sie Standbilder oder bearbeiten Sie vorhandene Videos mit natürlicher Sprache. Die API unterstützt konfigurierbare Dauer, Seitenverhältnis und Auflösung für generierte Videos — das SDK übernimmt das asynchrone Polling automatisch.

Jev-API entdecken.

Von der schnellen Verifizierung bis zur kinoreifen Ausgabe basiert die Abrechnung auf der Dauer des generierten Videos, der Auswahl der geeigneten Auflösung und darauf, jede Generierung in eine geplante kreative Investition zu verwandeln – Aktivitätsregel

Grok Imagine Image 2.0, sein verbessertes KI-Modell zur Bildgenerierung und -bearbeitung

GLM-5.3-FlashX is Z.ai's high-speed API serving variant of GLM-5.3-Flash, designed for applications where model capability needs to be paired with lower response latency and high generation throughput.

GPT Image 2 ist das Bildgenerierungsmodell von openai auf dem neuesten Stand der Technik für schnelle, hochwertige Bildgenerierung und -bearbeitung. Es unterstützt flexible Bildgrößen und Bildeingaben mit hoher Wiedergabetreue.

Qwen3.8-Omni-Flash (qwen3.8-omni-flash) ist das native omnimodale Modell von Alibaba Cloud für Audio-/Videoverständnis und multimodale Inhaltsanalyse.

GLM-5.3-Flash ist das erste native multimodale Modell der GLM-5-Serie, das eine stärkere Intelligenz als GLM-5.2 bietet und dabei eine außerordentlich kosteneffiziente Architektur beibehält.

minimax-h3 ist ein neues Videogenerierungsmodell, das für hochwertige kreative Produktion entwickelt wurde. Es bietet ein verbessertes Prompt-Verständnis, stärkere visuelle Konsistenz, flüssigere Bewegungen und eine flexiblere Kontrolle über Referenzbilder für filmische Workflows der Videogenerierung.

Generieren Sie Bilder aus Text-Prompts mit Grok Imagine-Modellen. Die API unterstützt die Batch-Generierung mehrerer Bilder sowie die Steuerung von Seitenverhältnis und Auflösung.

Gemini 3.8 Flash ist ein leichtgewichtiges Gemini-Modell der nächsten Generation mit dem Ziel, ein besseres Gleichgewicht zwischen Geschwindigkeit, Kosten und Coding-Fähigkeiten zu erreichen.

FLUX 3 - Modelle der realen Welt: Auf dem Weg zu multimodalen Flow-Modellen als Rückgrat visueller Intelligenz.

Minimax-m3 ist ein multimodales KI-Modell, das für robustes Schlussfolgern, natürliche Konversation und die kreative Inhaltserstellung entwickelt wurde. Es bietet eine ausgewogene Leistung bei Aufgaben des Text- und visuellen Verständnisses und eignet sich damit für allgemeine KI-Anwendungen.

MiniMax-M2.7 bietet dieselbe erstklassige Intelligenz wie die Standardversion – einschließlich rekursiver Selbstweiterentwicklung und Produktivität auf Expertenniveau im Office-Bereich –, ist jedoch für Anwendungen konzipiert, die Latenzen unter einer Sekunde und eine Hochgeschwindigkeits-Token-Generierung erfordern. Dank einer verbesserten Inferenz-Backbone-Architektur ist die Ausgabegeschwindigkeit 66 % höher als beim Standardmodell (bis zu 100 tps). Es ist die bevorzugte Wahl für interaktive Programmierassistenten, die Ausführung von Agentenschleifen in Echtzeit und Unternehmens-Pipelines mit hohem Durchsatz und strengen Anforderungen an die Abschlusszeit.