Gemini 3.7 Flash is now live on CometAPI →
Eine API, jedes Modell

Entdecken Sie den CometAPI-Modellkatalog

Durchsuchen und vergleichen Sie Text-, Bild-, Video- und Audiomodelle führender Anbieter. Funktionen und Preise prüfen und mit einem einzigen API-Schlüssel integrieren.

281+ ModelleEinheitliche AbrechnungProduktionsreife API

Filter

EingabepreiseKOSTENLOS$5+
KOSTENLOS$0.5$1$5+
281 Modelle verfügbar
Nach Funktion, Anbieter oder Preis filtern.
Gemini 3.7 Flash
Google
G
Text-Generierung

Gemini 3.7 Flash

gemini-3.7-flash
Text-Modellimage-to-textpdf-to-textspeech-to-texttext-to-textvideo-to-text

3.7 Flash delivers substantial improvements across software engineering, knowledge work, and web development workflows — with an introductory price of half the original 3.6 Flash cost per million tokens.

Ab
$0.6/1M tokens
Modell ansehen
DeepSeek V4 Pro
DeepSeek
Beliebt
D
Text-Generierung

DeepSeek V4 Pro

deepseek-v4-pro
Text-ModellBeliebttext-to-text

DeepSeek V4 Pro ist ein großskaliges Mixture-of-Experts-Modell von DeepSeek mit 1.6T Gesamtparametern und 49B aktivierten Parametern, das ein 1M-Token-Kontextfenster unterstützt. Es ist für fortgeschrittenes Schlussfolgern, Programmierung und Agenten-Workflows mit langem Planungshorizont ausgelegt und zeigt starke Leistung in Benchmarks zu Wissen, Mathematik und Softwareentwicklung.

Ab
$0.416/1M tokens
Modell ansehen
Grok 4.6
xAI
X
Text-Generierung

Grok 4.6

grok-4.6
Text-Modellimage-to-texttext-to-text

Das Flaggschiffmodell für Code und alles andere: agentische Tool-Aufrufe, minimale Halluzinationen, konfigurierbares Schlussfolgern.

Ab
$1.6/1M tokens
Modell ansehen
MiniMax H3
MiniMax
Beliebt
M
Video-Generierung

MiniMax H3

minimax-h3
Video-ModellBeliebttext-to-videoimage-to-video

minimax-h3 ist ein neues Videogenerierungsmodell, das für hochwertige kreative Produktion entwickelt wurde. Es bietet ein verbessertes Prompt-Verständnis, stärkere visuelle Konsistenz, flüssigere Bewegungen und eine flexiblere Kontrolle über Referenzbilder für filmische Workflows der Videogenerierung.

Ab
$0.08/s
Modell ansehen
Seedance-2-5
Bytedance
B
Video-Generierung

Seedance-2-5

seedance-2-5
Video-Modelltext-to-videoimage-to-video

seedance-2-5 ist ein Modell der nächsten Generation für die gemeinsame Audio-Video-Generierung, entwickelt für 30-Sekunden-Storytelling, mit präziser Referenzsteuerung und leistungsstarken Bearbeitungsfunktionen.

Ab
$0.103/s
Modell ansehen
Claude Sonnet 5
Anthropic
Beliebt
C
Text-Generierung

Claude Sonnet 5

claude-sonnet-5
Text-ModellBeliebttext-to-textpdf-to-textimage-to-text1M Kontext

Hochleistungsmodell für Programmierung und Agenten

Ab
$1.6/1M tokens
Modell ansehen
Qwen3.8-Max
Aliyun
Q
Text-Generierung

Qwen3.8-Max

qwen3.8-max
Text-Modelltext-to-textimage-to-textpdf-to-textvideo-to-text

Qwen3.8-Max ist das Flaggschiff-Sprachmodell von Alibaba Qwen, entwickelt für fortgeschrittenes Schlussfolgern, agentenbasierte Workflows, multimodales Verständnis und KI-Anwendungen im Unternehmensmaßstab. Es verfügt über 2.4T Parameter, setzt auf die MoE-Architektur, unterstützt das Umschalten zwischen Denk- und Schnellinferenz-Modi, kann verschiedene Inhaltsformate verarbeiten und liefert hervorragende Leistungen in Szenarien wie Code-Engineering, professioneller Büroarbeit und komplexem logischen Schlussfolgern, nur von Anthropic's Fable 5 übertroffen.

Ab
$1.6/1M tokens
Modell ansehen
Claude Opus 5
Anthropic
Beliebt
C
Text-Generierung

Claude Opus 5

claude-opus-5
Text-ModellBeliebttext-to-textimage-to-textpdf-to-text

Claude Opus 5 ist ab heute verfügbar. Es ist ein durchdachtes und proaktives Modell, das der Spitzenintelligenz von Claude Fable 5 zum halben Preis nahekommt.

Ab
$4/1M tokens
Modell ansehen
Happy Horse 1.1
Aliyun
Beliebt
Q
Video-Generierung

Happy Horse 1.1

happyhorse-1.1
Video-ModellBeliebttext-to-videoimage-to-video

HappyHorse 1.1 ist ein multimodales Videogenerationsmodell, das für professionelle Content-Erstellung, Werbung, Kurzfilme, Social-Media-Produktion und Storytelling entwickelt wurde. Es erweitert die Fähigkeiten von HappyHorse 1.0 — das nach hohen Platzierungen in unabhängigen Evaluierungen zur Videogenerierung große Aufmerksamkeit erhielt — um eine stärkere Szenenkohärenz und eine verbesserte visuelle Wiedergabetreue.

Ab
$0.112/s
Modell ansehen
Flux 3
Flux
Demnächst verfügbar
F
Video-Generierung

Flux 3

flux-3
Video-ModellDemnächst verfügbartext-to-video

Demnächst

Ab
Demnächst verfügbar
Modell ansehen
Claude Fable 5
Anthropic
Beliebt
C
Text-Generierung

Claude Fable 5

claude-fable-5
Text-ModellBeliebttext-to-textpdf-to-textimage-to-text

Der Zugriff auf Claude Fable 5 wurde wiederhergestellt. Es bringt Intelligenz der 5. Generation in Ihre anspruchsvollsten Programmierprojekte und beruflichen Aufgaben.

Ab
$8/1M tokens
Modell ansehen
GPT 5.6
OpenAI
O
Text-Generierung

GPT 5.6

gpt-5.6
Text-Modelltext-to-textimage-to-text

Starten Sie mit GPT-5.6 Sol für komplexes Schlussfolgern und Programmieren, wählen Sie GPT-5.6 Terra, um Intelligenz und Kosten auszugleichen, oder verwenden Sie GPT-5.6 Luna für kostensensible, hochvolumige Workloads.

Ab
Preise ansehen
Modell ansehen
GPT Image 2
OpenAI
Beliebt
O
Image-Generierung

GPT Image 2

gpt-image-2
Image-ModellBeliebttext-to-image

GPT Image 2 ist das Bildgenerierungsmodell von openai auf dem neuesten Stand der Technik für schnelle, hochwertige Bildgenerierung und -bearbeitung. Es unterstützt flexible Bildgrößen und Bildeingaben mit hoher Wiedergabetreue.

Ab
$4/1M tokens
Modell ansehen
Gemini 3.6 Flash
Google
Beliebt
G
Text-Generierung

Gemini 3.6 Flash

gemini-3.6-flash
Text-ModellBeliebttext-to-text

Gemini 3.6 Flash liefert dauerhaft Intelligenz auf Spitzenniveau, optimiert für Aufgaben in der realen Welt, mit höherer Geschwindigkeit und geringeren Kosten. Für das agentische Zeitalter konzipiert, überzeugt es bei der Codegenerierung, agentischer Ausführung und räumlichem Schlussfolgern. Dieses Modell ist besonders effektiv für schnelle agentische Schleifen, die komplexe Codezyklen und Iterationen umfassen.

Ab
$1.2/1M tokens
Modell ansehen
Seedance 2-0
Bytedance
Beliebt
B
Video-Generierung

Seedance 2-0

doubao-seedance-2-0
Video-ModellBeliebttext-to-videoimage-to-video

Seedance 2.0 ist das multimodale Video‑Foundation‑Modell der nächsten Generation von ByteDance, das auf filmische, narrative Videogenerierung mit mehreren Einstellungen fokussiert ist. Im Unterschied zu Text‑zu‑Video‑Demos mit nur einer Einstellung betont Seedance 2.0 referenzbasierte Steuerung (Bilder, kurze Clips, Audio), kohärente Figuren‑ und Stilkonsistenz über Einstellungen hinweg sowie native Audio-/Video‑Synchronisation — mit dem Ziel, KI‑Video für professionelle Kreativ- und Previsualisierungs‑Workflows nutzbar zu machen.

Ab
$0.056/s
Modell ansehen
Nano Banana 2 lite
Google
Beliebt
G
Image-Generierung

Nano Banana 2 lite

gemini-3.1-flash-lite-image
Image-ModellBeliebttext-to-image

Gemini 3.1 Flash Lite Image model ist ein Effizienzspezialist innerhalb der Bildgenerierungsfamilie und wurde für ultraniedrige Latenz sowie kosteneffiziente Bildgenerierung und -bearbeitung entwickelt.

Ab
$0.2/1M tokens
Modell ansehen
Claude Opus 4.8
Anthropic
Beliebt
C
Text-Generierung

Claude Opus 4.8

claude-opus-4-8
Text-ModellBeliebttext-to-textimage-to-textpdf-to-text200K tokens Kontext

Claude Opus 4.8 ist ein Premium-KI-Modell, entwickelt für fortgeschrittenes Schlussfolgern, tiefgehende Analysen und hochwertige Inhaltserstellung. Es überzeugt beim Umgang mit komplexen Anweisungen, beim Verständnis umfangreicher Kontexte und bei anspruchsvoller Problemlösung in professionellen und technischen Bereichen.

Ab
$4/1M tokens
Modell ansehen
Gemini 3.5 Flash
Google
Beliebt
G
Text-Generierung

Gemini 3.5 Flash

gemini-3.5-flash
Text-ModellBeliebttext-to-textimage-to-textvideo-to-textspeech-to-textpdf-to-text

Gemini 3.5 Flash ist ein Hochgeschwindigkeits-KI-Modell, das für schnelle Antwortzeiten und effiziente Codegenerierung entwickelt wurde. Es bietet eine deutlich verbesserte Generierungsgeschwindigkeit bei gleichzeitig starken Reasoning-Fähigkeiten und eignet sich damit für Echtzeitanwendungen und Entwickler-Workflows.

Ab
$1.2/1M tokens
Modell ansehen
Gemini 3.1 Pro
Google
G
Text-Generierung

Gemini 3.1 Pro

gemini-3.1-pro-preview
Text-Modelltext-to-textimage-to-textvideo-to-textspeech-to-textpdf-to-text

Gemini 3.1 Pro ist die nächste Generation der Gemini-Modellreihe, eine Suite hochleistungsfähiger, nativ multimodaler Reasoning-Modelle. Gemini 3 Pro ist jetzt Googles fortschrittlichstes Modell für komplexe Aufgaben und kann umfangreiche Datensätze sowie anspruchsvolle Problemstellungen aus verschiedenen Informationsquellen verstehen, darunter Text, Audio, Bilder, Videos und ganze Code-Repositories.

Ab
$1.6/1M tokens
Modell ansehen
Kimi K3
Moonshot AI
Beliebt
M
Text-Generierung

Kimi K3

kimi-k3
Text-ModellBeliebttext-to-text1,000k tokens Kontext

Kimi K3 ist Kimis Flaggschiffmodell, konzipiert für Langkontext-Programmierung und End-to-End-Wissensarbeit, mit 1M Token-Kontext und führender, umfassender Intelligenz.

Ab
$2.4/1M tokens
Modell ansehen
Kimi K2.7 Code
Moonshot AI
Beliebt
M
Text-Generierung

Kimi K2.7 Code

kimi-k2.7-code
Text-ModellBeliebttext-to-textimage-to-textvideo-to-text

Kimi K2.7 Code ist Kimis bislang intelligentestes Programmiermodell, das Anweisungen in langen Kontexten zuverlässig befolgt und Programmieraufgaben mit höherer Erfolgsrate erledigt. Es unterstützt Text-, Bild- und Videoeingaben und unterstützt ausschließlich den Gedankenmodus, Dialoge und Agentenaufgaben.

Ab
$0.76/1M tokens
Modell ansehen
Happy Horse 1.0
Aliyun
Q
Video-Generierung

Happy Horse 1.0

happyhorse-1.0
Video-Modelltext-to-videoimage-to-video

Happy Horse 1.0 — ein hochwertiges Audio-Video-Generierungsmodell, das die Erstellung von Text-zu-Video- und Bild-zu-Video-Inhalten ermöglicht. Es kann synchronisiertes Bildmaterial, Audio und Lippenbewegungen generieren und eignet sich damit für Kurzfilme, Werbemittel und Produktpräsentationen.

Ab
$0.112/s
Modell ansehen
Claude Mythos 5
Anthropic
Demnächst verfügbar
C
Text-Generierung

Claude Mythos 5

claude-mythos-5
Text-ModellDemnächst verfügbartext-to-textpdf-to-textimage-to-text

Bietet die Fähigkeiten von Claude Fable 5 ohne die Sicherheitsklassifikatoren. Verfügbar über Project Glasswing. Nachfolger von Claude Mythos Preview.

Ab
Demnächst verfügbar
Modell ansehen
Claude Opus 4.7
Anthropic
Beliebt
C
Text-Generierung

Claude Opus 4.7

claude-opus-4-7
Text-ModellBeliebttext-to-text

Das intelligenteste Modell für Agenten und Programmierung

Ab
$4/1M tokens
Modell ansehen
MiniMax-M3
MiniMax
M
Text-Generierung

MiniMax-M3

minimax-m3
Text-Modelltext-to-text

Minimax-m3 ist ein multimodales KI-Modell, das für robustes Schlussfolgern, natürliche Konversation und die kreative Inhaltserstellung entwickelt wurde. Es bietet eine ausgewogene Leistung bei Aufgaben des Text- und visuellen Verständnisses und eignet sich damit für allgemeine KI-Anwendungen.

Ab
$0.48/1M tokens
Modell ansehen
GPT 5.5 Pro
OpenAI
O
Text-Generierung

GPT 5.5 Pro

gpt-5.5-pro
Text-Modelltext-to-text

GPT-5.5 Pro vereint modernste Intelligenz, Präzision und Effizienz, um anspruchsvolle Herausforderungen zu bewältigen. Von Softwareentwicklung und Datenanalyse bis hin zu Forschung und Entscheidungsunterstützung liefert es Unterstützung auf Expertenniveau mit Geschwindigkeit und Konsistenz.

Ab
Preise ansehen
Modell ansehen
GPT 5.5
OpenAI
O
Text-Generierung

GPT 5.5

gpt-5.5
Text-Modelltext-to-text

Model 5.5 ist ein KI-Modell der nächsten Generation, das für stärkeres Schlussfolgerungsvermögen, schnellere Antworten und höhere Genauigkeit bei einer breiten Palette von Aufgaben entwickelt wurde. Es zeichnet sich durch das Verständnis komplexer Anweisungen, die Erstellung hochwertiger Inhalte sowie die Unterstützung bei Programmierung, Analyse und Problemlösung aus.

Ab
Preise ansehen
Modell ansehen
MiniMax-M2.7
MiniMax
M
Text-Generierung

MiniMax-M2.7

minimax-m2.7
Text-Modelltext-to-text

MiniMax-M2.7 bietet dieselbe erstklassige Intelligenz wie die Standardversion – einschließlich rekursiver Selbstweiterentwicklung und Produktivität auf Expertenniveau im Office-Bereich –, ist jedoch für Anwendungen konzipiert, die Latenzen unter einer Sekunde und eine Hochgeschwindigkeits-Token-Generierung erfordern. Dank einer verbesserten Inferenz-Backbone-Architektur ist die Ausgabegeschwindigkeit 66 % höher als beim Standardmodell (bis zu 100 tps). Es ist die bevorzugte Wahl für interaktive Programmierassistenten, die Ausführung von Agentenschleifen in Echtzeit und Unternehmens-Pipelines mit hohem Durchsatz und strengen Anforderungen an die Abschlusszeit.

Ab
$0.24/1M tokens
Modell ansehen
DeepSeek V4 Flash
DeepSeek
Beliebt
D
Text-Generierung

DeepSeek V4 Flash

deepseek-v4-flash
Text-ModellBeliebttext-to-text

DeepSeek V4 Flash ist ein effizienzoptimiertes Mixture-of-Experts-Modell von DeepSeek mit 284B Gesamtparametern und 13B aktivierten Parametern und unterstützt ein 1M-Token-Kontextfenster. Es ist für schnelle Inferenz und Workloads mit hohem Durchsatz ausgelegt, wobei es zugleich eine starke Leistung beim Schlussfolgern und Programmieren beibehält.

Ab
$0.12/1M tokens
Modell ansehen
GPT-5.4 nano
OpenAI
O
Text-Generierung

GPT-5.4 nano

gpt-5.4-nano
Text-Modelltext-to-text400,000 Kontext

GPT-5.4 Nano ist ein ultraleichtes KI-Modell, das für maximale Geschwindigkeit und Effizienz entwickelt wurde. Es ist für einfache Aufgaben, Interaktionen in Echtzeit und Bereitstellungen in großem Maßstab optimiert, bei denen geringe Latenz und minimaler Ressourcenverbrauch entscheidend sind.

Ab
Preise ansehen
Modell ansehen
GPT-5.4 mini
OpenAI
O
Text-Generierung

GPT-5.4 mini

gpt-5.4-mini
Text-Modelltext-to-text400,000 Kontext

GPT-5.4 Mini ist ein leichtgewichtiges und effizientes KI-Modell, das für Geschwindigkeit und alltägliche Produktivität optimiert ist. Es bietet zuverlässige Konversationsfunktionen, Inhaltserstellung und Unterstützung bei Aufgaben, bei gleichzeitig niedriger Latenz und geringem Ressourcenverbrauch.

Ab
Preise ansehen
Modell ansehen
GPT-5.4 pro
OpenAI
O
Text-Generierung

GPT-5.4 pro

gpt-5.4-pro
Text-Modelltext-to-textimage-to-text1,050,000 Kontext

GPT-5.4 Pro ist ein Hochleistungs-KI-Modell für professionelle und geschäftliche Anwendungen. Es bietet starke Fähigkeiten zum logischen Denken und Schlussfolgern, zuverlässige Genauigkeit und eine effiziente Ausführung bei Aufgaben wie Inhaltserstellung, Programmierung, Recherche und Datenanalyse.

Ab
Preise ansehen
Modell ansehen