TL;DR: CometAPI 變更日誌在 2026 年 8 月記錄了文字、多模態、圖像與影片工作負載的 15 個新模型 ID。影片先試 Seedance 2.5 或 Wan3.0;成本敏感的多模態工作選 GLM 5.3 Flash;程式與長上下文選 Gemini 3.7 Flash。部署前請驗證模型頁是否已上線、端點與價格。
CometAPI 在 2026 年 8 月新增了哪些 AI 模型?
CometAPI 的 2026 年 8 月模型彙總很實用,因為所有模型都可用同一 API 金鑰與同一計費流程,具備穩定的目錄 ID、文件化的端點,以及按模型計價。開發者可以在不重建整體整合的情況下切換模型 ID,同時仍可使用各供應商的原生或相容請求格式。
截至 2026 年 9 月 1 日,官方 CometAPI 變更日誌是 8 月發布時程的來源,並記錄了 15 個新模型 ID,涵蓋文字推理、視覺理解、圖像生成與影片。模型目錄與各模型頁面仍是目前可用性與定價的權威來源。優先測試的模型包括用於多模態影片的 Seedance 2.5、適合生產影片流程的 Wan3.0、成本敏感的多模態推理用 GLM 5.3 Flash,以及程式與長上下文工作的 Gemini 3.7 Flash。
CometAPI 2026 年 8 月模型發布摘要
| Model / ID | Modality | Current CometAPI Price (as of Sep 3, 2026) | Recommended Endpoint |
|---|---|---|---|
| Gemini 3.7 Flash gemini-3.7-flash | 多模態 → 文字 | $0.60 input / $3.00 output per 1M tokens | POST /v1beta/models/{model}:generateContent |
| Grok 4.6 grok-4.6 | 文字、圖像 → 文字 | $1.60 input / $4.80 output per 1M tokens | POST /v1/chat/completions POST /v1/responses |
| GLM 5.3 glm-5.3 | 文字 → 文字 | $1.12 input / $3.528 output per 1M tokens | POST /v1/chat/completions |
| DeepSeek V4 Flash Vision deepseek-v4-flash-vision | 文字、圖像 → 文字 | $0.352 input / $1.056 output per 1M tokens | POST /v1/chat/completions |
| Grok Imagine Image 2.0 grok-imagine-image-2.0 | 文字、圖像 → 圖像 | $0.032 per request | POST /v1/images/generations |
| GLM 5.3 Flash glm-5.3-flash | 文字、圖像、影片 → 文字 | $0.06 input / $0.20 output per 1M tokens | POST /v1/chat/completions |
| Seedance 2.5 seedance-2-5 | 多模態 → 影片 | From $0.0824/s; detailed billing: $0.103/s (480p), $0.231/s (720p) | POST /v1/videos |
| Qwen3.8 Max qwen3.8-max | 多模態 → 文字 | $1.60 input / $4.80 output per 1M tokens | POST /v1/chat/completions POST /v1/responses |
| MiniMax H3 minimax-h3 | 文字、圖像、影片、音訊 → 影片 | From $0.064/s; listed rates: $0.08/s (768p), $0.13/s (2K) | POST /v1/videos GET /v1/videos/{task_id} |
| DeepSeek V4 Pro 0813 deepseek-v4-pro-0813 | 文字 → 文字 | $0.528 input / $1.584 output / $0.0176 cache read per 1M tokens; 2× in stated UTC windows | POST /v1/chat/completions |
| FLUX 3 flux-3 | 多模態 → 影片 | $0.136/s (720p); $0.232/s (1080p) | POST /v1/videos GET /v1/videos/{task_id} |
| Qwen3.8 2.4T A95B qwen3.8-2.4t-a95b | 文字 → 文字 | $1.60 input / $4.80 output per 1M tokens | POST /v1/chat/completions |
| Grok Imagine Video 1.5 grok-imagine-video-1.5 | 文字、圖像 → 影片 | Image input $0.008; output $0.064/s (480p), $0.112/s (720p), $0.20/s (1080p) | POST /grok/v1/videos/generations GET /grok/v1/videos/{request_id} |
| Wan3.0 wan3.0 | 文字、圖像 → 影片 | From $0.04/s; listed rates: $0.05/s (480p), $0.10/s (720p), $0.20/s (1080p) | POST /v1/videos |
| Qwen3.8 Flash qwen3.8-flash | 多模態 → 文字 | $0.12 input / $0.376001 output per 1M tokens | POST /v1/chat/completions |
此表突出了在 CometAPI 8 月變更日誌記錄的 15 項新增中的重點模型,包括 CometAPI 所述的限時折扣定價。由於各家供應商與發布日期不同,基準測試說明也不一致,請以目錄作為探索與整合規劃的依據,而非通用的正面對比評分表。
僅調整 gpt-5.6-sol 與 minimax-m3 的定價,以及既有 DeepSeek 模型的服務調整,不計為新發布。
我推薦的 4 款 8 月模型
8 月的型錄相當廣泛,但有四款模型在不同工作負載上表現突出。以下推薦重在實用適配,不再重覆上面的定價表;在投入生產前,請於各模型頁確認即時價格與請求格式。
Seedance 2.5:更長的多模態影片
由於影片計費按秒且隨解析度變動,請保留快照日期並連回到模型的即時頁面。對於 Seedance 2.5,480p 片段每秒 $0.103,而 720p 每秒 $0.231——超過兩倍——因此請依據工作負載實際使用的解析度來預算。
Wan3.0:更低進入成本的生產級影片
Wan3.0 已上線,支援文字轉影片與圖像轉影片流程。當團隊需要非同步生產端點、可預期的每秒計費,並保留比較速度、運動品質與解析度空間時,它是務實的選項。
GLM 5.3 Flash:低成本的多模態推理
GLM 5.3 Flash 是面向高量文字與圖像理解的成本導向之選。可測試抽取、視覺問答、輔助程式設計,以及在延遲與成本比最高效的智能體步驟。
Kimi K3:長上下文的程式與知識工作
Kimi K3 於 7 月推出,但在 8 月仍是最值得採用的模型之一。其百萬 token 上下文與相容 OpenAI 的聊天路由,適合大型程式庫、研究綜整與長時程的程式工作流程。
依使用情境該選哪個新模型?
Gemini 3.7 Flash:程式與長上下文工作
公開訊號強調軟體工程與知識工作,但最有用的生產測試是你的程式庫或文件集合。執行固定提示包,記錄被接受任務率、延遲與計費的 tokens,再與你既用的模型比較。
影片模型:運動、參考忠實度與每段通過審核的成本
針對 Seedance 2.5、Wan3.0 與 MiniMax H3,使用相同提示、時長、長寬比與參考圖像。評分運動一致性、提示遵循度、視覺瑕疵、生成時間,以及每段通過審核的剪輯成本。
多模態模型:先看準確性而非最大上下文
對 GLM 5.3 Flash、DeepSeek V4 Flash Vision 與 Gemini 3.7 Flash,測試螢幕截圖、圖表、PDF 與文字-圖像混合輸入。只有當模型能擷取正確證據並產出穩定答案時,大上下文窗才有意義。
DeepSeek V4 Flash Vision: 用於視覺程式代理、圖表分析、螢幕截圖與瀏覽器自動化輸入。在你的混合文字-圖像任務上進行基準測試,於投入生產前比較準確性、延遲與計費的 tokens。
Grok Imagine Image 2.0: 用於生成加編輯的管線、多種長寬比、產品創意與基於參考的迭代。請根據工作負載所需的品質與解析度預算,而非僅看最低起始價格。
即將在 CometAPI 上線:觀察名單
截至 2026 年 9 月 3 日,此觀察名單僅包含 CometAPI 頁面標示為「Coming Soon」的模型。在型錄確認生產上線前,其模型 ID、路由與定價均視為暫定。
| Model | Model ID | Status | Decision |
|---|---|---|---|
| Qwen-Image-3.0 | qwen-image-3.0 | Coming Soon | 觀察名單;暫勿規劃生產流量。 |
| Veo 4 | veo4 | Coming Soon | 在投入生產前等待確認的上線路由與計費。 |
如何在 CometAPI 中呼叫相容 OpenAI 與原生 API?
CometAPI 使用一個 API 金鑰與一套計費流程,但不強迫所有供應商採用同一請求形狀。請在模型頁選擇最適合的路由:Gemini 使用原生內容生成路由;許多 LLM 使用相容 OpenAI 的聊天;圖像模型使用圖像端點;影片模型使用非同步影片 API。下方簡短的 POST 範例僅示範路由與 model 欄位;完整參數請見 API 文件。
- 文字與多模態 LLM 範例:POST https://api.cometapi.com/v1beta/models/gemini-3.7-flash:generateContent
- 圖像生成:POST
https://api.cometapi.com/v1/images/generations - 影片生成:POST
https://api.cometapi.com/v1/videos
POST 路由隨模態改變。Gemini 支援原生 /v1beta/models/{model}:generateContent 與相容模式;Grok Imagine Image 2.0 使用 /v1/images/generations;Seedance 2.5 使用 /v1/videos,隨後輪詢工作狀態。請以文字 API、圖像 API與影片 API為準。
常見問題
對開發者而言,最好的 AI API 聚合器是哪些?
最佳選擇取決於你是否只需要文字 LLM,或是更廣的文字、圖像、音訊與影片堆疊。請從即時模型 ID、端點相容性、使用可見性、備援支持、計費透明度與型錄新鮮度進行評估。若重視跨多模態的一個金鑰與一套計費流程,CometAPI 值得列入候選。
哪些 2026 年 8 月模型在 CometAPI 上確實已上線?
截至 9 月 1 日,8 月變更日誌記錄了 15 個新模型 ID。完整清單、支援格式與定價說明已在上表彙總。部署前請重新檢查模型目錄,因為可用性、別名與價格可能變更。
我能不改整個 SDK 就切換供應商嗎?
通常可以,但不一定。許多文字模型支援 /v1/chat/completions,Gemini 也能使用其原生內容生成路由,而媒體模型使用圖像、即時或影片端點。CometAPI 在這些格式上保持一個金鑰與計費流程,因此即使請求本文不完全相同,供應商切換也更簡單。
影片生成如何運作?
影片生成是非同步的。建立工作、保存返回的任務 ID,然後透過輪詢或接收 webhook,直到成功或失敗。完成後應用程式再擷取並存儲結果。
我應該多久重新檢查模型 ID 與價格?
在整合前、上線生產前,以及任何大型批次前都要檢查。自動化系統也應記錄每次成本估算所用的精確模型 ID 與價格快照,以免後續型錄變更改寫部署決策的歷史。
重點
CometAPI 在 8 月的 15 項新增,擴展了程式、視覺、圖像與影片的務實選擇,同時維持一個金鑰與一套計費流程。請依工作負載先從 Seedance 2.5、Wan3.0、GLM 5.3 Flash 或 Gemini 3.7 Flash 開始測試,僅在固定提示測得品質、延遲、可靠性與計費成本後,再推升至生產。