Gemini 3.8 Flash and Claude Fable 5.1 are now live on CometAPI →
technology/CometAPI 研究

2026 年 8 月 AI 模型發佈雷達:CometAPI 上的最新動態

Review 15 AI models CometAPI added in August 2026, verified via official Changelog: priority picks, exact model IDs, native/compatible endpoints, pricing.

CometAPI
Lei WangAI 模型與 API 研究團隊
更新於 Sep 3, 2026 4 分鐘閱讀
2026 年 8 月 AI 模型發佈雷達:CometAPI 上的最新動態
套用此模式

發出第一個 API 請求。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR: CometAPI 變更日誌在 2026 年 8 月記錄了文字、多模態、圖像與影片工作負載的 15 個新模型 ID。影片先試 Seedance 2.5 或 Wan3.0;成本敏感的多模態工作選 GLM 5.3 Flash;程式與長上下文選 Gemini 3.7 Flash。部署前請驗證模型頁是否已上線、端點與價格。

CometAPI 在 2026 年 8 月新增了哪些 AI 模型?

CometAPI 的 2026 年 8 月模型彙總很實用,因為所有模型都可用同一 API 金鑰與同一計費流程,具備穩定的目錄 ID、文件化的端點,以及按模型計價。開發者可以在不重建整體整合的情況下切換模型 ID,同時仍可使用各供應商的原生或相容請求格式。

截至 2026 年 9 月 1 日,官方 CometAPI 變更日誌是 8 月發布時程的來源,並記錄了 15 個新模型 ID,涵蓋文字推理、視覺理解、圖像生成與影片。模型目錄與各模型頁面仍是目前可用性與定價的權威來源。優先測試的模型包括用於多模態影片的 Seedance 2.5、適合生產影片流程的 Wan3.0、成本敏感的多模態推理用 GLM 5.3 Flash,以及程式與長上下文工作的 Gemini 3.7 Flash。

CometAPI 2026 年 8 月模型發布摘要

Model / IDModalityCurrent CometAPI Price (as of Sep 3, 2026)Recommended Endpoint
Gemini 3.7 Flash
gemini-3.7-flash
多模態 → 文字$0.60 input / $3.00 output per 1M tokensPOST /v1beta/models/{model}:generateContent
Grok 4.6
grok-4.6
文字、圖像 → 文字$1.60 input / $4.80 output per 1M tokensPOST /v1/chat/completions
POST /v1/responses
GLM 5.3
glm-5.3
文字 → 文字$1.12 input / $3.528 output per 1M tokensPOST /v1/chat/completions
DeepSeek V4 Flash Vision
deepseek-v4-flash-vision
文字、圖像 → 文字$0.352 input / $1.056 output per 1M tokensPOST /v1/chat/completions
Grok Imagine Image 2.0
grok-imagine-image-2.0
文字、圖像 → 圖像$0.032 per requestPOST /v1/images/generations
GLM 5.3 Flash
glm-5.3-flash
文字、圖像、影片 → 文字$0.06 input / $0.20 output per 1M tokensPOST /v1/chat/completions
Seedance 2.5
seedance-2-5
多模態 → 影片From $0.0824/s; detailed billing: $0.103/s (480p), $0.231/s (720p)POST /v1/videos
Qwen3.8 Max
qwen3.8-max
多模態 → 文字$1.60 input / $4.80 output per 1M tokensPOST /v1/chat/completions
POST /v1/responses
MiniMax H3
minimax-h3
文字、圖像、影片、音訊 → 影片From $0.064/s; listed rates: $0.08/s (768p), $0.13/s (2K)POST /v1/videos
GET /v1/videos/{task_id}
DeepSeek V4 Pro 0813
deepseek-v4-pro-0813
文字 → 文字$0.528 input / $1.584 output / $0.0176 cache read per 1M tokens; 2× in stated UTC windowsPOST /v1/chat/completions
FLUX 3
flux-3
多模態 → 影片$0.136/s (720p); $0.232/s (1080p)POST /v1/videos
GET /v1/videos/{task_id}
Qwen3.8 2.4T A95B
qwen3.8-2.4t-a95b
文字 → 文字$1.60 input / $4.80 output per 1M tokensPOST /v1/chat/completions
Grok Imagine Video 1.5
grok-imagine-video-1.5
文字、圖像 → 影片Image input $0.008; output $0.064/s (480p), $0.112/s (720p), $0.20/s (1080p)POST /grok/v1/videos/generations
GET /grok/v1/videos/{request_id}
Wan3.0
wan3.0
文字、圖像 → 影片From $0.04/s; listed rates: $0.05/s (480p), $0.10/s (720p), $0.20/s (1080p)POST /v1/videos
Qwen3.8 Flash
qwen3.8-flash
多模態 → 文字$0.12 input / $0.376001 output per 1M tokensPOST /v1/chat/completions

此表突出了在 CometAPI 8 月變更日誌記錄的 15 項新增中的重點模型,包括 CometAPI 所述的限時折扣定價。由於各家供應商與發布日期不同,基準測試說明也不一致,請以目錄作為探索與整合規劃的依據,而非通用的正面對比評分表。

僅調整 gpt-5.6-solminimax-m3 的定價,以及既有 DeepSeek 模型的服務調整,不計為新發布。

我推薦的 4 款 8 月模型

8 月的型錄相當廣泛,但有四款模型在不同工作負載上表現突出。以下推薦重在實用適配,不再重覆上面的定價表;在投入生產前,請於各模型頁確認即時價格與請求格式。

Seedance 2.5:更長的多模態影片

由於影片計費按秒且隨解析度變動,請保留快照日期並連回到模型的即時頁面。對於 Seedance 2.5,480p 片段每秒 $0.103,而 720p 每秒 $0.231——超過兩倍——因此請依據工作負載實際使用的解析度來預算。

Wan3.0:更低進入成本的生產級影片

Wan3.0 已上線,支援文字轉影片與圖像轉影片流程。當團隊需要非同步生產端點、可預期的每秒計費,並保留比較速度、運動品質與解析度空間時,它是務實的選項。

GLM 5.3 Flash:低成本的多模態推理

GLM 5.3 Flash 是面向高量文字與圖像理解的成本導向之選。可測試抽取、視覺問答、輔助程式設計,以及在延遲與成本比最高效的智能體步驟。

Kimi K3:長上下文的程式與知識工作

Kimi K3 於 7 月推出,但在 8 月仍是最值得採用的模型之一。其百萬 token 上下文與相容 OpenAI 的聊天路由,適合大型程式庫、研究綜整與長時程的程式工作流程。

依使用情境該選哪個新模型?

Gemini 3.7 Flash:程式與長上下文工作

公開訊號強調軟體工程與知識工作,但最有用的生產測試是你的程式庫或文件集合。執行固定提示包,記錄被接受任務率、延遲與計費的 tokens,再與你既用的模型比較。

影片模型:運動、參考忠實度與每段通過審核的成本

針對 Seedance 2.5、Wan3.0 與 MiniMax H3,使用相同提示、時長、長寬比與參考圖像。評分運動一致性、提示遵循度、視覺瑕疵、生成時間,以及每段通過審核的剪輯成本。

多模態模型:先看準確性而非最大上下文

對 GLM 5.3 Flash、DeepSeek V4 Flash Vision 與 Gemini 3.7 Flash,測試螢幕截圖、圖表、PDF 與文字-圖像混合輸入。只有當模型能擷取正確證據並產出穩定答案時,大上下文窗才有意義。

DeepSeek V4 Flash Vision: 用於視覺程式代理、圖表分析、螢幕截圖與瀏覽器自動化輸入。在你的混合文字-圖像任務上進行基準測試,於投入生產前比較準確性、延遲與計費的 tokens。

Grok Imagine Image 2.0: 用於生成加編輯的管線、多種長寬比、產品創意與基於參考的迭代。請根據工作負載所需的品質與解析度預算,而非僅看最低起始價格。

即將在 CometAPI 上線:觀察名單

截至 2026 年 9 月 3 日,此觀察名單僅包含 CometAPI 頁面標示為「Coming Soon」的模型。在型錄確認生產上線前,其模型 ID、路由與定價均視為暫定。

ModelModel IDStatusDecision
Qwen-Image-3.0qwen-image-3.0Coming Soon觀察名單;暫勿規劃生產流量。
Veo 4veo4Coming Soon在投入生產前等待確認的上線路由與計費。

如何在 CometAPI 中呼叫相容 OpenAI 與原生 API?

CometAPI 使用一個 API 金鑰與一套計費流程,但不強迫所有供應商採用同一請求形狀。請在模型頁選擇最適合的路由:Gemini 使用原生內容生成路由;許多 LLM 使用相容 OpenAI 的聊天;圖像模型使用圖像端點;影片模型使用非同步影片 API。下方簡短的 POST 範例僅示範路由與 model 欄位;完整參數請見 API 文件

POST 路由隨模態改變。Gemini 支援原生 /v1beta/models/{model}:generateContent 與相容模式;Grok Imagine Image 2.0 使用 /v1/images/generations;Seedance 2.5 使用 /v1/videos,隨後輪詢工作狀態。請以文字 API圖像 API影片 API為準。

常見問題

對開發者而言,最好的 AI API 聚合器是哪些?

最佳選擇取決於你是否只需要文字 LLM,或是更廣的文字、圖像、音訊與影片堆疊。請從即時模型 ID、端點相容性、使用可見性、備援支持、計費透明度與型錄新鮮度進行評估。若重視跨多模態的一個金鑰與一套計費流程,CometAPI 值得列入候選。

哪些 2026 年 8 月模型在 CometAPI 上確實已上線?

截至 9 月 1 日,8 月變更日誌記錄了 15 個新模型 ID。完整清單、支援格式與定價說明已在上表彙總。部署前請重新檢查模型目錄,因為可用性、別名與價格可能變更。

我能不改整個 SDK 就切換供應商嗎?

通常可以,但不一定。許多文字模型支援 /v1/chat/completions,Gemini 也能使用其原生內容生成路由,而媒體模型使用圖像、即時或影片端點。CometAPI 在這些格式上保持一個金鑰與計費流程,因此即使請求本文不完全相同,供應商切換也更簡單。

影片生成如何運作?

影片生成是非同步的。建立工作、保存返回的任務 ID,然後透過輪詢或接收 webhook,直到成功或失敗。完成後應用程式再擷取並存儲結果。

我應該多久重新檢查模型 ID 與價格?

在整合前、上線生產前,以及任何大型批次前都要檢查。自動化系統也應記錄每次成本估算所用的精確模型 ID 與價格快照,以免後續型錄變更改寫部署決策的歷史。

重點

CometAPI 在 8 月的 15 項新增,擴展了程式、視覺、圖像與影片的務實選擇,同時維持一個金鑰與一套計費流程。請依工作負載先從 Seedance 2.5、Wan3.0、GLM 5.3 Flash 或 Gemini 3.7 Flash 開始測試,僅在固定提示測得品質、延遲、可靠性與計費成本後,再推升至生產。

繼續學習

把這篇文章連到下一個決策。

查看所有主題
發布於 Sep 3, 2026
最後更新 Sep 3, 2026
2 次瀏覽
已審核內容清晰度、來源標註與最新 API 術語。

準備好將 AI 開發成本降低 20% 了嗎?

幾分鐘內免費開始。包含免費試用點數。無需信用卡。

閱讀更多