DeepSeek Vision and Grok Imagine models are now live on CometAPI →
guide/Penyelidikan CometAPI

Cara Menggunakan DeepSeek V4 Pro 0813 API pada tahun 2026: Panduan Pembangun Lengkap

Maaf, saya tiada maklumat terkini tentang keluaran DeepSeek V4 Pro “0813” selepas Okt 2024. Jika anda boleh berikan nota keluaran atau pautan rasmi (blog/announcement, halaman spesifikasi, harga, dokumentasi tentang “thinking modes” dan “streaming”), saya boleh menterjemah dan mengekstrak butiran perubahan, spesifikasi, harga, mod pemikiran dan sokongan penstriman ke dalam Bahasa Melayu dengan tepat.

CometAPI
AnnaPasukan penyelidikan model AI dan API
Dikemas kini Aug 24, 2026 13 min baca
Cara Menggunakan DeepSeek V4 Pro 0813 API pada tahun 2026: Panduan Pembangun Lengkap
Guna corak ini

Buat panggilan API pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TLDR: DeepSeek-V4-Pro-0813 ialah keluaran ketersediaan umum (GA) bagi model MoE perdana DeepSeek dengan 1.6T parameter (49B aktif). Ia memberikan peningkatan besar dalam keupayaan berorientasikan ejen berbanding pratonton April 2026, menyokong tetingkap konteks 1M token, sehingga 384K token output, tiga aras usaha pemikiran (low/high/max), OpenAI Responses API natif, pemanggilan alat, mod JSON, serta titik akhir serasi OpenAI dan Anthropic.

Harga rasmi bermula pada $0.435 / $0.87 per 1M token input/output (cache miss), dengan kadar waktu puncak/luar puncak bermula 16 Ogos 2026. Cara paling mudah dan sering paling kos efektif untuk mengaksesnya adalah melalui gerbang bersatu serasi OpenAI CometAPI pada kadar diskaun.

Perkara Utama

  • DeepSeek-V4-Pro-0813 ialah versi GA produksi yang dikeluarkan sekitar 12–13 Ogos 2026; ID model kekal deepseek-v4-pro.
  • Peningkatan besar pada penanda aras beragensi: DeepSWE 62.7, Terminal Bench 2.1 87.9, NL2Repo 61.5, Cybergym 83.3, HLE (dengan alat) 60.0.
  • Tiga mod/aras usaha pemikiran: tanpa pemikiran + low / high / max.
  • Set ciri penuh: konteks 1M, output maksimum 384K, pemanggilan alat, output JSON, Responses API, format Anthropic, penstriman, output berstruktur.
  • Harga waktu puncak/luar puncak bermula 16 Ogos 2026 (UTC); rancang beban kerja anda.
  • Keserasian SDK OpenAI memudahkan migrasi tanpa halangan.

Panduan komprehensif ini merangkumi semua yang pembangun perlukan: perubahan dalam keluaran 0813, spesifikasi dan harga rasmi, mod pemikiran, penstriman dan output berstruktur, serta panduan langkah demi langkah menggunakan model melalui CometAPI (disyorkan untuk banyak beban kerja produksi dan multi-model). Semua maklumat diambil daripada dokumentasi rasmi DeepSeek dan pelaporan serentak setakat 13 Ogos 2026.

Apakah DeepSeek V4 Pro 0813?

DeepSeek-V4-Pro-0813 ialah snapshot produksi ketersediaan umum bagi DeepSeek V4 Pro yang dikeluarkan pada Ogos 2026.

DeepSeek mengumumkan pada 13 Ogos bahawa versi rasmi V4 Pro telah tersedia serentak melalui apl, laman web, dan API mereka. Pengumuman 13 Ogos DeepSeek turut menambah keserasian natif dengan OpenAI Responses API dan tiga aras penaakulan praktikal: tanpa pemikiran, usaha pemikiran tinggi, dan usaha pemikiran maksimum. Yang penting untuk pembangun, DeepSeek menyatakan bahawa nama model API tidak berubah. Pembangun terus menggunakan:

deepseek-v4-pro

Penetapan 0813 mengenal pasti snapshot produksi dan bukannya pengenal model yang perlu diletakkan pembangun dalam permintaan API mereka.

Model ini diposisikan terutamanya untuk penaakulan lanjutan, kejuruteraan perisian, analisis konteks panjang, dan beban kerja berorientasikan ejen. Penilaian bebas daripada Artificial Analysis currently reports skor Intelligence Index sebanyak 53, berbanding median 27 dalam model open-weight setanding yang dipilih. Ia juga melaporkan kelajuan output kira-kira 77.6 token/saat dan ukuran 1.71 saat masa ke token pertama berdasarkan ujian API mereka.

Apakah Perubahan pada API dalam V4 Pro 0813?

Pengenal model teras dan URL asas kekal sama, jadi integrasi sedia ada terus berfungsi tanpa perubahan kod. Peningkatan bermakna adalah pada keupayaan, kualiti pasca-latihan, dan ciri sokongan.

Peningkatan Keupayaan Utama

Menurut pengumuman GA DeepSeek-V4-Pro rasmi dan log perubahan:

  • Peningkatan beragensi utama dengan lonjakan kukuh dalam beban kerja bertaraf produksi.
  • Skor penanda aras untuk binaan 0813 termasuk:
    • HLE (tanpa / dengan alat): 42.7 / 60.0
    • Terminal Bench 2.1: 87.9
    • NL2Repo: 61.5
    • Cybergym: 83.3
    • DeepSWE: 62.7
    • Toolathlon-Verified: 74.1
    • Agents’ Last Exam: 25.7
    • AutomationBench (Awam): 31.8
    • DSBench-FullStack: 71.1
    • DSBench-Hard: 67.2

Ini mewakili lonjakan besar berbanding pratonton April 2026 (cth., DeepSWE meningkat dengan ketara). Model ini kekal dengan seni bina Mixture-of-Experts dengan jumlah 1.6 trilion parameter dan kira-kira 49 bilion diaktifkan per token.

Ciri API Baharu dan Dipertingkat

  • Sokongan natif untuk OpenAI Responses API, dioptimumkan untuk Codex dengan skrip konfigurasi satu klik.
  • Kawalan usaha pemikiran yang lebih fleksibel: low / high / max (sebelumnya pemetaan pada Pro lebih terhad).
  • Sokongan dwi-mod berterusan (pemikiran diaktifkan secara lalai; tanpa pemikiran tersedia).
  • Keserasian penuh dengan format OpenAI Chat Completions dan Anthropic Messages.
  • Output JSON, Pemanggilan Alat, Chat Prefix Completion (Beta), dan FIM Completion (Beta, hanya tanpa pemikiran).
  • Panjang konteks kekal 1M token; output maksimum 384K token.
  • Had kejung (concurrency) untuk Pro: 500 (Flash: 2,500).

Pengumuman Kemas Kini Harga

Harga semasa (setakat 13 Ogos 2026) per 1M token:

ModelInput (Cache Hit)Input (Cache Miss)Output
deepseek-v4-flash$0.0028$0.14$0.28
deepseek-v4-pro$0.003625$0.435$0.87

Bermula 16:00 UTC pada 16 Ogos 2026, bil pengebilan waktu puncak/luar puncak berkuat kuasa (luar puncak = separuh daripada puncak). Waktu puncak: 01:00–04:00 dan 06:00–10:00 UTC. Kadar baharu:

ModelTempohInput (Cache Hit)Input (Cache Miss)Output
deepseek-v4-proLuar puncak$0.022$0.66$1.98
deepseek-v4-proWaktu puncak$0.044$1.32$3.96

DeepSeek turut menunjukkan peningkatan harga keseluruhan selanjutnya mungkin menyusul; pantau halaman harga rasmi.

Dokumentasi had kadar DeepSeek menetapkan kejung standard V4 Pro pada 500 permintaan per akaun. Satu sambungan dikira dari penghantaran hingga respons selesai, dan permintaan berlebihan menerima respons HTTP 429. DeepSeek menerima a untuk pengasingan penjadualan; ia mesti sepadan dan tidak lebih panjang daripada 512 aksara. Ia tidak sepatutnya mengandungi maklumat peribadi.

Sokongan Natif Responses API

Salah satu perubahan API paling jelas ialah sokongan natif untuk format OpenAI Responses API.

DeepSeek mengatakan Responses API direka sebahagiannya untuk menyokong alur kerja ejen pengaturcaraan seperti Codex. Titik akhir rasmi menggunakan:

https://api.deepseek.com

dan boleh diakses dengan OpenAI Python SDK.

Contoh:

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_DEEPSEEK_API_KEY",
    base_url="https://api.deepseek.com"
)

response = client.responses.create(
    model="deepseek-v4-pro",
    instructions="You are an expert software engineer.",
    input="Explain how database connection pooling works."
)

print(response.output_text)

Dokumentasi DeepSeek juga menyokong penstriman untuk permintaan Responses API, menggunakan server-sent events semantik dan bukannya konvensyen lama data: [DONE].


Kawalan Pemikiran yang Lebih Fleksibel

V4 Pro menjadikan penaakulan boleh dikonfigurasi dan tidak lagi memaksa pembangun menggunakan model penaakulan yang berasingan.

Dokumentasi DeepSeek menerangkan suis pemikiran seperti:

{
  "thinking": {
    "type": "enabled"
  }
}

dan usaha penaakulan seperti:

high
max

Konfigurasi pemikiran lalai adalah diaktifkan, dengan high digunakan untuk permintaan biasa. Beban kerja ejen yang kompleks tertentu boleh menggunakan max secara automatik.

Ini mewujudkan tiga mod praktikal untuk pembangun aplikasi:

  1. Tanpa pemikiran
  2. Pemikiran — Tinggi
  3. Pemikiran — Maks

Perbezaan ini sangat berguna ketika mereka bentuk aplikasi AI kerana tidak setiap permintaan memerlukan penaakulan maksimum.

Satu butiran pelaksanaan penting: dalam mod pemikiran, parameter seperti temperature dan top_p tidak mempengaruhi output model. DeepSeek mendokumenkan tingkah laku ini secara jelas.

Cara Menggunakan API DeepSeek V4 Pro 0813 dengan CometAPI

CometAPI berguna jika anda ingin mengintegrasikan DeepSeek V4 Pro tanpa menyelenggara integrasi API berasingan untuk setiap penyedia AI.

CometAPI kini mempromosikan API bersatu yang meliputi 500+ model AI, dengan lapisan API bersama dan pengebilan bersatu. Dokumentasi harganya mengatakan harga model rasmi umumnya ditawarkan pada diskaun 20% berbanding kadar rasmi penyedia.

Berikut ialah alur kerja integrasi CometAPI yang praktikal.

Langkah 1: Cipta Akaun CometAPI

Mula-mula, cipta atau log masuk ke akaun CometAPI anda.

Buka laman web CometAPI dan akses konsol API.

Dokumentasi DeepSeek V4 Pro CometAPI mengarahkan pengguna mendapatkan token API daripada konsol CometAPI.


Langkah 2: Cipta Kunci API CometAPI Anda

Selepas log masuk, buka bahagian token/kunci API akaun anda dan jana kunci API.

Simpan sebagai pemboleh ubah persekitaran dan bukan meng-hard code dalam aplikasi anda.

Linux/macOS:

export COMETAPI_KEY="YOUR_COMETAPI_KEY"

Windows PowerShell:

$env:COMETAPI_KEY="YOUR_COMETAPI_KEY"

Jangan sekali-kali komit kunci API ke GitHub, JavaScript frontend, aplikasi mudah alih, atau fail konfigurasi yang boleh diakses umum.


Langkah 3: Pasang OpenAI Python SDK

Memandangkan CometAPI menyediakan antara muka serasi OpenAI, anda boleh menggunakan klien OpenAI Python yang biasa.

pip install openai

Ini menjadikan migrasi sangat mudah bagi pembangun yang sudah mengenali format API OpenAI.


Langkah 4: Konfigurasikan Base URL CometAPI

Cipta klien seperti berikut:

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1"
)

Contoh V4 Pro yang diterbitkan CometAPI menggunakan Base URL ini dan ID model deepseek-v4-pro.


Langkah 5: Hantar Permintaan DeepSeek V4 Pro Pertama Anda

Sekarang hantar permintaan asas:

response = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[
        {
            "role": "system",
            "content": "You are an expert technical writer."
        },
        {
            "role": "user",
            "content": "Explain the advantages of a 1-million-token context window."
        }
    ]
)

print(response.choices[0].message.content)

Parameter kritikal ialah:

base_url = https://api.cometapi.com/v1
model = deepseek-v4-pro
endpoint = /chat/completions

Tiga Mod Pemikiran Diterangkan

DeepSeek V4 Pro menyokong:

  1. Mod tanpa pemikiran — Respons terpantas, tiada rantai pemikiran eksplisit. Sesuai untuk soal jawab ringkas atau senario kadar tinggi.
  2. Mod pemikiran dengan usaha low / high — Model menghasilkan reasoning_content sebelum jawapan akhir. High ialah lalai praktikal untuk kebanyakan kerja ejen dan pengaturcaraan.
  3. Usaha maksimum — Menolak keupayaan penaakulan model ke tahap tertinggi; disyorkan untuk masalah kompleks berbilang langkah. Mungkin menggunakan lebih banyak token dan latensi.

Dalam format serasi OpenAI anda mengawal ini dengan objek thinking dan parameter reasoning_effort. Rantai pemikiran muncul dalam message.reasoning_content. Apabila alat tidak digunakan, penaakulan terdahulu selalunya boleh ditinggalkan daripada konteks seterusnya; apabila alat digunakan, penaakulan penuh mesti dihantar semula.

Tukar Antara Usaha Pemikiran dan Mod Tanpa Pemikiran

  • Tanpa pemikiran: "thinking": {"type": "disabled"} (atau setara gaya Anthropic reasoning.effort: "none").
  • Pemikiran dengan usaha: "reasoning_effort": "low" | "high" | "max" bersama "thinking": {"type": "enabled"}.

Lalai ialah pemikiran diaktifkan dengan usaha tinggi. Gunakan low untuk pertanyaan mudah, high untuk kerja ejen tipikal, dan max untuk penaakulan paling sukar atau tugas pengaturcaraan berbilang langkah.

Penstriman Respons dan Output Berstruktur

Penstriman diaktifkan hanya dengan menetapkan "stream": true. Kedua-dua kandungan dan (jika berkenaan) token penaakulan boleh distrim. Ini penting untuk ejen interaktif dan aplikasi berorientasikan pengguna.

Output berstruktur / JSON adalah kelas pertama: gunakan response_format={"type": "json_object"} atau sokongan skema yang lebih maju yang tersedia melalui Responses API dan definisi alat. Digabungkan dengan pemanggilan alat, ini membolehkan gelung ejen yang boleh dipercayai yang menghasilkan tindakan boleh-baca mesin.

Titik akhir Responses API (/responses) menyediakan permukaan yang lebih moden dan selaras dengan OpenAI, sangat berguna untuk alur kerja gaya Codex dan kini disokong secara natif untuk V4 Pro.

Guna Output Berstruktur / Mod JSON

DeepSeek menyokong Output JSON. Minta melalui response_format:

response = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[
        {"role": "system", "content": "Return valid JSON only."},
        {"role": "user", "content": "Extract the key entities from this text: ..."}
    ],
    response_format={"type": "json_object"},
    extra_body={"thinking": {"type": "enabled"}, "reasoning_effort": "high"}
)

Untuk kawalan skema yang lebih ketat, gabungkan dengan panggilan alat atau Responses API di mana disokong.

Laksanakan Pemanggilan Alat (Function Calling)

Takrifkan alat dalam format OpenAI. Dalam mod pemikiran anda mesti menghantar semula reasoning_content dengan betul pada pusingan seterusnya apabila alat terlibat.

Apabila berinteraksi dengan alat kelak, pembangun mesti mengekalkan reasoning_content yang sepadan apabila memanggil alat mindset. Pengendalian yang tidak betul boleh mengakibatkan ralat 400.

Python
tools = [
    {
        "type": "function",
        "function": {
            "name": "get_weather",
            "description": "Get current weather for a city",
            "parameters": {
                "type": "object",
                "properties": {
                    "location": {"type": "string", "description": "City name"}
                },
                "required": ["location"]
            }
        }
    }
]

response = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[{"role": "user", "content": "What's the weather in Hangzhou?"}],
    tools=tools,
    extra_body={"thinking": {"type": "enabled"}, "reasoning_effort": "high"}
)
# Handle tool_calls, execute, append results, and continue the conversation

Lihat panduan rasmi Tool Calls dan Thinking Mode untuk corak berbilang pusingan yang tepat apabila alat digunakan.

Amalan Terbaik untuk Menggunakan API DeepSeek V4 Pro 0813

Padankan usaha penaakulan dengan tugas

Jangan gunakan penaakulan Max untuk tugas yang hanya memerlukan klasifikasi.

Polisi penghalaan ringkas berkesan:

Mudah → Tanpa pemikiran
Sederhana → Tinggi
Kompleks → Maks

Ini boleh mengurangkan kedua-dua latensi dan kos.

Strim respons panjang

Jika aplikasi anda memerlukan beberapa saat untuk menjana respons, gunakan:

stream=True

Pengguna lazimnya merasakan output bertambah-tambah jauh lebih pantas berbanding menunggu respons lengkap.

Sahkan output berstruktur

Mod JSON meningkatkan kebolehpercayaan, tetapi aplikasi anda masih harus mengesahkan JSON yang dikembalikan.

Gunakan:

import json

data = json.loads(response_text)

dan kemudian sahkan medan wajib sebelum menulis ke pangkalan data anda atau mencetuskan tindakan luaran.

Pantau penggunaan token

Sentiasa periksa:

response.usage

apabila tersedia.

Pada skala V4 Pro, perakaunan token bukan ciri analitik pilihan. Ia ialah mekanisme kawalan kos teras.

Asingkan prompt stabil dan dinamik

Untuk aplikasi konteks panjang, kekalkan arahan dan dokumen berulang sebagai stabil untuk memaksimumkan penggunaan semula cache.

Sediakan model sandaran

Seni bina produksi praktikal boleh menghala:

Permintaan mudah
      ↓
V4 Flash

Permintaan kompleks
      ↓
V4 Pro

Permintaan sangat sukar
      ↓
V4 Pro penaakulan maksimum

Polisi penghalaan tepat harus ditentukan melalui penanda aras anda sendiri.


Ralat Lazim API DeepSeek V4 Pro

Ralat: Model tidak ditemui

Semak bahawa anda menggunakan:

deepseek-v4-pro

dan bukannya tersilap mencipta nama model snapshot.

DeepSeek menyatakan bahawa nama model API kekal tidak berubah untuk keluaran produksi 0813.

Ralat: Parameter pemikiran tidak sah

Untuk permintaan serasi OpenAI, gunakan:

"thinking": {
  "type": "enabled"
}

dalam badan permintaan yang sesuai, dan gunakan:

reasoning_effort=high

atau:

reasoning_effort=max

Dokumentasi API rasmi DeepSeek mentakrifkan parameter ini.

Ralat: Output JSON rosak

Gunakan:

"response_format": {
  "type": "json_object"
}

dan arahkan model secara eksplisit dalam prompt untuk output JSON. DeepSeek memberi amaran bahawa mod JSON hendaklah disertai arahan untuk menjana JSON.

Ralat semasa pemanggilan alat berbilang pusingan

Apabila menggunakan mod pemikiran dengan panggilan alat, kekalkan reasoning_content yang diperlukan dalam permintaan seterusnya.

Ini adalah butiran yang mudah terlepas dan boleh menghasilkan respons 400.

API DeepSeek V4 Pro 0813: Seni Bina Disyorkan

Untuk aplikasi produksi, seni bina permulaan yang kukuh kelihatan seperti berikut:

                    ┌─────────────────────┐
                    │      Your App       │
                    └──────────┬──────────┘
                               │
                               ▼
                    ┌─────────────────────┐
                    │   Routing Layer     │
                    └──────────┬──────────┘
                               │
                ┌──────────────┼──────────────┐
                ▼              ▼              ▼
          Non-thinking       High            Max
                │              │              │
                └──────────────┼──────────────┘
                               ▼
                    ┌─────────────────────┐
                    │   CometAPI          │
                    │ deepseek-v4-pro     │
                    └──────────┬──────────┘
                               │
                 ┌─────────────┼─────────────┐
                 ▼             ▼             ▼
              Streaming      Tools       JSON Output
                 │             │             │
                 └─────────────┼─────────────┘
                               ▼
                    ┌─────────────────────┐
                    │ Validation / Logs   │
                    └─────────────────────┘

Ini memisahkan pemilihan model daripada logik aplikasi.

Jika model lain menjadi lebih ekonomik atau berprestasi lebih baik untuk beban kerja tertentu, lapisan penghalaan boleh berubah tanpa menulis semula keseluruhan aplikasi.

Kesimpulan dan Syor

DeepSeek-V4-Pro-0813 menandakan kematangan siri V4 Pro menjadi peranti perdana yang sedia produksi dengan prestasi beragensi yang jauh lebih kukuh sambil mengekalkan konteks 1M yang murah hati dan ekonomi siri ini yang menarik. Pembangun boleh mula menggunakannya hari ini dengan hampir sifar kos migrasi terima kasih kepada keserasian OpenAI dan Anthropic.

Untuk kebanyakan pasukan kami mengesyorkan:

  1. Prototip dan eksperimen multi-model di CometAPI.
  2. Pindahkan beban kerja DeepSeek sahaja yang berjumlah tinggi atau sensitif latensi ke titik akhir rasmi sebaik sahaja harga puncak/luar puncak dan sebarang pelarasan lanjut stabil.
  3. Lalai ke mod pemikiran dengan reasoning_effort="high" untuk tugas ejen dan pengaturcaraan; simpan max untuk masalah paling sukar.
  4. Sentiasa laksanakan pengembalian reasoning_content yang betul bagi panggilan alat dan manfaatkan penstriman + output berstruktur untuk aplikasi yang mantap.

Dengan keluaran 0813, DeepSeek telah menyampaikan model kelas open-weight yang sangat berkebolehan dan kos efisien yang kompetitif untuk beban kerja beragensi dan konteks panjang yang serius. Integrasikan ia melalui CometAPI atau API rasmi dan mula membina. Terokai DeepSeek V4 Pro di CometAPI.


Soalan Lazim

Adakah DeepSeek V4 Pro 0813 sama dengan deepseek-v4-pro?

Ya. Pengumuman keluaran rasmi DeepSeek mengatakan nama model API kekal tidak berubah sementara versi produksi dikemas kini ke V4 Pro 0813.

Adakah DeepSeek V4 Pro menyokong tetingkap konteks 1M token?

Ya. Dokumentasi model/harga semasa DeepSeek menyenaraikan panjang konteks 1M token dan output maksimum 384K.

Apakah tiga mod pemikiran DeepSeek V4 Pro?

Untuk reka bentuk aplikasi praktikal, ia ialah:

  1. Tanpa pemikiran
  2. Pemikiran dengan usaha tinggi
  3. Pemikiran dengan usaha maksimum

API menggunakan suis pemikiran bersama reasoning_effort. API semasa DeepSeek mendedahkan high dan max, manakala nilai keserasian seperti low dan medium dipetakan kepada high.

Bolehkah saya strim respons DeepSeek V4 Pro?

Ya. Penstriman disokong melalui Chat Completions API, dan penstriman mod pemikiran boleh termasuk delta reasoning_content sebelum kandungan jawapan biasa.

Bolehkah saya menggunakan DeepSeek V4 Pro dengan CometAPI?

Ya. CometAPI pada masa ini mendokumentasikan model deepseek-v4-pro melalui titik akhir serasi OpenAI /v1/chat/completions.

Patutkah saya menggunakan DeepSeek V4 Pro atau V4 Flash?

Gunakan V4 Flash apabila kadar pemprosesan, latensi, dan kos menjadi keutamaan. Gunakan V4 Pro untuk penaakulan sukar, pengaturcaraan, analisis konteks panjang, dan alur kerja berorientasikan ejen.

Strategi penghalaan hibrid biasanya lebih baik daripada menggunakan Pro untuk semua.

Adakah harga API DeepSeek V4 Pro berubah?

Ya. DeepSeek telah mengumumkan harga waktu puncak/luar puncak bermula 17 Ogos 2026. Dokumentasi rasmi menyenaraikan V4 Pro pada $0.66/M input cache-miss dan $1.98/M output semasa tempoh luar puncak, berbanding $1.32/M input dan $3.96/M output semasa tempoh puncak di bawah jadual baharu.

Terus belajar

Sambungkan artikel ini ke keputusan seterusnya.

Lihat semua topik
Diterbitkan pada Aug 13, 2026
Terakhir dikemas kini Aug 24, 2026
52 paparan
Disemak untuk kejelasan, atribusi sumber dan terminologi API semasa.

Bersedia untuk mengurangkan kos pembangunan AI sebanyak 20%?

Mulakan secara percuma dalam beberapa minit. Kredit percubaan percuma disertakan. Tiada kad kredit diperlukan.

Baca Lagi