ข้อกำหนดทางเทคนิค
| รายการ | DeepSeek-V4-Pro |
|---|---|
| ผู้ให้บริการ | DeepSeek |
| ชื่อโมเดล API | deepseek-v4-pro |
| Base URLs | https://api.deepseek.com และ https://api.deepseek.com/anthropic |
| ประเภทอินพุต | ข้อความ |
| ประเภทเอาต์พุต | ข้อความ, การเรียกใช้เครื่องมือ, ข้อความให้เหตุผล |
| ความยาวบริบท | 1,000,000 โทเค็น |
| ผลลัพธ์สูงสุด | 384,000 โทเค็น |
| โหมดการให้เหตุผล | non-thinking, thinking (ค่าเริ่มต้น) |
| ค่าเริ่มต้นของเอเจนต์/การเขียนโค้ด | reasoning_effort สามารถตั้งค่าสูงได้; คำขอเอเจนต์ที่ซับซ้อนอาจใช้ max โดยอัตโนมัติ |
| คุณสมบัติที่รองรับ | เอาต์พุต JSON, Tool Calls, Chat Prefix Completion (เบต้า), FIM Completion (เบต้าในโหมด non-thinking) |
| การเผยแพร่น้ำหนักแบบโลคัล/โอเพ่น | พารามิเตอร์รวม 1.6T, พารามิเตอร์ที่ถูกใช้งาน 49B, ความละเอียดแบบผสม FP4 + FP8 |
| สัญญาอนุญาต (model card) | MIT |
| model card อ้างอิง | DeepSeek-V4-Pro preview บน Hugging Face |
DeepSeek-V4-Pro คืออะไร?
DeepSeek-V4-Pro เป็นสมาชิกที่ทรงพลังยิ่งกว่าของตระกูลพรีวิว V4 ของ DeepSeek ตาม model card อย่างเป็นทางการ อธิบายว่าเป็นโมเดล MoE ที่มีพารามิเตอร์ 1.6T และพารามิเตอร์ที่ถูกใช้งาน 49B พร้อมหน้าต่างบริบทหนึ่งล้านโทเค็น มุ่งเน้นงานความรู้ระยะยาว การสร้างโค้ด และงานเอเจนต์ เอกสาร API เปิดให้ใช้งานผ่านพื้นผิว chat-completions มาตรฐานของ DeepSeek และรองรับสไตล์ SDK ทั้งแบบ OpenAI และ Anthropic
คุณสมบัติหลัก
- บริบทระดับล้านโทเค็น: DeepSeek ระบุความยาวบริบท 1M โทเค็น ทำให้โมเดลเหมาะกับชุดเอกสารขนาดใหญ่มาก รีโพซิทอรี และเซสชันเอเจนต์หลายขั้นตอน
- สองโหมดการให้เหตุผล: API รองรับโหมด non-thinking และ thinking; thinking เป็นค่าเริ่มต้น และเอกสารระบุว่าคำขอเอเจนต์ที่ซับซ้อน เช่น Claude Code หรือ OpenCode อาจใช้ความพยายาม
maxโดยอัตโนมัติ - รองรับการเรียกใช้เครื่องมือ: โหมด thinking ของ DeepSeek รองรับการเรียกใช้เครื่องมือ ซึ่งสำคัญสำหรับเอเจนต์ที่ต้องการการค้นหา การจัดการไฟล์ หรือฟังก์ชันภายนอก
- ประสิทธิภาพบริบทยาว: model card ระบุว่า V4 ใช้การออกแบบ attention แบบไฮบริดที่มี Compressed Sparse Attention และ Heavily Compressed Attention เพื่อลดการคำนวณบริบทยาวและต้นทุน KV cache เมื่อเทียบกับ V3.2. citeturn980363view2
- เน้นการเขียนโค้ดและการให้เหตุผล: DeepSeek ระบุว่าโหมด reasoning V4-Pro-Max พัฒนาเกณฑ์มาตรฐานด้านการเขียนโค้ดและลดช่องว่างกับโมเดลปิดแหล่งชั้นนำในงานให้เหตุผลและงานเอเจนต์ได้มาก. citeturn980363view2
- ความยืดหยุ่นของ SDK: สามารถเข้าถึงได้ผ่าน chat completions ที่เข้ากันได้กับ OpenAI มาตรฐาน หรือผ่านปลายทางที่เข้ากันกับ Anthropic ของ DeepSeek สำหรับเวิร์กโฟลว์ที่เน้นเครื่องมือ
ผลการทดสอบมาตรฐาน
model card อย่างเป็นทางการของ DeepSeek รายงานผลการประเมินสำหรับตระกูลโมเดลฐานและชุดเปรียบเทียบ V4-Pro-Max ในตารางโมเดลฐาน V4-Pro ได้คะแนนสูงกว่า V3.2-Base ในหลายเกณฑ์ความรู้และบริบทยาว รวมถึง MMLU-Pro (73.5 เทียบกับ 65.5), FACTS Parametric (62.6 เทียบกับ 27.1) และ LongBench-V2 (51.5 เทียบกับ 40.2).
| เกณฑ์มาตรฐาน | V3.2-Base | V4-Flash-Base | V4-Pro-Base |
|---|---|---|---|
| MMLU-Pro (EM) | 65.5 | 68.3 | 73.5 |
| FACTS Parametric (EM) | 27.1 | 33.9 | 62.6 |
| HumanEval (Pass@1) | 62.8 | 69.5 | 76.8 |
| LongBench-V2 (EM) | 40.2 | 44.7 | 51.5 |
model card เดียวกันยังแสดงให้เห็นว่า V4-Pro-Max ยังคงแข่งขันได้กับโมเดลแนวหน้าชั้นนำในงานที่เลือก ตัวอย่างเช่น ทำได้ 87.5 ใน MMLU-Pro, 57.9 ใน SimpleQA-Verified, 90.1 ใน GPQA Diamond และ 67.9 ใน Terminal Bench 2.0 ในตารางเปรียบเทยบที่เผยแพร่
DeepSeek-V4-Pro เทียบกับ DeepSeek-V4-Flash เทียบกับ DeepSeek-V3.2
| โมเดล | เหมาะสำหรับ | บริบท | หมายเหตุ |
|---|---|---|---|
| DeepSeek-V4-Pro | การให้เหตุผลหนัก การเขียนโค้ด เอเจนต์ เอกสารขนาดใหญ่ | 1M | โมเดล V4 ที่ใหญ่ที่สุด พารามิเตอร์ที่ถูกใช้งาน 49B ความสามารถโดยรวมแข็งแกร่งที่สุดในซีรีส์. citeturn980363view2turn980363view0 |
| DeepSeek-V4-Flash | การใช้งานทั่วไปที่เร็วและเบา | 1M | โมเดลขนาดเล็ก 284B/13B ยังรองรับโหมด thinking และการเรียกใช้เครื่องมือ. citeturn980363view2turn980363view0 |
| DeepSeek-V3.2 | รุ่นพื้นฐานบริบทยาวเจเนอเรชันก่อนหน้า | 128K ในเอกสาร API ก่อนหน้า; V4 ใช้การออกแบบบริบท 1M ที่ต่างกัน | ใช้เป็นจุดอ้างอิงสำหรับการเพิ่มประสิทธิภาพ; model card ของ V4-Pro รายงานการลดการคำนวณบริบทยาวและ KV cache ครั้งใหญ่เมื่อเทียบกับ V3.2. citeturn321011view1turn980363view2 |
กรณีใช้งานที่ดีที่สุด
- ผู้ช่วยเขียนโค้ดและเครื่องมือ refactoring ระดับ repository
- การวิเคราะห์และสังเคราะห์เอกสารยาว
- เอเจนต์ที่ใช้เครื่องมือซึ่งต้องการการให้เหตุผลหลายรอบ
- เวิร์กโฟลว์สนับสนุนด้านเทคนิคที่ได้ประโยชน์จากหน่วยความจำระยะยาวและผลลัพธ์แบบมีโครงสร้าง
- งานความรู้ภาษาจีนและหลายภาษาที่ model card แสดงให้เห็นผลงานเกณฑ์มาตรฐานที่แข็งแกร่ง
วิธีเข้าถึงและใช้งาน Deepseek v4 pro API
ขั้นตอนที่ 1: สมัครสำหรับ API Key
เข้าสู่ระบบที่ cometapi.com หากคุณยังไม่เป็นผู้ใช้ของเรา โปรดลงทะเบียนก่อน เข้าสู่ คอนโซล CometAPI รับ API key สำหรับสิทธิ์การเข้าถึงอินเทอร์เฟซ คลิก “Add Token” ที่ API token ในศูนย์ส่วนบุคคล รับ token key: sk-xxxxx และส่ง
ขั้นตอนที่ 2: ส่งคำขอไปยัง Deepseek v4 proAPI
เลือกปลายทาง “deepseek-v4-pro” เพื่อส่งคำขอ API และตั้งค่า request body วิธีการร้องขอและ request body สามารถดูได้จากเอกสาร API บนเว็บไซต์ของเรา เว็บไซต์ของเรายังมีการทดสอบ Apifox เพื่อความสะดวกของคุณ แทนที่ <YOUR_API_KEY> ด้วย CometAPI key จริงจากบัญชีของคุณ ตำแหน่งที่เรียกใช้: Anthropic Messages รูปแบบ และ Chat รูปแบบ
ใส่คำถามหรือคำขอของคุณลงในช่อง content—นี่คือสิ่งที่โมเดลจะตอบกลับ ประมวลผลการตอบกลับของ API เพื่อรับคำตอบที่สร้างขึ้น
ขั้นตอนที่ 3: ดึงและตรวจสอบผลลัพธ์
ประมวลผลการตอบกลับของ API เพื่อรับคำตอบที่สร้างขึ้น หลังจากประมวลผลแล้ว API จะตอบกลับด้วยสถานะงานและข้อมูลผลลัพธ์ เปิดใช้คุณสมบัติต่างๆ เช่น การสตรีม การแคชพรอมต์ หรือการจัดการบริบทยาว ผ่านพารามิเตอร์มาตรฐาน