DeepSeek V4.1 Flash แทนที่ช่วงเบต้าอายุสั้นด้วยรุ่นพร้อมใช้งานจริง ซึ่งสร้างขึ้นบนคอมพิวต์แบบอสมมาตร มัลติโหมดแบบเนทีฟ เกณฑ์มาตรฐานสำหรับเอเจนต์ที่แข็งแกร่งขึ้น และราคาค่า API ที่ลดลงอย่างมาก
TL;DR
DeepSeek V4.1 Flash เป็นทั้ง API อย่างเป็นทางการและโมเดลแบบ open-weight แล้ว ไม่ใช่เอ็นด์พอยต์เบต้าที่จะหมดอายุ DeepSeek ระบุว่าเป็นโมเดล Mixture-of-Experts ที่มีพารามิเตอร์ 552B พร้อมสถาปัตยกรรมแบบ Causal-Encoder-Decoder ใหม่ โดยจะเปิดใช้งานพารามิเตอร์เพียง 8B ขณะประมวลผลอินพุต และ 16B ระหว่างการสร้างเอาต์พุต การออกแบบแบบอสมมาตรนี้ตั้งใจให้ใช้ทรัพยากรคอมพิวต์น้อยลงกับพรอมต์ที่ยาว โดยไม่ลดทอนขั้นตอนการสร้างแบบออโตรีเกรสซีฟ
ชื่อโมเดล API สำหรับโปรดักชันคือ deepseek-flash รองรับหน้าต่างบริบท 1M โทเคน สูงสุด 384K โทเคนเอาต์พุต โหมดคิดและไม่คิด เอาต์พุต JSON การเรียกใช้เครื่องมือ Responses API, Anthropic-compatible API และรับอินพุตภาพแบบเนทีฟ ตารางเกณฑ์มาตรฐานอย่างเป็นทางการของ DeepSeek แสดงการพัฒนาที่เป็นรูปธรรมเมื่อเทียบกับ V4 Flash 0731 และ V4 Pro 0813 ในงานด้านโค้ด เอเจนต์ ความปลอดภัยไซเบอร์ และมัลติโหมด
การเปลี่ยนแปลงราคาเองก็สำคัญไม่แพ้กัน ในช่วงพีก V4.1 Flash มีค่าใช้จ่าย $0.006 ต่อหนึ่งล้านโทเคนอินพุตแบบ cache-hit, $0.30 ต่อหนึ่งล้านโทเคนอินพุตแบบ cache-miss และ $1.20 ต่อหนึ่งล้านโทเคนเอาต์พุต อัตรานอกพีกอยู่ที่ครึ่งหนึ่งของจำนวนดังกล่าว
Key Takeaways
- DeepSeek V4.1 Flash เป็นโมเดลที่ปล่อยใช้งานพร้อมน้ำหนักเปิด; ตัวระบุชั่วคราว
deepseek-v4.1-flash-expires-on-0910ไม่ใช่การอ้างอิงสำหรับโปรดักชันอีกต่อไป - การออกแบบ MoE ขนาด 552B เปิดใช้งาน 8B พารามิเตอร์สำหรับอินพุต และ 16B สำหรับเอาต์พุต ซึ่งสร้างโปรไฟล์ประสิทธิภาพที่ต่างจากสถาปัตยกรรมของ V4 Flash ที่มีทั้งหมด 284B/ใช้งาน 13B
- มัลติโหมดแบบเนทีฟเป็นส่วนหนึ่งของโมเดลหลักแทนที่จะเป็นสาขา Vision Exp แยกต่างหาก
- การเปรียบเทียบอย่างเป็นทางการแสดงว่า V4.1 Flash นำหน้า V4 Pro 0813 บนเกณฑ์มาตรฐานด้านเอเจนต์และโค้ดส่วนใหญ่ แม้ว่าจะไม่ได้เป็นผู้นำทุกงานความรู้หรือเทอร์มินัลเมื่อเทียบกับผู้ท้าชิงระดับแนวหน้าในทุกกรณี
- Global KV cache ลดลงเหลือ 890 ไบต์ต่อโทเคน เล็กกว่า V4 Flash ประมาณ 3.9 เท่า และประมาณหนึ่งในสี่ของรอยเท้าก่อนหน้า
- ราคาช่วงพีกของ API อยู่ที่ $0.006 สำหรับอินพุตแบบ cache-hit, $0.30 สำหรับอินพุตแบบ cache-miss และ $1.20 สำหรับเอาต์พุตต่อหนึ่งล้านโทเคน; อัตรานอกพีกต่ำกว่าครึ่งหนึ่ง
What Is DeepSeek V4.1 Flash?
DeepSeek V4.1 Flash คือโมเดลฐานที่เน้นประสิทธิภาพของ DeepSeek ในเดือนกันยายน 2026 สำหรับการให้เหตุผล การเขียนโค้ด เอเจนต์ และความเข้าใจแบบมัลติโหมด ประกาศอย่างเป็นทางการ อธิบายว่าเป็นโมเดล MoE ขนาด 552B ที่เพิ่มความสามารถ พร้อมทั้งลดคอมพิวต์และหน่วยความจำที่ต้องใช้ในการประมวลผลอินพุต
การเปลี่ยนแปลงหลักคือสถาปัตยกรรม V4 Flash ก่อนหน้าใช้บัดเจ็ตพารามิเตอร์ที่เปิดใช้งานแบบเดียวกันตลอดการอนุมาน V4.1 Flash แยกภาระงานอินพุตและเอาต์พุต: เปิดใช้งาน 8B พารามิเตอร์เมื่อเข้ารหัสพรอมต์ และ 16B เมื่อสร้างคำตอบ DeepSeek เรียกการออกแบบนี้ว่า Causal-Encoder-Decoder
| Date | Status | Model ID |
|---|---|---|
| Sep 8 | Limited beta | deepseek-v4.1-flash-expires-on-0910 |
| Sep 10 | Production release | deepseek-flash |
DeepSeek V4.1 Flash Specification:
| Specification | DeepSeek V4.1 Flash |
|---|---|
| Release status | เปิดตัวเป็น API อย่างเป็นทางการและโมเดลแบบ open-weight |
| Architecture | Mixture-of-Experts พร้อมโครงสร้าง Causal-Encoder-Decoder |
| Total parameters | 552B |
| Activated parameters | 8B สำหรับอินพุต; 16B สำหรับเอาต์พุต |
| Context window | 1M โทเคน |
| Maximum output | 384K โทเคน |
| Input modalities | ข้อความและภาพ |
| Output modality | ข้อความ |
| Production API model name | deepseek-flash |
| Thinking modes | โหมด Thinking และ Non-thinking |
| API features | เอาต์พุต JSON, การเรียกใช้เครื่องมือ, Responses API, Anthropic API, prefix completion, FIM completion |
| Open weights | เผยแพร่บน Hugging Face |
How Does the DeepSeek V4.1 Flash Work: Causal-Encoder-Decoder
โดยทั่วไป โมเดลภาษาประเภท decoder-only ใช้สแต็กขนาดใหญ่เดียวกันสำหรับการประมวลผลพรอมต์และการสร้างโทเคน V4.1 Flash ของ DeepSeek จัดสรรความจุที่เปิดใช้งานแตกต่างกันให้กับแต่ละขั้นตอน
ในขั้นตอนอินพุต โมเดลจะประมวลผลพรอมต์ด้วยรอยเท้าพารามิเตอร์ที่เปิดใช้งาน 8B ขั้นตอนนี้สามารถตรวจสอบบริบทของข้อความหรือภาพที่ให้มาได้อย่างมีประสิทธิภาพ เพราะคำตอบเต็มรูปแบบยังไม่ได้ถูกสร้าง ในขั้นตอนเอาต์พุต โมเดลจะเปิดใช้งาน 16B พารามิเตอร์และดำเนินการสร้างโทเคนแบบมีสาเหตุทีละโทเคน การออกแบบดังกล่าวจึงช่วยประหยัดคอมพิวต์ในช่วงเข้ารหัสพรอมต์ ขณะคงความจุที่เปิดใช้งานมากขึ้นสำหรับการให้เหตุผลและการตอบ
DeepSeek ยังไม่ได้เผยรายละเอียดการนำไปใช้งานทุกประการในประกาศ ดังนั้นคำอธิบายที่ปลอดภัยที่สุดจึงเป็นเชิงหน้าที่: สถาปัตยกรรมเป็นแบบอสมมาตร ขั้นตอนอินพุตและเอาต์พุตใช้บัดเจ็ตพารามิเตอร์ที่เปิดใช้งานแตกต่างกัน และระบบที่ได้ช่วยลดหน่วยความจำและต้นทุนการอนุมาน
KV Cache Reduction
ผลด้านหน่วยความจำวัดได้จริง DeepSeek รายงานว่า Global KV cache อยู่ที่ 890 ไบต์ต่อโทเคน สำหรับ V4.1 Flash เมื่อเทียบกับ 3,514 ไบต์สำหรับ V4 Flash, 48,068 ไบต์สำหรับ V3.2 และ 389,120 ไบต์สำหรับ V1 ตัวเลขของ V4.1 เล็กกว่า V4 Flash ประมาณ 3.9 เท่า
สำหรับเอเจนต์ที่มีบริบทยาว นี่สำคัญเกินกว่าหนึ่งเกณฑ์มาตรฐาน แคช KV ที่เล็กลงช่วยลดแรงกดดันต่อหน่วยความจำแบนด์วิดท์สูงระหว่างที่คำขอทำงาน และลดปริมาณสถานะที่ต้องย้ายไปยังสตอเรจที่ช้ากว่า DeepSeek ระบุว่า V4.1 Flash ต้องการ HBM ประมาณหนึ่งในสี่ และ SSD ประมาณหนึ่งในแปดของรุ่นก่อนหน้าสำหรับงานแคชในระดับที่เทียบกันได้
DeepSeek V4.1 Flash Features
Native Multimodal Input
V4.1 Flash รองรับภาพเป็นส่วนหนึ่งของ API ของโมเดลหลัก ซึ่งมาแทนการแยกระหว่าง V4 Flash ที่มีเฉพาะข้อความและเอ็นด์พอยต์ V4 Flash Vision แบบทดลอง นักพัฒนาจึงสามารถสร้างเวิร์กโฟลว์ด้านความเข้าใจเอกสาร การวิเคราะห์กราฟ การตีความภาพหน้าจอ และเอเจนต์เชิงภาพบนโมเดลผลิตจริงเดียวกัน
Long-Context Reasoning
สเปค API อย่างเป็นทางการยังคงหน้าต่างบริบท 1M โทเคน และอนุญาตเอาต์พุตได้สูงสุด 384K โทเคน โมเดลจึงเหมาะกับการเขียนโค้ดระดับคลังซอร์ส การวิเคราะห์หลายเอกสาร เซสชันเอเจนต์ระยะยาว และเวิร์กโฟลว์ที่ต้องเก็บประวัติการใช้เครื่องมือจำนวนมาก
Production API Features
โมเดลรองรับโหมด Thinking และ Non-thinking เอาต์พุต JSON ที่มีโครงสร้าง การเรียกใช้เครื่องมือ Responses API อินเทอร์เฟซที่เข้ากันได้กับ Anthropic การเติมแชตแบบ prefix และ FIM completion ในโหมด non-thinking ความสามารถเหล่านี้ทำให้ V4.1 Flash เป็นตัวแทนสำหรับโปรดักชันโดยตรงสำหรับเวิร์กโหลดเอเจนต์และโค้ดจำนวนมากของ V4 Flash
Open Weights
DeepSeek ได้เผยแพร่น้ำหนักของ V4.1 Flash และรายงานทางเทคนิค การเผยแพร่ช่วยเพิ่มความสามารถในการทำซ้ำ แต่โมเดลยังคงมีขนาดใหญ่มาก: ประกาศของ DeepSeek ขอให้องค์กรที่สนใจการปรับใช้ขนาดใหญ่เตรียมการประมาณ 2,000 GPU พร้อมคลัสเตอร์สตอเรจ
DeepSeek V4.1 Flash Benchmark Performance
ผลลัพธ์อย่างเป็นทางการเปลี่ยนการประเมินก่อนหน้าที่ว่า V4.1 ยังไม่มีหลักฐานจากเกณฑ์มาตรฐาน ตอนนี้ DeepSeek ให้ตารางกว้างครอบคลุมด้านความรู้ คณิตศาสตร์ โค้ด เอเจนต์เทอร์มินัล ความปลอดภัยไซเบอร์ ระบบอัตโนมัติ และงานเอเจนต์มัลติโหมด

| Benchmark | DeepSeek V4.1 Flash | V4 Pro 0813 | V4 Flash 0731 |
|---|---|---|---|
| GPQA Diamond | 90.9 | 92.4 | 89.9 |
| Codeforces rating | 3471 | 3348 | 3289 |
| MathArena Apex | 65.6 | 65.3 | 58.6 |
| Terminal-Bench 2.1 | 90.6 | 87.9 | 82.7 |
| DeepSWE v1.1 | 74.2 | 62.7 | 54.4 |
| NL2Repo-Bench | 65.4 | 61.5 | 54.2 |
| CyberGym | 88.1 | 83.3 | 76.7 |
| Automation-Bench | 54.8 | 43.2 | 37.7 |
ในมุมมองแปดเกณฑ์มาตรฐานที่เลือกนี้ V4.1 Flash เอาชนะ V4 Pro 0813 ได้เจ็ดการทดสอบ และเอาชนะ V4 Flash 0731 ได้ทั้งหมดแปดรายการ ช่องว่างที่มากที่สุดปรากฏในวิศวกรรมซอฟต์แวร์และเอเจนต์: DeepSWE เพิ่มขึ้น 11.5 คะแนนเหนือ V4 Pro และ 19.8 เหนือ V4 Flash ขณะที่ Automation-Bench ดีขึ้น 11.6 และ 17.1 คะแนนตามลำดับ
อย่างไรก็ตามผลลัพธ์ยังต้องตีความอย่างระมัดระวัง V4.1 Flash ทำคะแนนต่ำกว่า V4 Pro บน GPQA Diamond และตารางเต็มของทางการแสดงว่า Claude Opus 5 และ GPT-5.6 Sol ยังนำหน้าใน Terminal-Bench 3.0 บทสรุปที่เป็นประโยชน์คือ V4.1 Flash ปรับปรุงสมดุลระหว่างประสิทธิภาพและความสามารถของ DeepSeek อย่างมีนัยสำคัญ; ตารางเกณฑ์มาตรฐานไม่ได้พิสูจน์ความเป็นผู้นำสากลในทุกงาน
DeepSeek V4.1 Flash API Pricing
DeepSeek ใช้การคิดค่าบริการแบบช่วงพีกและนอกพีก ช่วงเวลาพีกคือ 01:00–04:00 และ 06:00–10:00 UTC วันจันทร์ถึงศุกร์; ช่วงอื่นทั้งหมดรวมถึงวันสุดสัปดาห์ใช้อัตรานอกพีก เอกสารราคาปัจจุบัน ระบุว่าอัตรานอกพีกอยู่ที่ครึ่งหนึ่งของอัตราพีก
| Price per 1M tokens | V4.1 Flash off-peak | V4.1 Flash peak | V4 Pro 0813 off-peak | V4 Pro 0813 peak |
|---|---|---|---|---|
| Cache-hit input | $0.003 | $0.006 | $0.022 | $0.044 |
| Cache-miss input | $0.15 | $0.30 | $0.66 | $1.32 |
| Output | $0.60 | $1.20 | $1.98 | $3.96 |

การประหยัดมีนัยสำคัญ สำหรับเวิร์กโหลดที่ใช้โทเคนอินพุตแบบ cache-miss 100 ล้านโทเคน และโทเคนเอาต์พุต 10 ล้านโทเคน V4.1 Flash มีค่าใช้จ่ายประมาณ $21 ในช่วงนอกพีก หรือ $42 ในช่วงพีก เวิร์กโหลดเดียวกันที่อัตราเผยแพร่ของ V4 Pro 0813 จะมีค่าใช้จ่ายประมาณ $85.80 นอกพีก หรือ $171.60 ในช่วงพีก V4.1 Flash มีราคาถูกกว่าประมาณ 75.5% ในตัวอย่างนี้
การแคชพรอมต์ยิ่งเสริมข้อได้เปรียบสำหรับเอเจนต์ที่ใช้คำสั่งระบบ บริบทของคลัง หรือเอกสารซ้ำๆ อัตราค่าใช้จ่ายของ V4.1 สำหรับ cache-hit ต่ำกว่า cache-miss 50 เท่าในทั้งสองช่วงเวลา
DeepSeek V4.1 Flash vs V4 Flash vs V4 Pro
| Dimension | DeepSeek V4.1 Flash | DeepSeek V4 Flash | DeepSeek V4 Pro |
|---|---|---|---|
| Total parameters | 552B | 284B | 1.6T |
| Activated parameters | 8B input / 16B output | 13B | 49B |
| Architecture focus | ประสิทธิภาพแบบอสมมาตรระหว่างอินพุต/เอาต์พุต | V4 MoE น้ำหนักเบา | ความจุสูงสุดของ V4 |
| Native vision | ใช่ | สาย Vision Exp แยกต่างหาก | ไม่ |
| Context window | 1M | 1M | 1M |
| Maximum output | 384K | 384K | 384K |
| API status on DeepSeek | โมเดลโปรดักชันปัจจุบัน | ยกเลิก; ชื่อเดิมชี้ไปยัง V4.1 Flash | กำหนดให้ชี้ไปยัง V4.1 Flash ตั้งแต่ 14 กันยายน 2026 |
| Best fit | เอเจนต์ทั่วไป โค้ด วิชวล และ throughput สูง | ความเข้ากันได้ในการย้ายระบบเท่านั้น | เวิร์กโหลด Pro ที่มีอยู่ระหว่างช่วงเปลี่ยนผ่าน |
V4.1 Flash มีจำนวนพารามิเตอร์รวมมากกว่า V4 Flash แต่สามารถให้บริการได้ถูกกว่า เพราะขั้นตอนอินพุตเปิดใช้งานเพียง 8B พารามิเตอร์และใช้แคช KV ที่เล็กกว่ามาก เมื่อเทียบกับ V4 Pro จะเปิดใช้งานพารามิเตอร์น้อยกว่ามาก ขณะเดียวกันทำผลงานเหนือกว่า Pro บนเกณฑ์มาตรฐานเอเจนต์และโค้ดส่วนใหญ่ที่เลือกไว้ด้านบน
API Access and Migration
ชื่อโมเดลโปรดักชันคือ deepseek-flash แอปพลิเคชันที่มีอยู่สามารถคงค่า base URL แบบเข้ากันได้กับ OpenAI คือ https://api.deepseek.com หรือ base URL แบบเข้ากันได้กับ Anthropic คือ https://api.deepseek.com/anthropic.
- อัปเดตชื่อโมเดลเป็น
deepseek-flash - คงค่า base URL ของ DeepSeek และวิธีการยืนยันตัวตนเดิม
- ทดสอบใหม่สำหรับโหมดคิด การเรียกใช้เครื่องมือ อินพุตภาพ เวลาแฝง และการใช้โทเคนกับพรอมต์โปรดักชัน
- เฝ้าดู alias เดิม:
deepseek-v4-flashและdeepseek-v4-flash-vision-expตอนนี้ชี้ไปยัง V4.1 Flash ขณะที่deepseek-v4-proกำหนดจะชี้ไปยัง V4.1 Flash ตั้งแต่ 14 กันยายน 2026 จนกว่าจะมีการปล่อย V4.1 Pro
สำหรับผู้ใช้ CometAPI DeepSeek V4.1 API ใน CometAPI เปิดให้ใช้งานแล้วควบคู่กับ DeepSeek V4 Flash API ที่มีอยู่ ก่อนสลับทราฟฟิกโปรดักชัน โปรดยืนยันชื่อโมเดลสุดท้าย ราคา และการแมป alias ในแดชบอร์ด CometAPI เนื่องจากผู้ให้บริการภายนอกอาจแตกต่างจากการตั้งชื่อและอัตราค่าบริการของ API อย่างเป็นทางการของ DeepSeek
Who Should Use DeepSeek V4.1 Flash?
V4.1 Flash เหมาะอย่างยิ่งกับเอเจนต์สำหรับการเขียนโค้ด การวิเคราะห์คลังซอร์ส ระบบอัตโนมัติผ่านเทอร์มินัล เวิร์กโฟลว์เอกสารแบบมัลติโหมด ผู้ช่วยที่มีบริบทยาว และระบบที่ใช้เครื่องมือจำนวนมาก ความก้าวหน้าของเกณฑ์มาตรฐานกระจุกตัวในเวิร์กโหลดที่ได้รับประโยชน์มากที่สุดจากแคชหน่วยความจำที่ลดลงและราคาต่อโทเคนที่ต่ำลง
ทีมที่ใช้งาน V4 Flash อยู่ควรมองเป็นตัวเลือกย้ายโดยตรง ทีมที่ใช้ V4 Pro ควรทดสอบอย่างรอบคอบ แต่เกณฑ์มาตรฐานและข้อมูลราคาของ DeepSeek เองตอนนี้ทำให้ V4.1 Flash เป็นค่าเริ่มต้นที่คุ้มค่ากว่าสำหรับเวิร์กโหลดระดับ Pro จำนวนมาก
การโฮสต์ด้วยตนเองเป็นอีกการตัดสินใจหนึ่ง น้ำหนักแบบเปิดไม่ได้ทำให้โมเดลขนาด 552B เบา องค์กรควรเปรียบเทียบต้นทุนของการปรับใช้ GPU จำนวนมากและสตอเรจกับการใช้ API แบบโฮสต์ก่อนตัดสินใจรันภายใน
Limitations and Open Questions
- ผลเกณฑ์มาตรฐานมาจากชุดการประเมินของ DeepSeek; จำเป็นต้องมีการทำซ้ำโดยอิสระเพื่อวัดประสิทธิภาพในฮาร์เนสและสภาพแวดล้อมเครื่องมือที่แตกต่าง
- ยืนยันว่ารองรับมัลติโหมดแบบเนทีฟแล้ว แต่ทีมแอปพลิเคชันควรตรวจสอบรูปแบบภาพที่รองรับ การนับโทเคน และพฤติกรรมวิชวลกับ API จริง
- alias ของโมเดลเดิมตอนนี้เปลี่ยนโมเดลที่อยู่หลังชื่อที่มีอยู่ ซึ่งอาจเปลี่ยนเอาต์พุตโดยไม่ต้องแก้โค้ดแอปพลิเคชัน
- V4.1 Flash ลดความต้องการโครงสร้างพื้นฐานเมื่อเทียบกับโมเดลก่อนหน้า แต่การปรับใช้แบบ open-weight ยังต้องใช้คอมพิวต์และสตอเรจจำนวนมาก
- ควรยืนยันเอ็นด์พอยต์ V4.1 ของ CometAPI และราคาสุดท้ายในคอนโซลจริงก่อนใช้งานโปรดักชัน
Final Verdict
DeepSeek V4.1 Flash เป็นอัปเดตเชิงสถาปัตยกรรมและผลิตภัณฑ์ครั้งใหญ่ โมเดล MoE ขนาด 552B ผสานขั้นตอนอินพุตที่เปิดใช้งาน 8B ขั้นตอนเอาต์พุตที่เปิดใช้งาน 16B วิชวลแบบเนทีฟ หน้าต่างบริบท 1M โทเคน และแคช KV ที่บีบอัดอย่างมาก การออกแบบเหล่านี้แปลเป็นเกณฑ์มาตรฐานด้านโค้ดและเอเจนต์ที่แข็งแกร่งขึ้น พร้อมราคาค่า API ที่ต่ำกว่า V4 Pro 0813 อย่างมาก
การเปลี่ยนแปลงที่ใช้งานได้จริงที่สุดคือการรวมศูนย์ V4.1 Flash นำข้อความ วิชวล การให้เหตุผล การใช้เครื่องมือ และการทำงานบริบทยาวมาไว้ใต้ชื่อโมเดลโปรดักชันเดียว สำหรับการผสาน DeepSeek ใหม่ส่วนใหญ่ deepseek-flash ตอนนี้เป็นจุดเริ่มต้นที่เหมาะสม; V4 Pro กลายเป็นตัวเลือกสำหรับการเปรียบเทียบการย้าย มากกว่าการเลือกอัตโนมัติสำหรับงานยาก
FAQ
Is DeepSeek V4.1 Flash officially released?
ใช่ มีให้ใช้งานผ่าน API ของ DeepSeek ภายใต้ชื่อโมเดล deepseek-flash และ DeepSeek ได้เผยแพร่น้ำหนักเปิดพร้อมรายงานทางเทคนิคแล้ว
Is the temporary V4.1 beta model ID still required?
ไม่ deepseek-v4.1-flash-expires-on-0910 เป็นตัวระบุเบต้าระยะสั้น แอปพลิเคชันโปรดักชันควรใช้ deepseek-flash
How many parameters does DeepSeek V4.1 Flash have?
โมเดลมีพารามิเตอร์รวม 552B เปิดใช้งาน 8B พารามิเตอร์ระหว่างประมวลผลอินพุต และ 16B ระหว่างสร้างเอาต์พุต
Does DeepSeek V4.1 Flash support images?
รองรับ อินพุตภาพเป็นเนทีฟในโมเดลโปรดักชัน จึงไม่จำเป็นต้องใช้เอ็นด์พอยต์ V4 Flash Vision Exp แยกต่างหากอีกต่อไป
Is V4.1 Flash better than V4 Pro?
นำหน้า V4 Pro 0813 บนการเปรียบเทียบด้านโค้ด เอเจนต์ ระบบอัตโนมัติ และความปลอดภัยไซเบอร์ส่วนใหญ่ที่ DeepSeek เผยแพร่ แต่ V4 Pro ยังนำบน GPQA Diamond ทีมควรประเมินทั้งสองด้วยพรอมต์ของตนเองก่อนย้าย
How much does the API cost?
ในช่วงพีก อัตราต่อหนึ่งล้านโทเคนคือ $0.006 สำหรับอินพุตแบบ cache-hit, $0.30 สำหรับอินพุตแบบ cache-miss และ $1.20 สำหรับเอาต์พุต อัตรานอกพีกอยู่ที่ครึ่งหนึ่งของราคาเหล่านี้
What happens to the old V4 model names?
ชื่อเดิม deepseek-v4-flash และ deepseek-v4-flash-vision-exp ชี้ไปยัง V4.1 Flash แล้ว DeepSeek ระบุว่า deepseek-v4-pro จะชี้ไปยัง V4.1 Flash ตั้งแต่ 14 กันยายน 2026 จนกว่าจะมีการปล่อย V4.1 Pro
Can I use DeepSeek V4.1 Flash through CometAPI?
ได้ ตอนนี้ CometAPI มี เอ็นด์พอยต์ DeepSeek V4.1 API ให้ใช้งาน ควรยืนยันชื่อโมเดลที่แน่นอน ราคา และคุณสมบัติที่รองรับในคอนโซล CometAPI ก่อนส่งทราฟฟิกโปรดักชัน เนื่องจากผู้ให้บริการภายนอกอาจใช้การตั้งชื่อหรืออัตราค่าบริการที่ต่างจาก API อย่างเป็นทางการของ DeepSeek
