Kimi K3 is now live on CometAPI →

ราคา API ของ Kimi K3 (2026): มีค่าใช้จ่ายเท่าไร และการเปรียบเทียบโค้ดกับ K2.7

CometAPI
Mia MarenJul 17, 2026
ราคา API ของ Kimi K3 (2026): มีค่าใช้จ่ายเท่าไร และการเปรียบเทียบโค้ดกับ K2.7

TL;DR

Kimi K3 มีค่าใช้จ่าย $0.30 ต่อ 1M โทเค็นอินพุตแบบ cache hit, $3.00 ต่อ 1M โทเค็นอินพุตแบบ cache miss และ $15.00 ต่อ 1M โทเค็นเอาต์พุต พร้อม หน้าต่างบริบท ขนาด 1,048,576 โทเค็น

เมื่อเทียบกับ K2.7 Code แล้ว K3 มีค่าใช้จ่ายต่อโทเค็นสูงกว่ามาก แต่ให้หน้าต่างบริบทมากกว่า 4× พร้อมความสามารถด้านภาพแบบเนทีฟ และรองรับงานตัวแทนระยะยาวได้ดีกว่า

สรุป: K2.7 Code ยังคงคุ้มค่ากว่าสำหรับงานโค้ดทั่วไปภายในบริบท 256K ให้ใช้ K3 เมื่อคุณต้องการบริบทที่ใหญ่ขึ้น ความสามารถมัลติโหมด หรือเป็นเส้นทางยกระดับเมื่อ K2.7 ไม่สามารถทำงานได้อย่างน่าเชื่อถือ

Kimi K3 API Pricing at a Glance

รายการKimi K3
API model IDkimi-k3
อินพุตแบบ cache hit$0.30 / 1M tokens
อินพุตแบบ cache miss$3.00 / 1M tokens
เอาต์พุต$15.00 / 1M tokens
หน้าต่างบริบท1,048,576 tokens
การให้เหตุผลเปิดใช้งานเสมอ
ระดับความพยายามในการให้เหตุผลที่รองรับเฉพาะ max
จำนวนโทเค็นคำตอบสูงสุดค่าเริ่มต้น131,072 tokens
จำนวนโทเค็นคำตอบสูงสุดที่ปรับได้สูงสุด 1,048,576 tokens โดยขึ้นอยู่กับขีดจำกัดบริบทรวม
ความสามารถหลักการมองเห็นแบบเนทีฟ, การเรียกใช้เครื่องมือ, เอาต์พุตแบบมีโครงสร้าง, Partial Mode, การโหลดเครื่องมือแบบไดนามิก, การแคชบริบทอัตโนมัติ
Batch APIปัจจุบัน K3 ยังไม่อยู่ในรายชื่อโมเดลที่รองรับใน Batch

ดู Kimi K3 quickstart ของ Moonshot สำหรับพารามิเตอร์ API ปัจจุบันและรายละเอียดการผสานรวม

What Kimi K3 Adds Over K2.7 Code

การอัปเกรดที่ชัดเจนที่สุดคือความยาวบริบท

K2.7 Code รองรับ 262,144 โทเค็น ในขณะที่ K3 เพิ่มขีดจำกัดนั้นเป็น 1,048,576 โทเค็น ซึ่งทำให้ K3 เหมาะกับรีโพขนาดใหญ่ ประวัติตัวแทนยาวๆ เอกสารจำนวนมาก และเวิร์กโฟลว์ที่มิฉะนั้นต้องลดบริบทลง

K3 ยังรองรับ:

  • ความเข้าใจเชิงภาพแบบเนทีฟ
  • เอาต์พุตแบบมีโครงสร้างเคร่งครัด
  • tool_choice
  • การโหลดเครื่องมือแบบไดนามิก
  • การแคชบริบทอัตโนมัติ
  • เวิร์กโฟลว์งานโค้ดและความรู้ที่ทำงานยาวนาน

Kimi K3 technical blog ของ Moonshot รายงานคะแนน 88.3 บน Terminal-Bench 2.1, 77.8 บน Program Bench และ 81.2 บน FrontierSWE

นี่คือคะแนนที่ผู้ให้บริการรายงานเอง จึงควรใช้เป็นเหตุผลในการประเมิน K3 มิใช่การรับประกันว่าจะเหนือกว่า K2.7 Code ในงานผลิตจริงทุกกรณี

สำหรับข้อมูลรุ่นก่อนหน้า ดู Kimi K2 API guide ของ CometAPI

Kimi K3 vs Kimi K2.7 Code Pricing

โมเดลอินพุต cache hitอินพุต cache missเอาต์พุตบริบท
kimi-k3$0.30 / 1M$3.00 / 1M$15.00 / 1M1,048,576
kimi-k2.7-code$0.19 / 1M$0.95 / 1M$4.00 / 1M262,144
kimi-k2.7-code-highspeed$0.38 / 1M$1.90 / 1M$8.00 / 1M262,144

อัตรา K2.7 มาจาก เอกสารราคาอย่างเป็นทางการของ Kimi K2.7 Code ของ Moonshot

เมื่อเทียบกับ K2.7 Code มาตรฐาน K3 มีราคา:

  • 1.58× สำหรับอินพุตแบบ cache hit
  • 3.16× สำหรับอินพุตแบบ cache miss
  • 3.75× สำหรับเอาต์พุต

ส่วนเพิ่มของ K3 น้อยกว่าเมื่อเทียบกับ K2.7 Code HighSpeed แต่สองโมเดลนี้มุ่งเน้นต่างกัน: HighSpeed เน้นความเร็วในการสร้างโค้ด ในขณะที่ K3 มุ่งไปที่งานบริบทยาวและงานตัวแทนที่ท้าทายมากกว่า

เอกสารราคา Batch API ปัจจุบันของ Moonshot ยังไม่ได้ระบุ K3 ดังนั้นอย่าคิดว่า ส่วนลด Batch ที่ใช้กับโมเดล Kimi อื่น ๆ จะใช้กับ K3 ด้วย

Kimi K3 Context Caching: How the 90% Input Discount Works

K3 รองรับการแคชบริบทอัตโนมัติ

นักพัฒนาไม่จำเป็นต้องสร้าง cache ID หรือ TTL เอง การทำให้คำนำหน้า (prefix) ขนาดใหญ่คงที่ในหลายคำขอจะเปิดโอกาสให้คำขอต่อ ๆ ไปได้อัตรา cache hit

ความแตกต่างของราคา:

  • Cache miss: $3.00 / 1M โทเค็นอินพุต
  • Cache hit: $0.30 / 1M โทเค็นอินพุต

ดังนั้นโทเค็นอินพุตที่เป็น cache hit จึงมีราคาถูกกว่า 90% เมื่อเทียบกับ cache miss

อย่างไรก็ตาม เอาต์พุตยังคิดราคา $15 ต่อหนึ่งล้านโทเค็น ดังนั้นค่าใช้จ่ายรวมต่อคำขอจะไม่ได้ลดลง 90%

ตัวอย่าง สมมติว่า:

  • อินพุต 600,000 โทเค็น
  • เอาต์พุต 20,000 โทเค็น
สถานะแคชค่าใช้จ่ายอินพุตค่าใช้จ่ายเอาต์พุตรวม
อินพุตทั้งหมดเป็น cache miss$1.80$0.30$2.10
อินพุตทั้งหมดเป็น cache hit$0.18$0.30$0.48

ในกรณีอย่างง่ายนี้ ค่าใช้จ่ายรวมลดลงประมาณ 77%

การประหยัดจริงขึ้นอยู่กับสัดส่วนของโทเค็นอินพุตที่ได้อัตรา cache hit

Example: What a Coding Task Costs on K3 vs K2.7

สมมติว่างานโค้ดใช้งาน:

  • อินพุต 200,000 โทเค็น
  • เอาต์พุต 20,000 โทเค็น
เส้นทางรวมเมื่อแคชยังไม่ทำงานรวมเมื่อแคชครบ
kimi-k3$0.90$0.36
kimi-k2.7-code$0.27$0.12
kimi-k2.7-code-highspeed$0.54$0.24

สำหรับเวิร์กโหลดนี้ K3 มีค่าใช้จ่ายประมาณ 3.33× ของ K2.7 Code มาตรฐานในคำขอแบบ cold

ภายใน K3 เอง การย้ายจากอินพุตที่เป็น cache miss ทั้งหมดไปเป็น cache hit ทั้งหมดลดค่าใช้จ่ายโดยประมาณจาก $0.90 เป็น $0.36 ลดลง 60% ในตัวอย่างนี้

แต่ค่าใช้จ่ายต่อคำขอเป็นเพียงส่วนหนึ่งของสมการเท่านั้น

ค่าใช้จ่ายต่อภารกิจที่สำเร็จ = ค่าใช้จ่ายเวิร์กโฟลว์ทั้งหมด ÷ จำนวนภารกิจที่ผ่านการตรวจรับ

การเปรียบเทียบสำหรับงานผลิตควรรวมการลองใหม่ การเรียกสำรอง การเรียกใช้เครื่องมือ และเวลาในการตรวจทานของมนุษย์ด้วย

คำขอ K3 ที่สำเร็จในครั้งเดียวอาจคุ้มค่ากว่าความพยายามที่ถูกกว่าแต่ล้มเหลวหลายครั้ง

A Real-World Edge Case: Reasoning Token Cost

K3 ใช้การให้เหตุผลเสมอ ดังนั้นการใช้โทเค็นเอาต์พุตอาจเป็นส่วนสำคัญของบิลค่าใช้จ่าย

ในการ ทดสอบวันเปิดตัวโดย Simon Willison การขอให้ K3 สร้าง SVG ใช้โทเค็นการให้เหตุผล 13,241 โทเค็นก่อนที่จะสร้างโทเค็นคำตอบ 3,417 โทเค็น คิดเป็นค่าใช้จ่ายประมาณ $0.25

นี่เป็นการทดสอบแบบไม่เป็นทางการด้วยพรอมป์ตเดียว ไม่ใช่การวัดผลอย่างเป็นระบบ แต่ชี้ให้เห็นข้อควรคำนึงเรื่องค่าใช้จ่าย: คำตอบสุดท้ายที่มองเห็นอาจเป็นเพียงส่วนหนึ่งของเอาต์พุตที่ถูกคิดค่าใช้จ่าย

เนื่องจากปัจจุบัน K3 รองรับเฉพาะความพยายามในการให้เหตุผลระดับสูงสุด ทีมงานควรวัดการใช้โทเค็นเอาต์พุตจริงในเวิร์กโหลดของตนเอง

A Better Default: K2.7 First, K3 on Escalation

สำหรับงานโค้ดผสม การกำหนดเส้นทางอาจคุ้มค่ากว่าการส่งทุกคำขอไปที่ K3 โดยตรง

กลยุทธ์ง่าย ๆ คือ:

Start with K2.7 Code
        ↓
Task exceeds 256K context?
        → Yes: use K3
        ↓ No
Run task and validation
        ↓
Validation failed?
        → Yes: escalate to K3
        ↓ No
Return result

ใช้ตัวอย่างก่อนหน้า:

  • K2.7 Code มีค่าใช้จ่าย $0.27 ต่อความพยายามแบบ cold
  • K3 มีค่าใช้จ่าย $0.90
  • K2.7 สำเร็จ 70% ของงาน
  • 30% ถูกลองใหม่หนึ่งครั้งบน K3

ค่าใช้จ่ายเฉลี่ยกลายเป็น:

$0.27 + (30% × $0.90) = $0.54 per task

การส่งทุกงานไปที่ K3 โดยตรงจะมีค่าใช้จ่าย $0.90 ต่อภารกิจภายใต้สมมติฐานโทเค็นเดียวกัน

ทำให้กลยุทธ์แบบกำหนดเส้นทางนี้ ถูกกว่า 40% ในสถานการณ์อย่างง่ายนี้

การประหยัดที่แท้จริงจะแตกต่างกันไป แต่หลักการคือมีประโยชน์: ส่งงานประจำไปยังโมเดลที่ถูกกว่า และยกระดับเมื่อความสามารถเพิ่มเติมจำเป็นจริง

When Is Kimi K3 Worth the Upgrade?

K3 น่าพิจารณามากเมื่อ:

  • บริบทที่ต้องการเกินขีดจำกัด 262,144 โทเค็นของ K2.7 Code
  • งานผสานโค้ดกับอินพุตภาพ
  • ตัวแทนที่ทำงานยาวนานต้องทำงานครอบคลังโค้ดขนาดใหญ่และเครื่องมือภายนอก
  • K2.7 ต้องลองใหม่หรือเรียกสำรองบ่อยครั้ง
  • งานมีมูลค่าสูงจนคุณภาพการสำเร็จสำคัญกว่าการลดค่าใช้จ่ายของการเรียกครั้งแรก

K2.7 Code ยังคงเป็นตัวเลือกที่แข็งแกร่งสำหรับงานโค้ดที่ทำซ้ำได้ ขอบเขตชัดเจน และมีอัตราความสำเร็จสูงอยู่แล้วภายในบริบท 256K

สำหรับแอปโค้ดที่ไวต่อเวลา ควรทดสอบ K2.7 Code HighSpeed แยกต่างหากด้วย

Migrating from K2.7 to K3: Five Engineering Checks

  1. K3 Reasoning Cannot Currently Be Reduced

K3 ให้เหตุผลเสมอ และ API ปัจจุบันรองรับเพียง:

reasoning_effort="max"

เนื่องจาก max เป็นค่าเริ่มต้น จึงสามารถละเว้นพารามิเตอร์นี้ได้

  1. Remove K2-Specific thinking Parameters

อย่าใช้พารามิเตอร์ thinking ของ K2.x กับ K3

ให้ใช้ฟิลด์ระดับบนสุด reasoning_effort แทน

  1. Omit Fixed Sampling Parameters

ขณะนี้ K3 ใช้ค่าคงที่สำหรับพารามิเตอร์รวมถึง:

temperature=1.0
top_p=0.95
n=1
presence_penalty=0
frequency_penalty=0

Moonshot แนะนำให้ละเว้นฟิลด์เหล่านี้แทนการ override

  1. Preserve Complete Assistant Messages

สำหรับการสนทนาหลายรอบและลูปการเรียกใช้เครื่องมือ ให้ส่งข้อความ assistant ทั้งฉบับไปยังคำขอถัดไป แทนที่จะเก็บเฉพาะ content ที่มองเห็นได้

  1. Validate Vision and Search Before Production

API ด้านภาพของ K3 ในปัจจุบันยังไม่รองรับ URL รูปภาพสาธารณะโดยตรง ให้ใช้รูปแบบรูปภาพที่รองรับ เช่นข้อมูล base64 หรือกลไกอ้างอิงไฟล์ของ Moonshot

Moonshot ยังแนะนำว่าในระยะใกล้นี้อย่าพึ่งพาฟังก์ชัน Web Search ในงานผลิตระหว่างที่ฟีเจอร์กำลังอัปเดต

Kimi K3 API Example in Python

K3 สามารถเรียกผ่านอินเทอร์เฟซ API ที่เข้ากันได้กับ OpenAI:

from openai import OpenAI

client = OpenAI(
    base_url="YOUR_OPENAI_COMPATIBLE_BASE_URL",
    api_key="YOUR_API_KEY",
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[
        {
            "role": "system",
            "content": "You are an expert software engineer.",
        },
        {
            "role": "user",
            "content": "Analyze this repository logic and identify potential issues.",
        },
    ],
    reasoning_effort="max",  # Optional while "max" is the default
)

assistant_message = response.choices[0].message
print(assistant_message)

หลีกเลี่ยงการ override ค่าคงที่ของพารามิเตอร์การสุ่มตัวอย่างของ K3 สำหรับเวิร์กโฟลว์หลายรอบและการเรียกใช้เครื่องมือ ให้เก็บข้อความ assistant ทั้งฉบับไว้

How to Evaluate Kimi K3 Before Upgrading

ทดสอบ K3 บนเวิร์กโหลดจริง ไม่ใช่เฉพาะพรอมป์ตเบนช์มาร์ก

ชุดการทดสอบที่ใช้ได้จริงอาจรวมถึง:

  • การแก้ไขรีโพทั่วไป
  • งานที่ใกล้ขีดจำกัดบริบท 256K
  • งานที่เกิน 256K
  • งานวิศวกรรมเชิงภาพ
  • งานตัวแทนหรือความรู้ที่กินเวลายาวนาน

เปรียบเทียบ K3, K2.7 Code และ K2.7 Code HighSpeed ตามความเหมาะสม

ติดตาม:

  • อัตราความสำเร็จของงาน
  • โทเค็นอินพุตที่แคชและไม่แคช
  • โทเค็นเอาต์พุตและการให้เหตุผล
  • การลองใหม่และการเรียกสำรอง
  • latency p50 และ p95
  • ข้อผิดพลาดในการเรียกเครื่องมือ
  • เวลาในการตรวจทานของมนุษย์
  • ค่าใช้จ่ายต่อภารกิจที่สำเร็จ

จากนั้นเปรียบเทียบสามนโยบาย:

  1. ทั้งหมดใช้ K2.7 Code
  2. ทั้งหมดใช้ K3
  3. ใช้ K2.7 Code เป็นค่าเริ่มต้น และยกระดับไป K3

เส้นทางที่ดีที่สุดคือเส้นทางที่ตอบโจทย์คุณภาพและ latency ที่ต้องการ ด้วยค่าใช้จ่ายต่อภารกิจที่สำเร็จน้อยที่สุด

Kimi K3 Pricing on CometAPI

การคำนวณข้างต้นใช้อัตราราคา API อย่างเป็นทางการของ Moonshot AI เพื่อให้การเปรียบเทียบ K3 และ K2.7 สอดคล้องกัน

ในขณะที่เผยแพร่ Kimi K3 บน CometAPI มีราคาถูกกว่า 20% เมื่อเทียบกับอัตรามาตรฐานของ Moonshot AI:

เส้นทางอินพุตเอาต์พุต
Moonshot AI$3.00 / 1M$15.00 / 1M
CometAPI$2.40 / 1M$12.00 / 1M

เนื่องจากราคา API อาจเปลี่ยนแปลง กรุณาตรวจสอบหน้ารุ่นแบบสดก่อนใช้ตัวเลขเหล่านี้สำหรับการวางงบประมาณผลิต

API ที่เข้ากันได้กับ OpenAI ของ CometAPI ทำให้ทดสอบ kimi-k3 ควบคู่กับเส้นทางโมเดลอื่น ๆ ได้ง่าย โดยใช้พรอมป์ตและเวิร์กโฟลว์ประเมินเดียวกัน

พร้อมทดสอบ Kimi K3 หรือยัง? ดู Kimi K3 บน CometAPI และเปรียบเทียบราคาก่อนย้ายเข้าสู่การผลิต

สำหรับตัวอย่างการผสานรวมและการประเมินผล ดู CometAPI Cookbook บน GitHub

FAQ

Kimi K3 API มีค่าใช้จ่ายเท่าไร?

Moonshot AI ระบุ Kimi K3 ที่ $0.30 ต่อหนึ่งล้านโทเค็นอินพุตแบบ cache hit, $3.00 ต่อหนึ่งล้านโทเค็นอินพุตแบบ cache miss และ $15.00 ต่อหนึ่งล้านโทเค็นเอาต์พุต

รหัสโมเดล API คือ kimi-k3.

Kimi K3 ถูกกว่า Kimi K2.7 Code หรือไม่?

ไม่ จากอัตราอย่างเป็นทางการของ Moonshot K3 มีราคาประมาณ 3.16× สำหรับอินพุตแบบ cache miss และ 3.75× สำหรับเอาต์พุต

อย่างไรก็ดี อาจลดค่าใช้จ่ายเวิร์กโฟลว์ได้หากช่วยเพิ่มอัตราความสำเร็จของงานหรือ ลดการลองใหม่

Kimi K3 มีหน้าต่างบริบท 1M โทเค็นหรือไม่?

มี Kimi K3 รองรับ หน้าต่างบริบท 1,048,576 โทเค็น เมื่อเทียบกับ 262,144 โทเค็นสำหรับ Kimi K2.7 Code

Kimi K3 รองรับการแคชบริบทอัตโนมัติหรือไม่?

รองรับ การแคชบริบทเป็นแบบอัตโนมัติ โทเค็นอินพุตที่เป็น cache hit มีราคา $0.30 ต่อหนึ่งล้าน เมื่อเทียบกับ $3.00 ต่อหนึ่งล้านสำหรับ cache miss

สามารถปิดการให้เหตุผลของ Kimi K3 เพื่อลดค่าใช้จ่ายได้หรือไม่?

ขณะนี้ยังไม่ได้ K3 ใช้การให้เหตุผลเสมอ และรองรับเพียง reasoning_effort="max"

Final Thoughts

Kimi K3 มอบบริบทที่มากกว่าและความสามารถที่กว้างกว่ารุ่น K2.7 Code อย่างมีนัยสำคัญ แต่แลกกับราคาโทเค็นที่สูงกว่า

สำหรับงานโค้ดทั่วไปภายในบริบท 256K K2.7 Code มักคุ้มค่ากว่า สำหรับงานบริบทยาว มัลติโหมด หรือเอเยนต์ที่ท้าทาย K3 สามารถคุ้มค่ากับส่วนเพิ่ม โดยเฉพาะเมื่อต่อยอดความสำเร็จของงาน

สำหรับหลายระบบในงานผลิต กลยุทธ์ที่มีประสิทธิภาพที่สุดจึงไม่ใช่แทนที่ K2.7 ทั้งหมด แต่คือใช้ K2.7 เป็นค่าเริ่มต้น และยกระดับไป K3 เมื่อจำเป็น

ตัวชี้วัดที่สำคัญที่สุดไม่ใช่ค่าใช้จ่ายต่อการเรียก API แต่คือ ค่าใช้จ่ายต่อภารกิจที่สำเร็จ

พร้อมลดต้นทุนการพัฒนา AI ลง 20% แล้วหรือยัง?

เริ่มต้นฟรีภายในไม่กี่นาที มีเครดิตทดลองใช้ฟรี ไม่ต้องใช้บัตรเครดิต

อ่านเพิ่มเติม