ข้อกำหนดทาง技术ของ gpt-oss-20b-free
| ข้อกำหนด | gpt-oss-20b |
|---|---|
| ผู้ให้บริการ | OpenAI |
| ตระกูลโมเดล | gpt-oss โมเดล open-weight สำหรับงานให้เหตุผล |
| โมเดล | gpt-oss-20b-free |
| Model ID ใน CometAPI | gpt-oss-20b-free |
| สถาปัตยกรรม | Mixture of Experts (MoE) |
| พารามิเตอร์ทั้งหมด | 21B |
| พารามิเตอร์ที่ใช้งาน | 3.6B |
| หน้าต่างบริบท | 131,072 โทเค็น |
| โทเค็นผลลัพธ์สูงสุด | 131,072 |
| อินพุต / เอาต์พุต | รับข้อความเข้า ส่งข้อความออก |
| ระดับการให้เหตุผล | ต่ำ, ปานกลาง, สูง |
| ใบอนุญาต | Apache 2.0 โดยขึ้นอยู่กับนโยบายการใช้งาน gpt-oss |
| การเรียกใช้ฟังก์ชัน | รองรับ |
| เอาต์พุตแบบมีโครงสร้าง | รองรับ |
| สตรีมมิง | รองรับ |
| ไฟน์จูน | รองรับผ่านเครื่องมือ/โครงสร้างพื้นฐานแบบเปิด |
| เป้าหมายการปรับใช้แบบเนทีฟ | โลคอล, เอดจ์, โครงสร้างพื้นฐานส่วนตัว หรือการอนุมานแบบโฮสต์ |
| ขอบเขตความรู้สิ้นสุดที่ | June 1, 2024 |
gpt-oss-20b คืออะไร?
gpt-oss-20b เป็นโมเดลให้เหตุผลแบบ open-weight ขนาดเล็กกว่าในตระกูล gpt-oss ของ OpenAI โดยเฉพาะอย่างยิ่ง, CometAPI ยังให้ใช้งาน gpt-oss-20b ได้ฟรี โดยมี ID คือ gpt-oss-20b-free. โมเดลนี้มีพารามิเตอร์ทั้งหมด 21 พันล้าน แต่เปิดใช้งานประมาณ 3.6 พันล้านพารามิเตอร์ต่อการวิ่งแบบ forward pass โดยใช้สถาปัตยกรรม Mixture-of-Experts เพื่อลดความต้องการด้านการอนุมาน ในขณะที่ยังคงความสามารถในการให้เหตุผลไว้ได้มาก OpenAI วางตำแหน่งให้เหมาะกับงานที่ต้องการความหน่วงต่ำ ใช้งานโลคอล และงานเฉพาะทาง มากกว่าที่จะเป็นตัวแทนแทนโมเดลเชิงพาณิชย์ขนาดใหญ่ที่สุดของตน
โมเดลนี้รองรับเฉพาะข้อความ และถูกออกแบบมาสำหรับเวิร์กโฟลว์ด้านการให้เหตุผลและเชิงตัวแทน น้ำหนักแบบเปิดสามารถดาวน์โหลด ปรับแต่ง ไฟน์จูน และปรับใช้บนโครงสร้างพื้นฐานที่นักพัฒนาควบคุมได้ OpenAI และ Hugging Face จัดทำเอกสารการควอนไทซ์แบบ MXFP4 ดั้งเดิมที่ทำให้โมเดลรันได้ภายในหน่วยความจำประมาณ 16 GB ซึ่งถือว่าเข้าถึงได้ง่ายผิดปกติสำหรับโมเดลในคลาสพารามิเตอร์นี้
คุณสมบัติหลักของ gpt-oss-20b
- สถาปัตยกรรม MoE ที่มีประสิทธิภาพ: พารามิเตอร์รวม 21B แต่ใช้งานเพียง 3.6B ต่อการวิ่ง ช่วยลดความหน่วงและข้อกำหนดด้านการปรับใช้
- การให้เหตุผลแบบปรับแต่งได้: นักพัฒนาสามารถเลือกความพยายามในการให้เหตุผลเป็นต่ำ ปานกลาง หรือสูง เพื่อแลกเปลี่ยนระหว่างความหน่วงและทรัพยากรคำนวณกับคุณภาพการให้เหตุผล
- การใช้เครื่องมือแบบเชิงตัวแทน: โมเดลรองรับเวิร์กโฟลว์ที่มีการเรียกใช้ฟังก์ชัน การท่องเว็บ การรัน Python และเอาต์พุตแบบมีโครงสร้าง เมื่อรันไทม์ที่ให้บริการเปิดให้ใช้เครื่องมือเหล่านั้น
- การปรับแต่งแบบ open-weight: ใบอนุญาต Apache 2.0 อนุญาตให้แก้ไขและใช้งานเชิงพาณิชย์ได้อย่างกว้างขวาง โดยขึ้นอยู่กับนโยบายการใช้งาน gpt-oss
- การปรับใช้แบบโลคอลและส่วนตัว: โมเดลถูกออกแบบให้รันบนโครงสร้างพื้นฐานที่นักพัฒนาควบคุม รวมถึงสภาพแวดล้อมโลคอลหรือส่วนตัว
- บริบทยาว: เอกสารเวอร์ชันผลิตจริงระบุหน้าต่างบริบท 131,072 โทเค็น และขีดจำกัดโทเค็นผลลัพธ์สูงสุด 131,072
ผลการทดสอบมาตรฐานของ gpt-oss-20b
ผลการประเมินที่ OpenAI เผยแพร่แสดงให้เห็นว่า gpt-oss-20b โดดเด่นด้านการให้เหตุผลทางคณิตศาสตร์และการเขียนโค้ดเมื่อเทียบกับขนาดของมัน เมื่อใช้ระดับการให้เหตุผลสูงร่วมกับเครื่องมือ โมเดลทำได้ 98.7% บน AIME 2025, 96.0% บน AIME 2024, 60.7% บน SWE-Bench Verified, และ 54.8% บน Tau-Bench Retail สำหรับการประเมินด้านความรู้และการให้เหตุผล OpenAI รายงาน 85.3% บน MMLU, 71.5% บน GPQA Diamond โดยไม่ใช้เครื่องมือ, และ 17.3% บน Humanity's Last Exam เมื่อใช้เครื่องมือ ผลลัพธ์จะแตกต่างกันมากตามระดับความพยายามด้านการให้เหตุผลและการเข้าถึงเครื่องมือ ดังนั้นตัวเลขเหล่านี้ไม่ควรถูกตีความว่าเป็นอัตราความแม่นยำสำหรับการใช้งานจริงเสมอไป
| เบนช์มาร์ก | ผลลัพธ์ของ gpt-oss-20b | เงื่อนไขการประเมิน |
|---|---|---|
| AIME 2024 | 96.0% | ระดับการให้เหตุผลสูง พร้อมเครื่องมือ |
| AIME 2025 | 98.7% | ระดับการให้เหตุผลสูง พร้อมเครื่องมือ |
| GPQA Diamond | 71.5% | ระดับการให้เหตุผลสูง ไม่มีเครื่องมือ |
| MMLU | 85.3% | ระดับการให้เหตุผลสูง |
| SWE-Bench Verified | 60.7% | ระดับการให้เหตุผลสูง |
| Tau-Bench Retail | 54.8% | ระดับการให้เหตุผลสูง |
| Humanity's Last Exam | 17.3% | ระดับการให้เหตุผลสูง พร้อมเครื่องมือ |
การเปรียบเทียบของ OpenAI เองจัดให้ gpt-oss-20b อยู่ใกล้กับ o3-mini ในหลายหมวดการประเมิน ในขณะที่ gpt-oss-120b ซึ่งใหญ่กว่ามักได้เปรียบบนงานที่ต้องการความรู้กว้างและเวิร์กโฟลว์เชิงตัวแทนมากกว่า
gpt-oss-20b เทียบกับ gpt-oss-120b และ o3-mini
| โมเดล | ข้อได้เปรียบหลัก | บริบท | เหมาะที่สุดสำหรับ |
|---|---|---|---|
| gpt-oss-20b | โมเดลให้เหตุผลแบบ open-weight ที่มีประสิทธิภาพ | 131K | การอนุมานโลคอล การเขียนโค้ด คณิตศาสตร์ เอเยนต์เฉพาะทาง |
| gpt-oss-120b | ความสามารถโดยรวมที่สูงกว่า | 131K | งานให้เหตุผลที่ซับซ้อนกว่าและเวิร์กโหลดระดับผลิตจริง |
| o3-mini | โมเดลให้เหตุผลแบบ proprietary | แตกต่างตามการปรับใช้ | เวิร์กโฟลว์แบบจัดการที่ไม่ต้องการน้ำหนักเปิด |
ความแตกต่างเชิงปฏิบัติอยู่ที่การควบคุมการปรับใช้ gpt-oss-20b เหมาะกว่าสำหรับกรณีที่นักพัฒนาต้องการน้ำหนักเปิด การรันแบบโลคอล/ส่วนตัว การปรับแต่ง หรือฮาร์ดแวร์ที่ต้องการไม่สูงมาก ส่วน gpt-oss-120b เหมาะกว่าเมื่อความสามารถด้านความรู้และการให้เหตุผลที่สูงกว่ามีความสำคัญเพียงพอที่จะยอมรับรอยเท้าการปรับใช้ที่ใหญ่ขึ้น
ข้อจำกัดของ gpt-oss-20b
gpt-oss-20b รองรับเฉพาะข้อความ และไม่รับอินพุตแบบภาพ เสียง หรือวิดีโอโดยกำเนิด จำนวนพารามิเตอร์ที่เล็กกว่ายังทำให้เกิดช่องว่างด้านประสิทธิภาพในบางการประเมินที่เน้นความรู้และเวิร์กโฟลว์เชิงตัวแทนเมื่อเทียบกับ gpt-oss-120b นอกจากนี้ การปรับใช้แบบ open-weight ยังโยนภาระด้านปฏิบัติการไปยังนักพัฒนามากขึ้น: การโฮสต์ สเกล มอนิटर ควบคุมความปลอดภัย และการกำหนดค่ารันไทม์ จะไม่ถูกจัดการในแบบเดียวกับ API เชิงพาณิชย์ที่มีการจัดการ
OpenAI ยังระบุว่าโมเดลน้ำหนักเปิดมีโปรไฟล์ด้านความปลอดภัยที่แตกต่างจากโมเดลแบบโฮสต์ เพราะนักพัฒนาสามารถแก้ไขหรือไฟน์จูนเวทได้ ดังนั้นการปรับใช้ในงานผลิตจริงควรเพิ่มกลไกระดับแอปพลิเคชันสำหรับความปลอดภัยและการควบคุมการเข้าถึงอย่างเหมาะสม
กรณีการใช้งานของ gpt-oss-20b
- ผู้ช่วยเขียนโค้ดแบบโลคอล ที่นักพัฒนาต้องการการให้เหตุผลและการสร้างโค้ดโดยไม่ต้องส่งโค้ดไปยังโมเดลที่โฮสต์แบบเป็นกรรมสิทธิ์
- การให้เหตุผลเชิงคณิตศาสตร์และเทคนิค ที่สามารถเปิดระดับการให้เหตุผลสูงสำหรับโจทย์ที่ยาก
- เวิร์กโหลดระดับองค์กรแบบส่วนตัว ที่ต้องปรับใช้ภายในสภาพแวดล้อมที่ควบคุมได้
- เอเยนต์ที่ใช้เครื่องมือ ซึ่งผสานการเรียกใช้ฟังก์ชัน การรัน Python การค้นเว็บ หรือเครื่องมือเฉพาะแอปพลิเคชัน
- ผู้ช่วยเฉพาะโดเมนที่ผ่านการไฟน์จูน ที่น้ำหนักเปิดมีคุณค่ามากกว่าการเข้าถึงโมเดลเชิงพาณิชย์แบบมีการจัดการ
- การอนุมานภายใต้ข้อจำกัดด้านทรัพยากร ที่เป้าหมายหน่วยความจำราว 16 GB ที่เปิดได้ด้วยการควอนไทซ์ MXFP4 มีความสำคัญ
การเข้าถึง gpt-oss-20b ผ่าน CometAPI
ปัจจุบัน CometAPI แสดงรายการ gpt-oss-20b-free เป็นโมเดลของ OpenAI และอธิบายว่าเป็นโมเดล MoE แบบโอเพนซอร์สที่มีพารามิเตอร์รวม 21B พารามิเตอร์ที่ใช้งาน 3.6B และบริบทในชั้น 128K ให้ใช้งานได้ฟรี และเปิดให้เข้าถึงโมเดลผ่าน API แบบรวมของ CometAPI โดยบันทึกการเปลี่ยนแปลงของ CometAPI ระบุว่าโมเดลนี้ปฏิบัติตามรูปแบบมาตรฐานการแชตของ OpenAI
สำหรับการผสานการทำงานกับ CometAPI เวิร์กโฟลว์ทั่วไปคือสร้างคีย์ CometAPI ใช้ base URL ของ CometAPI และส่งชื่อโมเดลในคำขอ เอกสารของ CometAPI รองรับการผสานที่ใช้ร่วมกับ OpenAI SDK และปัจจุบันระบุ https://api.cometapi.com/v1 เป็น base URL สำหรับเริ่มต้นแบบรวดเร็ว