DeepSeek ปล่อยน้ำหนัก (weights) ของโมเดลรุ่นใหม่ V4 Flash 0731 ออกสู่สาธารณะเมื่อ 31 กรกฎาคม 2026 พร้อมเปิดใช้งานผ่าน API แบบ public beta โดยจุดที่คนในวงการจับตาคือ มันเป็นโมเดล open-weight ที่ทำคะแนนติดท็อป 3 ของโลก แต่ราคาถูกจนน่าตกใจ
เกิดอะไรขึ้น
V4 Flash คือรุ่น "เล็กเร็ว" ตัวแรกในไลน์อัพสองชั้นของ DeepSeek (คู่กับรุ่นใหญ่ V4 Pro) โดยมีรายละเอียดสำคัญดังนี้:
- สถาปัตยกรรมแบบ MoE ขนาดรวม 284 พันล้านพารามิเตอร์ แต่เปิดใช้งานจริงเพียง 13 พันล้าน ต่อครั้ง ทำให้เร็วและประหยัดต้นทุนประมวลผล
- ปล่อยน้ำหนักภายใต้สัญญาอนุญาต MIT — ใครก็เอาไปใช้เชิงพาณิชย์หรือดัดแปลงได้เต็มที่ ไม่มีข้อจำกัด
- ทำคะแนน 50 บน Artificial Analysis Intelligence Index จัดอยู่ในกลุ่ม ท็อป 3 ของโมเดล open-weight บนกระดานจัดอันดับ
- ราคาผ่าน API อยู่ที่ $0.14 สำหรับ input และ $0.28 สำหรับ output ต่อล้าน token (ถ้า cache-hit เหลือ $0.0028)
รุ่น 0731 นี้ยังใช้สถาปัตยกรรมเดิมของ V4 Flash แต่ผ่านการฝึกซ้ำ (re-post-training) ที่ดันคะแนนงานสาย agentic การเขียนโค้ด และการเรียกใช้เครื่องมือ (tool-calling) ให้ แซงรุ่น V4 Pro Preview ที่ใหญ่กว่าได้
แปลว่าอะไร
ที่ผ่านมาโมเดลเก่งสุดมักเป็นแบบปิดของเจ้าใหญ่ แต่การที่โมเดลเปิดตัวเล็กทำคะแนน agentic แซงพี่ใหญ่ในค่ายเดียวกันได้ สะท้อนว่า ช่องว่างระหว่างโมเดลเปิดกับโมเดลปิดกำลังแคบลงเรื่อย ๆ และต้นทุนต่อ token ก็ถูกลงอย่างรวดเร็ว
"open-weight" หมายถึงบริษัทเปิดให้ดาวน์โหลดน้ำหนักของโมเดลไปรันเองได้ — ต่างจาก "open-source" เต็มรูปแบบที่เปิดทั้งข้อมูลและกระบวนการฝึก แต่ MIT license ก็ให้อิสระใช้เชิงพาณิชย์ได้จริง
สำหรับบริบทไทย ธุรกิจที่รันแชตบอตบน LINE หรืองานปริมาณมาก เช่น สรุปเอกสาร คัดแยกข้อความ ยิ่งต้นทุนต่อ token ต่ำก็ยิ่งทำงานหนัก ๆ ได้คุ้มขึ้น และการเป็น open-weight ยังเปิดทางให้ผู้ที่ต้องการเก็บข้อมูลไว้ในระบบตัวเอง (self-host) เพื่อความเป็นส่วนตัว
คะแนน benchmark ไม่เท่ากับผลงานในงานจริงของคุณเสมอไป และการรันโมเดล open-weight เองก็ต้องมีเครื่อง GPU และทีมดูแล — ธุรกิจเล็กส่วนใหญ่ยังสะดวกเรียกผ่าน API มากกว่า
