สงคราม AI ปีนี้ไม่ได้แข่งกันแค่ "ใครเก่งสุด" อีกต่อไป แต่กำลังกลายเป็น "ใครคุ้มสุด" ล่าสุดเมื่อ 10 กันยายน 2026 Cognition บริษัทเจ้าของเอเจนต์เขียนโค้ดชื่อดัง Devin ประกาศเปิดตัวโมเดลใหม่ล่าสุดของตัวเองในชื่อ SWE-2
จุดขายที่ Cognition ชูขึ้นมาชัดเจนคือ SWE-2 ทำคะแนนห่างจาก Claude Fable 5.1 ของ Anthropic แค่ไม่ถึง 1 คะแนนบนโจทย์เขียนโค้ดในโลกจริง แต่ค่ารันถูกกว่าถึง 70% นั่นแปลว่านักพัฒนาและทีมเล็ก ๆ ได้ประสิทธิภาพระดับใกล้เคียงรุ่นท็อป ในราคาที่จ่ายไหวขึ้นมาก
เบื้องหลัง: ต่อยอดจากโมเดลโอเพนเวต
SWE-2 ไม่ได้สร้างจากศูนย์ แต่ post-trained มาจาก Kimi K3 โมเดลโอเพนเวตขนาด 2.8 ล้านล้านพารามิเตอร์ ที่ผ่านการฝึกแบบ reinforcement learning มาเน้นงานเขียนโค้ดแบบเอเจนต์อยู่แล้ว จากนั้น Cognition นำมาฝึกต่อเพื่อจูนให้เข้ากับการทำงานจริงบน Devin
โมเดลนี้ถูกปล่อยลงเครื่องมือหลายตัวพร้อมกัน ทั้ง Devin Desktop และ Devin CLI ส่วน Devin Web และ Devin Fusion กำลังทยอยตามมา
ตัวเลขบอกอะไร (และไม่บอกอะไร)
ในตารางเบนช์มาร์กของ Cognition เอง SWE-2 ทำได้ 50.0% บน FrontierCode 1.1 (Fable 5.1 อยู่ที่ 50.9%, GPT-6 Astra 53.3%) และ 73.0% บน DeepSWE 1.1 — สูสีกับรุ่นท็อปจริง ๆ
ที่น่าสนใจกว่าคือเรื่องประสิทธิภาพต่อการทำงาน: Cognition ระบุว่า SWE-2 medium ทำงานเสร็จโดยใช้ ขั้นตอนน้อยลง 58% และ ต้นทุนต่อรอบถูกลง 81% เมื่อเทียบกับ SWE-1.7 รุ่นก่อน
ตัวเลขเบนช์มาร์กมาจากผู้ผลิตเอง และ SWE-2 ก็ไม่ได้ชนะทุกสนาม — บนโจทย์ Terminal-Bench 4 มันทำได้แค่ 27.3% ขณะที่ Fable 5.1 และ Astra อยู่ที่ราว 56-58% เวลาเลือกเครื่องมือจึงควรดูว่างานของเราตรงกับจุดแข็งของโมเดลไหน มากกว่าเชื่อคะแนนรวมอย่างเดียว
แปลว่าอะไรสำหรับคนทั่วไป
แม้จะเป็นข่าวสายนักพัฒนา แต่ทิศทางนี้ส่งผลถึงทุกคน เพราะ เมื่อค่ารันเอเจนต์เขียนโค้ดถูกลงเรื่อย ๆ ต้นทุนการสร้างแอป เว็บ และระบบอัตโนมัติก็จะถูกลงตามไปด้วย เครื่องมือดิจิทัลที่เคยแพงจนธุรกิจเล็กเอื้อมไม่ถึงจะเริ่มเข้าถึงได้ง่ายขึ้นในอีกไม่กี่ปีข้างหน้า
เทรนด์ที่เห็นชัดในปีนี้คือโมเดล AI ราคาถูกลงแต่เก่งขึ้น การแข่งขันดุเดือดระหว่างหลายค่ายทำให้ผู้ใช้ปลายทางได้ประโยชน์ — ทางเลือกมากขึ้น ราคาต่อรองได้มากขึ้น
