OpenAI เปิดตัว GPT-6 Sol และ Luna ลดราคา API ชูจุดเด่นงานเขียนโค้ดและงานสำนักงาน

OpenAI เปิดตัว GPT-6 Sol และ Luna ลดราคา API ชูจุดเด่นงานเขียนโค้ดและงานสำนักงาน

รูปภาพเพื่อช่วยให้เข้าใจบทความ

OpenAI เปิดตัว GPT-6 Sol และ GPT-6 Luna เมื่อวันที่ 22 กันยายน 2026 ตามเวลาท้องถิ่น โดยระบุว่าได้นำแนวทางการฝึกโมเดลที่ใกล้เคียงกับ GPT-6 Astra มาใช้ เพื่อถ่ายทอดความสามารถด้านงานวิชาชีพ ความถูกต้องของข้อมูล การเขียนโค้ด การใช้งานคอมพิวเตอร์ และการปรับพฤติกรรมโมเดล ไปสู่ผลิตภัณฑ์ที่ทำงานได้เร็วขึ้นและมีต้นทุนต่ำลง

GPT-6 Sol ถูกวางตำแหน่งสำหรับงานเขียนโปรแกรมที่ซับซ้อน ส่วน GPT-6 Luna มุ่งเน้นงานสำนักงาน การสรุปเนื้อหา และการดึงข้อมูลจากเอกสาร

ลดราคา API พร้อมเปิดใช้ผ่าน ChatGPT และ Codex

ค่าบริการ API ของ GPT-6 Sol อยู่ที่ 2 ดอลลาร์สหรัฐต่อโทเคนขาเข้า 1 ล้านโทเคน และ 10 ดอลลาร์ต่อโทเคนขาออก 1 ล้านโทเคน ซึ่ง OpenAI ระบุว่าต่ำกว่าราคาโปรโมชันของ GPT-5.6 ราว 50% ส่วน GPT-6 Luna ลดราคาขาเข้าจาก 0.20 ดอลลาร์เหลือ 0.10 ดอลลาร์ และลดราคาขาออกจาก 1.20 ดอลลาร์เหลือ 0.50 ดอลลาร์ต่อ 1 ล้านโทเคน

นักพัฒนาสามารถเรียกใช้โมเดลผ่านรหัส gpt-6-sol และ gpt-6-luna ได้ตั้งแต่วันประกาศ ขณะที่ผู้ใช้แพ็กเกจ Plus, Pro, Business, Enterprise และ Edu สามารถเข้าถึงทั้งสองโมเดลผ่าน ChatGPT Work และ Codex ส่วนผู้ใช้ Free และ Go ใช้ GPT-6 Luna ได้ผ่านแอปเดสก์ท็อป อย่างไรก็ตาม MacRumors รายงานว่าในช่วงเปิดตัว โมเดลทั้งสองยังไม่เปิดให้ใช้งานใน Chat mode

ด้าน GitHub เตรียมทยอยนำทั้งสองโมเดลเข้าสู่ GitHub Copilot บน VS Code, Visual Studio, Copilot CLI, คลาวด์เอเจนต์, แอป Copilot, github.com, GitHub Mobile, JetBrains, Xcode และ Eclipse โดย Sol รองรับแพ็กเกจ Copilot Pro+, Max, Business และ Enterprise ส่วน Luna รองรับตั้งแต่ Pro ขึ้นไป รวมถึงแพ็กเกจสำหรับองค์กร

OpenAI ชูต้นทุนต่อภารกิจลดลง

ผลประเมินที่ OpenAI เปิดเผยระบุว่า GPT-6 Sol ทำคะแนน AutomationBench ที่ระดับ xhigh effort ได้ 33.2% ด้วยต้นทุน 0.27 ดอลลาร์ต่อภารกิจ และทำคะแนน Agents' Last Exam ที่ระดับ max effort ได้ 56.4% ส่วนการทดสอบ DeepSWE v1.1 ที่ระดับ max effort ให้คะแนน Sol 68.8% และ Luna 66.6% ขณะที่ Claude Fable 5 ทำได้ 69.9% ที่ระดับ xhigh effort ซึ่งสูงกว่า Sol

สำหรับ OSWorld 2.0 แบบออฟไลน์ GPT-6 Sol ที่ระดับ xhigh effort ทำได้ 60.5% เทียบกับ Claude Opus 5 ที่ระดับ medium effort ซึ่งทำได้ 60.3% โดย OpenAI ระบุว่า Sol ให้คะแนนใกล้เคียงกันด้วยต้นทุนต่อภารกิจต่ำกว่าประมาณ 80% บริษัทอ้างด้วยว่า GPT-6 Luna ที่ตั้งค่า max สามารถทำคะแนนเหนือ GPT-5.6 Sol ที่ระดับ medium โดยใช้ต้นทุนเพียงหนึ่งในสิบ

OpenAI ยังระบุว่าผลประเมินภายในด้านความถูกต้องพบข้อผิดพลาดของ Sol น้อยกว่า GPT-5.6 Sol ประมาณครึ่งหนึ่ง การทดสอบดังกล่าวใช้บทสนทนาจริงที่ผ่านการลบข้อมูลระบุตัวตน แต่ไม่มีผลตรวจสอบจากบุคคลที่สามแนบมากับประกาศ บริษัทชี้แจงว่าบทสนทนาที่คัดมาเน้นกรณีซึ่งก่อให้เกิดข้อผิดพลาด จึงไม่ใช่ตัวแทนของการใช้งานทั่วไปที่พบความผิดพลาดด้านข้อเท็จจริงน้อยกว่า เช่นเดียวกับการประเมินเอเจนต์และการเขียนโค้ดที่ออกแบบมาให้ทดสอบสถานการณ์ยาก ไม่ได้ใช้วัดอัตราความล้มเหลวในการใช้งานตามปกติ

ผลอิสระสะท้อนทั้งจุดแข็งและจุดถอย

Artificial Analysis รายงานว่า Coding Agent Index ของ GPT-6 Sol ที่ระดับ max เพิ่มจาก 55 เป็น 57 คะแนนเมื่อเทียบกับ GPT-5.6 Sol แต่ GPT-6 Luna ลดจาก 43 เหลือ 41 คะแนน ส่วน AA-Omniscience Index ของ Sol เพิ่มจาก 22 เป็น 27 คะแนน และ Luna เพิ่มจาก -10 เป็น 1 คะแนน อัตราการสร้างข้อมูลคลาดเคลื่อนตามดัชนีนี้ลดจาก 92% เหลือ 60% สำหรับ Sol และจาก 93% เหลือ 77% สำหรับ Luna

Terminal-Bench 4.0 ของ Sol เพิ่มจาก 40% เป็น 44% และ Luna เพิ่มจาก 12% เป็น 13% ขณะที่ AutomationBench-AA เพิ่มจาก 60% เป็น 62% สำหรับ Sol และจาก 50% เป็น 53% สำหรับ Luna

อย่างไรก็ดี GDPval-AA v2.1 ของ Sol ลดลงราว 100 Elo และ Luna ลดลงราว 75 Elo ส่วน AA-Briefcase v1.1 พบว่า Luna ลดลงประมาณ 45 Elo ขณะที่ Sol ทรงตัว Artificial Analysis วิเคราะห์ว่าคะแนนที่ลดลงเกิดจากคุณภาพการนำเสนอและการขาดองค์ประกอบบางส่วนตามเกณฑ์ประเมิน มากกว่าจะเป็นการสูญเสียความสามารถพื้นฐาน

ข้อมูลของสถาบันเดียวกันระบุว่า ต้นทุนต่อภารกิจที่ระดับ max ของ Sol ลดลงเหลือ 1.06 ดอลลาร์ หรือราวครึ่งหนึ่ง ส่วน Luna ลดลงประมาณ 60% เหลือ 0.07 ดอลลาร์ แต่คะแนน Intelligence Index โดยรวมของ Sol เพิ่มเพียง 1 คะแนน และ Luna ไม่เปลี่ยนแปลง

Anthropic เปิด Claude Opus 5.5 ก่อนหน้าเพียง 90 นาที

การแข่งขันในตลาดโมเดลปัญญาประดิษฐ์ร้อนแรงขึ้นในวันเดียวกัน เมื่อ Anthropic เปิดตัว Claude Opus 5.5 ก่อนการประกาศ GPT-6 Sol และ Luna ราว 90 นาที โดย MacRumors รายงานว่า Claude Opus 5.5 ทำผลงานเหนือ GPT-6 Astra ในงานเขียนโค้ดและงานความรู้บางประเภท ทำให้การเปรียบเทียบต้นทุนต่อภารกิจระหว่างโมเดลมีความซับซ้อนมากขึ้น

ภาพรวมผลทดสอบจึงไม่ได้ชี้ไปในทิศทางเดียว แม้ GPT-6 Sol จะมีตัวชี้วัดการเขียนโค้ดจากองค์กรอิสระและต้นทุนที่ดีขึ้นจากรุ่นก่อน แต่ GPT-6 Luna กลับมีคะแนน Coding Agent Index ลดลง ขณะที่ทั้งสองโมเดลถอยหลังใน GDPval-AA และผล DeepSWE v1.1 ที่ OpenAI เปิดเผยเองยังแสดงให้เห็นว่า Claude Fable 5 ทำคะแนนสูงกว่า GPT-6 Sol เล็กน้อย

Source: Original Korean article - Trendy News Korea

ความคิดเห็น