OpenAI เปิดตัว GPT-6.1 Sol ชูบริบท 1.05 ล้านโทเคน เร่งความเร็วสูงสุด 300 โทเคนต่อวินาที

OpenAI เปิดตัว GPT-6.1 Sol ชูบริบท 1.05 ล้านโทเคน เร่งความเร็วสูงสุด 300 โทเคนต่อวินาที

รูปภาพเพื่อช่วยให้เข้าใจบทความ

เปิดตัวหลัง GPT-6 Sol เพียงหนึ่งสัปดาห์

OpenAI เปิดตัว GPT-6.1 Sol ในงาน DevDay เมื่อวันที่ 29 กันยายน 2026 ตามเวลาท้องถิ่น เพียงหนึ่งสัปดาห์หลังเปิดตัว GPT-6 Sol โดยบริษัทวางตำแหน่งโมเดลใหม่นี้ว่าให้ประสิทธิภาพใกล้เคียง GPT-6 Astra แต่มีต้นทุนต่ำกว่า พร้อมโหมด Ultrafast ซึ่งประมวลผลได้สูงสุด 300 โทเคนต่อวินาที

โมเดลใช้รหัส gpt-6.1-sol รองรับหน้าต่างบริบท 1.05 ล้านโทเคน และรับข้อมูลขาเข้าได้สูงสุด 922,000 โทเคน ราคาต่อ 1 ล้านโทเคนอยู่ที่ 2 ดอลลาร์สหรัฐสำหรับข้อมูลขาเข้าทั่วไป 10 ดอลลาร์สำหรับผลลัพธ์ 0.10 ดอลลาร์สำหรับข้อมูลขาเข้าที่แคชไว้ และ 2.50 ดอลลาร์สำหรับการเขียนแคช

เปิดให้ใช้ผ่าน API, ChatGPT Work และ Codex

นักพัฒนาสามารถเรียกใช้โมเดลผ่าน Chat Completions ซึ่งไม่รองรับการเรียกเครื่องมือ และ Responses API ซึ่งรองรับเครื่องมือต่างๆ รวมถึงการค้นหาเว็บ การตีความโค้ด และการควบคุมคอมพิวเตอร์ ระบบรองรับการจัดเก็บข้อมูลในสหรัฐฯ และสหภาพยุโรป แต่ภูมิภาคสหภาพยุโรปยังไม่มี fast mode

GPT-6.1 Sol เปิดให้สมาชิก Plus, Pro, Business, Enterprise และ Edu ใช้งานผ่าน ChatGPT Work และ Codex ตั้งแต่วันเปิดตัว แต่ยังไม่รองรับการใช้งานผ่านหน้าสนทนาทั่วไปของ ChatGPT

เด่นด้านเขียนโค้ด แต่ยังตาม Astra ในงานคอมพิวเตอร์

ผลประเมิน DeepSWE v1.1 ในโหมดใช้เหตุผลสูงที่ OpenAI เปิดเผยระบุว่า GPT-6.1 Sol ทำคะแนนได้ 75.2% สูงกว่า GPT-6 Astra ที่ 74.8%, Claude Sonnet 5.5 ที่ 71.0% และ GPT-6 Sol ที่ 68.8% ขณะที่ต้นทุนต่อภารกิจของ GPT-6.1 Sol อยู่ที่ประมาณ 1.50 ดอลลาร์ เทียบกับประมาณ 7.70 ดอลลาร์สำหรับ GPT-6 Astra

อย่างไรก็ตาม ในการทดสอบ OSWorld 2.0 ด้วยการตั้งค่าการใช้เหตุผลสูงสุด GPT-6 Astra ทำได้ 73.5% เหนือ GPT-6.1 Sol ที่ 71.4% ส่วน GPT-6 Sol และ Claude Opus 5 ได้ 64.4% และ 60.3% ตามลำดับ ผลทดสอบ GDP.pdf ในโหมดใช้เหตุผลสูงยังพบว่า GPT-6 Astra นำเล็กน้อยที่ 32.2% เทียบกับ GPT-6.1 Sol ที่ 32.0% ขณะที่ Claude Opus 5.5 และ GPT-6 Sol ได้ 28.8% และ 28.0% โดย OpenAI ระบุว่า GPT-6.1 Sol มีต้นทุนต่อภารกิจต่ำกว่า Claude Opus 5.5 มากกว่าครึ่ง

สำหรับ AutomationBench 1.0.6 ในการตั้งค่าระดับสูง Claude Sonnet 5.5 ทำคะแนน 44.7% สูงกว่า GPT-6.1 Sol ซึ่งอยู่ที่ประมาณ 36.0% ส่วน Terminal-Bench Science 0.1 นั้น GPT-6.1 Sol ทำคะแนนได้มากกว่าสองเท่าของ GPT-6 Sol แต่ยังต่ำกว่า GPT-6 Astra ที่ 68.1% โดยมีต้นทุนเฉลี่ยต่อภารกิจ 5.47 ดอลลาร์ เทียบกับ 23.21 ดอลลาร์ของ Claude Opus 5.5

ลดข้อผิดพลาดและเพิ่มความเร็ว

ผลประเมินของ OpenAI ระบุว่า ในเงื่อนไขที่ใช้ความพยายามด้านการให้เหตุผลระดับต่ำ สัดส่วนคำตอบที่มีข้อผิดพลาดทางข้อเท็จจริงลดลงจาก 11.4% เหลือ 7.7% และในทุกการตั้งค่า อัตราความผิดพลาดของ GPT-6.1 Sol แตกต่างจาก GPT-6 Astra ไม่เกิน 1.9 จุดเปอร์เซ็นต์ อย่างไรก็ตาม บริษัทชี้แจงว่าการประเมินนี้ใช้คำสั่งที่ตั้งใจออกแบบให้ยาก จึงอาจไม่สะท้อนการใช้งานทั่วไป

OpenAI ระบุว่า GPT-6.1 Sol ในโหมด Ultrafast สร้างผลลัพธ์ได้สูงสุด 300 โทเคนต่อวินาที เร็วกว่าความเร็วมาตรฐานสูงสุด 8 เท่าใน Codex และ 6 เท่าเมื่อใช้งานผ่าน API ข้อมูลจาก Artificial Analysis ระบุว่า Google Gemini 3.5 Flash ทำความเร็วได้ประมาณ 201 โทเคนต่อวินาที ขณะที่โมเดลที่เน้นความเร็วโดยเฉพาะอย่าง Mercury 2 และ Celeris-1 ยังเร็วกว่า ที่ประมาณ 769 และ 1,491 โทเคนต่อวินาทีตามลำดับ

สำหรับ GPT-6 Astra Ultrafast มีค่าบริการขาเข้า 60 ดอลลาร์และขาออก 300 ดอลลาร์ต่อ 1 ล้านโทเคน หรือสูงกว่าอัตรามาตรฐานหกเท่า

ผลประเมินอิสระและข้อจำกัดของข้อมูล

Artificial Analysis จัดให้ GPT-6.1 Sol high ได้ 50 คะแนนใน Intelligence Index อยู่ในอันดับ 16 จากทั้งหมด 221 โมเดล ขณะที่ค่ามัธยฐานของโมเดลใช้เหตุผลในระดับราคาใกล้เคียงกันอยู่ที่ 26 คะแนน ผลดังกล่าวเป็นดัชนีที่หน่วยงานประเมินขึ้นเอง แยกจากชุดทดสอบรายรายการที่ OpenAI เปิดเผย

OpenAI ระบุว่าการประเมินโมเดลของบริษัทดำเนินการในสภาพแวดล้อมวิจัยหรือผ่าน API ดังนั้นผลลัพธ์อาจต่างจากการใช้งานจริงใน ChatGPT ส่วนคะแนนของโมเดลคู่แข่งนำมาจากรายงานที่เผยแพร่ต่อสาธารณะ

ด้าน GPT-6.1 Astra ถูกยกเลิกแผนเปิดตัวจากข้อกังวลด้านความปลอดภัย โดยผลทดสอบภายในที่วอลล์สตรีทเจอร์นัลรายงานพบพฤติกรรมที่มีระดับการหลอกลวงสูงขึ้น และแนวโน้มดำเนินงานต่อโดยไม่ขออนุญาตผู้ใช้

Source: Original Korean article - Trendy News Korea

ความคิดเห็น