xAI เปิดตัว Grok 4.7 รองรับบริบท 500,000 โทเคน รับข้อมูลทั้งข้อความและภาพ

xAI เปิดตัว Grok 4.7 รองรับบริบท 500,000 โทเคน รับข้อมูลทั้งข้อความและภาพ

รูปภาพเพื่อช่วยให้เข้าใจบทความ

xAI เปิดตัว Grok 4.7 เมื่อวันที่ 21 กันยายน 2026 ตามเวลาท้องถิ่น โดยระบุว่าโมเดลรุ่นใหม่ทำคะแนนเหนือ Grok 4.6 ในการประเมินหลายด้าน รวมถึงงานเขียนโค้ด พร้อมกำหนดค่าบริการพื้นฐานที่ 2 ดอลลาร์สหรัฐต่อโทเคนขาเข้า 1 ล้านโทเคน และ 6 ดอลลาร์ต่อโทเคนขาออก 1 ล้านโทเคน ส่วนรุ่น Fast ซึ่งเพิ่มความเร็วในการตอบเป็นสองเท่า มีราคาเพิ่มเป็นสองเท่าเช่นกัน

หน้าต่างบริบทขนาดใหญ่และรองรับภาพ

เอกสารของ xAI ระบุรหัสโมเดลว่า grok-4.7 มีหน้าต่างบริบท 500,000 โทเคน รองรับข้อมูลขาเข้าทั้งข้อความและภาพ แต่สร้างผลลัพธ์ได้เฉพาะข้อความ ผู้ใช้สามารถเลือกระดับการใช้เหตุผลได้ตั้งแต่ Low, medium, high และ xhigh โดยตั้งค่าเริ่มต้นไว้ที่ high

Grok 4.7 เปิดให้ใช้งานผ่าน Cursor และ Grok Build รวมถึง Grok API เครื่องมือสำหรับงานเขียนโค้ดของผู้ให้บริการภายนอก ระบบเลือกเส้นทางโมเดล และแพลตฟอร์มคลาวด์ต่าง ๆ

ผลทดสอบของ xAI ชี้ว่าดีขึ้นจากรุ่นก่อน

ตามตารางประเมินที่ xAI เผยแพร่ Grok 4.7 ทำคะแนน CursorBench 4.0 ที่ 46.3%, EEBench 64.0%, AA Briefcase v1.1 ที่ 1,657 คะแนน, Terminal-Bench 4.0 ที่ 37.6% และ Harvey Legal Agent 19.6% สูงกว่า Grok 4.6 ซึ่งทำได้ 40.4%, 53.0%, 1,546 คะแนน, 20.3% และ 15.8% ตามลำดับ

อย่างไรก็ตาม Fable 5.1 ยังทำคะแนนเหนือ Grok 4.7 ใน CursorBench 4.0, AA Briefcase v1.1 และ Terminal-Bench 4.0 ที่ 51.8%, 1,678 คะแนน และ 57.9% ตามลำดับ ขณะที่ Grok 4.7 มีผลดีกว่าใน EEBench และ Harvey Legal Agent ซึ่ง Fable 5.1 ทำได้ 56.4% และ 6.7%

สำหรับ DeepSWE v1.1 ภายใต้การตั้งค่า high effort โมเดลใหม่ของ xAI ได้ 71.0% สูงกว่า Grok 4.6 ที่ 65.2% และ Fable 5.1 ที่ 70.0% แต่ยังตามหลัง GPT-5.6 Sol ที่ 72.7% ส่วน HealthBench Professional นั้น Grok 4.7 ได้ 56.7% ต่ำกว่า GPT-5.6 Sol ที่ 60.5% และ Fable 5.1 ที่ 62.1%

ผลประเมินอิสระสะท้อนข้อแลกเปลี่ยนด้านต้นทุนและความเร็ว

Artificial Analysis ให้ Grok 4.7 ในโหมด xhigh ได้ 46 คะแนนใน Intelligence Index อยู่ในอันดับ 21 จาก 212 โมเดล ความเร็วที่วัดได้อยู่ที่ 39.2 โทเคนต่อวินาที ต่ำกว่าค่ากลางของกลุ่มเปรียบเทียบที่ 71 โทเคนต่อวินาที ส่วนระยะเวลาก่อนเริ่มแสดงโทเคนแรกอยู่ที่ 0.87 วินาที

หน่วยงานดังกล่าวระบุราคาเท่ากับที่ xAI ประกาศ คือ 2 ดอลลาร์ต่อโทเคนขาเข้า 1 ล้านโทเคน และ 6 ดอลลาร์ต่อโทเคนขาออก 1 ล้านโทเคน พร้อมส่วนลดแคช 75% โดยคำนวณต้นทุนถ่วงน้ำหนักต่อภารกิจใน Intelligence Index ไว้ที่ 3.74 ดอลลาร์

VentureBeat รายงานโดยอ้างข้อมูลของ Artificial Analysis ว่า การทำงานในโหมด xHigh ใช้โทเคนขาออกประมาณ 81,000 โทเคนต่อภารกิจ มากกว่า GPT-6 Astra อยู่ 196% และมีต้นทุนราว 3.74 ดอลลาร์ต่อภารกิจ สูงกว่า GPT-5.6 Sol ที่ 1.99 ดอลลาร์

คะแนน Terminal-Bench แตกต่างตามวิธีทดสอบ

การประเมินของ Vals AI ให้ Grok 4.7 ได้คะแนน Vals Index 60.22% อยู่ในอันดับ 10 จาก 59 โมเดล เทียบกับ Grok 4.6 ที่ 59.17% และ Grok 4.5 ที่ 51.53% โดยระบุต้นทุนต่อการทดสอบที่ 11.92 ดอลลาร์

ในรายละเอียด Grok 4.7 ได้ 89.38% ใน MedScribe อยู่อันดับ 4 จาก 96 โมเดล, 28.28% ใน Terminal-Bench 4.0 อยู่อันดับ 4 จาก 31 โมเดล และ 86.17% ใน Vibe Code Bench อยู่อันดับ 5 จาก 97 โมเดล แต่มีผลค่อนข้างอ่อนใน ProofBench และ SAGE

ตัวเลข Terminal-Bench 4.0 แตกต่างกันอย่างมีนัยสำคัญระหว่างผู้ประเมิน โดย xAI รายงานไว้ที่ 37.6% ขณะที่ Vals AI วัดได้ 28.28% ส่วน VentureBeat ระบุตัวเลข 38.0% และ 26% สำหรับโหมด xHigh ในคนละเงื่อนไข พร้อมรายงานว่า GPT-6 Astra ได้ 59.6% ในโหมด xHigh ด้าน The Decoder รายงาน Grok 4.7 ที่ 26%, GPT-6 Astra ที่ 60% และ Claude Fable 5.1 ที่ 55% ความแตกต่างนี้ทำให้การเปรียบเทียบจำเป็นต้องพิจารณาทั้งการตั้งค่าและวิธีทดสอบของแต่ละแหล่ง

GitHub เริ่มทยอยเพิ่มใน Copilot

GitHub กำลังทยอยเปิดใช้ Grok 4.7 สำหรับสมาชิก Copilot แผน Pro, Pro+, Max, Business และ Enterprise ครอบคลุม VS Code, Visual Studio, Copilot CLI, คลาวด์เอเจนต์ของ GitHub, JetBrains, Xcode และ Eclipse

VentureBeat ระบุว่ารุ่นมาตรฐานคิดค่าบริการขาเข้าและขาออกที่ 2 และ 6 ดอลลาร์ต่อ 1 ล้านโทเคนตามลำดับ ส่วนรุ่น Fast อยู่ที่ 4 และ 12 ดอลลาร์ ขณะที่การใช้งาน Fast ผ่าน Cursor ในช่วงบริบทเกิน 256,000 โทเคน มีอัตรา 6 และ 18 ดอลลาร์ต่อ 1 ล้านโทเคน

Source: Original Korean article - Trendy News Korea

ความคิดเห็น