SpaceXAI เปิดตัว Grok 4.7 โมเดล AI รุ่นใหม่สำหรับงานเขียนโค้ดและงาน Knowledge Work ที่ราคา $2 ต่อล้าน input token และ $6 ต่อล้าน output token ต่ำกว่าโมเดลระดับเดียวกันในตลาด

SpaceXAI วาง Grok 4.7 เป็นโมเดลที่มีความสามารถสูงสุดของบริษัทสำหรับงานเขียนโค้ดและงาน Knowledge Work โดยจุดที่ต่างจากรุ่นก่อนคือโมเดลทำงานกับโจทย์ยากได้ยาวนานขึ้นและตรวจทานงานของตัวเองได้รอบคอบขึ้น ในเชิงเทคนิค Grok 4.7 ใช้ base model ใหม่ที่มีขนาดใหญ่กว่า Grok 4.6 และผ่านการฝึกด้วย Reinforcement Learning ที่ยาวขึ้นบนชุดงานที่ยากกว่าเดิม โดยให้น้ำหนักกับโจทย์ที่ต้องใช้เวลาทำงานหลายชั่วโมง นอกจากนี้ยังฝึกให้โมเดลเข้าใจ harness ของ Grok Bot โดยตรง ซึ่งช่วยยกระดับงานสนทนาและงาน Knowledge Work ทั่วไป ด้านราคา Grok 4.7 ยังคงอัตราเดียวกับ Grok 4.6 ขณะที่คู่แข่งอย่าง GPT-5.6 Sol Max คิดค่าบริการที่ $4 ต่อล้าน input token และ $20 ต่อล้าน output token ส่วน Fable 5.1 Max อยู่ที่ $10 และ $50 ตามลำดับ
บน CursorBench 4.0 ซึ่งเป็น benchmark ที่เน้นงาน coding ที่ต้องรันต่อเนื่องเป็นเวลานาน Grok 4.7 ในโหมด xHigh ทำคะแนนได้ 46.3% เพิ่มจาก 40.4% ของ Grok 4.6 โหมด High และสูงกว่า GPT-5.6 Sol Max ที่ 41.7% แม้ Fable 5.1 Max จะยังนำอยู่ที่ 51.8% แต่คิดค่า input token แพงกว่าถึง 5 เท่า ซึ่งเป็นที่มาของการที่ SpaceXAI ระบุว่าโมเดลอยู่ในระดับแนวหน้าด้านราคาต่อประสิทธิภาพ ส่วน DeepSWE v1.1 อยู่ที่ 71.0% ในโหมด high effort ความเปลี่ยนแปลงสะท้อนชัดที่สุดในงานที่ต้องทำต่อเนื่องหลายชั่วโมง โดย Terminal-Bench 4.0 ขยับจาก 20.3% เป็น 38.0% เกือบเท่าตัว ขณะที่ EEBench ซึ่งวัดงานด้านวิศวกรรมไฟฟ้าทำได้ 64.0% นำหน้าทั้ง GPT-5.6 Sol Max ที่ 39.4% และ Fable 5.1 Max ที่ 56.4% ด้าน GDPval และ AA Briefcase ซึ่งจำลองงานจริงของกลุ่มวิชาชีพ เช่น ทนายความ พยาบาล และนักวิเคราะห์การเงิน Grok 4.7 ทำคะแนน Elo บน GDPval ที่ 1,695 เพิ่มจาก 1,605 ของรุ่นก่อน และ AA Briefcase v1.1 ที่ 1,657 คะแนน ส่วนงานเฉพาะทางอื่นให้ผลต่างกันไป โดย Harvey Legal Agent Benchmark ทำได้ 19.6% ทิ้งห่าง GPT-5.6 Sol Max ที่ 2.5% และ Fable 5.1 Max ที่ 6.7% ขณะที่ HealthBench Professional อยู่ที่ 56.7% ซึ่งยังตามหลังทั้งสองโมเดล
อีกประเด็นที่องค์กรควรพิจารณาคือชุด safeguard ที่ออกแบบใหม่ทั้งหมด ซึ่ง SpaceXAI ระบุว่าแข็งแรงที่สุดเท่าที่เคยทดสอบมาทั้งในแง่การปฏิเสธคำสั่งที่ไม่เหมาะสมและการต้านทาน jailbreak โดยเฉพาะในโดเมนแบบ dual-use อย่างงาน Cybersecurity และงานชีวภาพ ที่โมเดลทำคะแนนนำบน biosafety benchmark ของ LatchBio ที่ 62.4% ส่วน HackerBench v0.3 ซึ่งเป็น benchmark สำหรับงาน cyber ที่มีความเสี่ยงและเป็นอันตราย Grok 4.7 ปล่อยให้ prompt กลุ่มเสี่ยงผ่านเพียง 3.3% แต่ยังแทบไม่บล็อกงานด้านความปลอดภัยที่ถูกต้องตามวัตถุประสงค์ ล่าสุดยังเริ่มเปิดให้พันธมิตรด้าน Cybersecurity บางรายเข้าถึงความสามารถ red-team ของ Grok 4.7 แบบ invite-only เพื่อใช้ในงานวิจัยเชิงป้องกัน
Grok 4.7 เปิดให้ใช้งานแล้วผ่าน Cursor และ Grok Build รวมถึง Grok API coding harness จาก 3rd-party และบรรดา model router กับ cloud platform ต่าง ๆ ราคาเริ่มต้นที่ $2 ต่อล้าน input token และ $6 ต่อล้าน output token นอกจากนี้ยังมีตัวเลือกแบบ fast variant ที่ให้ความเร็ว output เพิ่มขึ้น 2 เท่าในราคา 2 เท่า ผู้ดูแลระบบและนักพัฒนาที่สนใจสามารถศึกษารายละเอียดเพิ่มเติมได้ที่ docs.x.ai
ที่มา: https://x.ai/news/grok-4-7
TechTalkThai ศูนย์รวมข่าว Enterprise IT ออนไลน์แห่งแรกในประเทศไทย









