Alibaba Group ได้เปิดตัวสมาชิกใหม่ล่าสุดในซีรีส์ Qwen ซึ่งเป็นโมเดลภาษาขนาดใหญ่แบบโอเพนซอร์สของบริษัท ทั้งนี้ Qwen3.8-Max เป็น LLM ที่มีความสามารถสูงที่สุดของยักษ์ใหญ่ด้านอีคอมเมิร์ซจากประเทศจีน ณ ปัจจุบัน โดยมีพารามิเตอร์ถึง 2.4 ล้านล้านตัว ซึ่งมากกว่าโมเดล Qwen3.5 ที่ Alibaba เปิดตัวเมื่อเดือนกุมภาพันธ์ถึงประมาณเจ็ดเท่า โดย LLM รุ่นนี้จะใช้พารามิเตอร์จำนวน 95,000 ล้านตัวในการตอบคำถามแต่ละครั้ง

Qwen3.8-Max รองรับพรอมต์ที่มีข้อมูลสูงสุดถึง 1 ล้านโทเค็น ตามข้อมูลของ Alibaba สิ่งนี้ช่วยให้โมเดลสามารถวิเคราะห์ข้อความได้มากกว่า 200 หน้า หรือฟุตเทจวิดีโอนานประมาณ 100 ชั่วโมงต่อการเรียกใช้งานหนึ่งครั้ง โดยการตอบกลับพรอมต์สามารถรองรับได้สูงสุดถึง 131,000 โทเค็น
Alibaba ยังไม่ได้เปิดเผยภาพรวมโดยละเอียดเกี่ยวกับสถาปัตยกรรมของ Qwen3.8-Max โดยโมเดลสองรุ่นก่อนหน้าอย่าง Qwen3.5 และ Qwen3.6 มีคุณสมบัติทางเทคนิคบางประการร่วมกัน รวมถึงกลไกความสนใจที่เรียกว่า Gated DeltaNet ซึ่งมีความเป็นไปได้ที่ LLM รุ่นใหม่ล่าสุดของ Alibaba อาจใช้เทคโนโลยีนี้เช่นกัน
กลไกความสนใจของ LLM เป็นโมดูลซอฟต์แวร์ที่ใช้ในการตีความพรอมต์ โดยโมดูลจะรับข้อความที่ป้อนเข้ามา ระบุส่วนที่สำคัญที่สุด และจัดลำดับความสำคัญระหว่างการประมวลผล สำหรับ Gated DeltaNet เป็นรูปแบบหนึ่งของเทคโนโลยีที่ได้รับการนำเสนอโดยนักวิจัยจาก Nvidia เมื่อปีที่แล้ว
กลไกความสนใจแบบมาตรฐานจะขยายตัวในรูปแบบกำลังสอง ซึ่งหมายความว่าการเพิ่มขนาดของพรอมต์ขึ้นเป็นสองเท่าจะทำให้ความต้องการหน่วยความจำและพลังในการคำนวณที่ใช้ในการประมวลผลเพิ่มขึ้นถึงสี่เท่า ในทางตรงกันข้าม โมดูล Gated DeltaNet จะขยายตัวในรูปแบบเชิงเส้น ทำให้ความต้องการโปรเซสเซอร์และหน่วยความจำไม่เพิ่มขึ้นรวดเร็วตามขนาดของพรอมต์ที่ใหญ่ขึ้น ซึ่งช่วยลดการใช้ทรัพยากรฮาร์ดแวร์ของ LLM
Gated DeltaNet ไม่ใช่การนำกลไกความสนใจไปใช้งานเพียงวิธีเดียวที่ให้การขยายตัวแบบเชิงเส้น สิ่งที่ทำให้โดดเด่นคือการใช้เทคนิคการประมวลผลข้อมูลสองประการที่เรียกว่า กฎการอัปเดตแบบมีเกต (gated update rule) และกฎเดลตา (delta rule) ตามข้อมูลของ Nvidia เทคนิคเหล่านี้ทำให้ LLM ที่ใช้กลไกความสนใจแบบขยายตัวเชิงเส้นมีความสามารถในการประมวลผลพรอมต์ขนาดยาวได้ดียิ่งขึ้น
Alibaba ได้ประเมินขีดความสามารถของ Qwen3.8-Max ผ่านการทดสอบหลายรายการก่อนการเปิดตัวในครั้งนี้ โดยบริษัทระบุว่าโมเดลสามารถดำเนินการโครงการเขียนโปรแกรมระยะเวลา 16 วันได้สำเร็จโดยไม่ต้องอาศัยการป้อนข้อมูลจากมนุษย์ และในการทดสอบอีกรายการ Qwen3.8-Max ได้ดำเนินการงานปรับปรุงประสิทธิภาพการออกแบบชิปซึ่งประกอบด้วยขั้นตอนมากกว่า 500 ขั้นตอน
โมเดลทำคะแนนได้ 1,668 คะแนนบนเกณฑ์มาตรฐานที่เรียกว่า Frontend Code Arena ซึ่งวัดทักษะการพัฒนาอินเทอร์เฟซของ LLM โดยคะแนนดังกล่าวตามหลังการกำหนดค่าที่ล้ำสมัยที่สุดของ Claude Opus 5 ซึ่งเป็น LLM ล่าสุดของ Anthropic อยู่เพียง 37 คะแนนเท่านั้น ทั้งนี้ Qwen3.8-Max ยังมีประสิทธิภาพเหนือกว่าโมเดลชั้นนำอื่น ๆ อีกกว่า 12 รายการ รวมถึง Muse Spark 1.1 ซึ่งเป็นโมเดลเรือธงของ Meta Platforms
โมเดลดังกล่าวพร้อมให้ใช้งานผ่านแพลตฟอร์มคลาวด์ของ Alibaba ในช่วงการเปิดตัว โดยบริษัทมีแผนที่จะเปิดเป็นโอเพนซอร์สในสัปดาห์หน้า พร้อมกับเวอร์ชันที่เล็กลงและประหยัดทรัพยากรฮาร์ดแวร์มากกว่าที่เรียกว่า Qwen3.8-27B
ที่มา: https://siliconangle.com/2026/08/03/alibaba-debuts-qwen3-8-max-model-2-4t-parameters/
TechTalkThai ศูนย์รวมข่าว Enterprise IT ออนไลน์แห่งแรกในประเทศไทย







