อาลีบาบาเปิดตัว Qwen3.8-Flash โมเดลประมวลผลมัลติโมดัลแบบเปิดเผยค่าน้ำหนักที่ผ่านการเทรนเรียบร้อยแล้ว (open-weight) ที่ใช้สถาปัตยกรรม Mixture-of-Experts (MoE) ชูจุดเด่นเรื่องความคุ้มค่าสูงสุด โมเดลนี้ประกอบด้วยโมเดลหลักที่มีพารามิเตอร์ 125 พันล้านรายการ (125B) เสริมด้วย N-gram Embeddings อีก 51 พันล้านรายการ (51B) โดยดึงพารามิเตอร์มาใช้งานจริงเพียง 6 พันล้านพารามิเตอร์ (6B) ต่อหนึ่งโทเคน ซึ่งช่วยสร้างความสมดุลได้อย่างลงตัวระหว่างความสามารถ ความเร็วในการตอบสนอง และต้นทุน เหมาะสำหรับแอปพลิเคชันที่ต้องรองรับปริมาณงานสูง เวิร์กโฟลว์ที่ทำงานร่วมกับเครื่องมือต่าง ๆ ตลอดจนระบบช่วยเขียนโค้ดและผู้ช่วยทำงานร่วม นอกจากนี้ Qwen3.8-Flash ยังเป็นต้นแบบของสถาปัตยกรรมที่ออกแบบมาเพื่อรองรับซีรีส์ Qwen4 ที่กำลังจะเปิดตัวเร็ว ๆ นี้
Read More »
TechTalkThai ศูนย์รวมข่าว Enterprise IT ออนไลน์แห่งแรกในประเทศไทย







