NetApp เปิดตัว NetApp Novus สถาปัตยกรรม storage รุ่นใหม่สำหรับผู้ให้บริการ AI infrastructure ที่ดูแล GPU cluster ขนาดใหญ่ โดยแยก metadata ออกจาก data path เพื่อลดคอขวดที่ทำให้ GPU utilization ลดลง

NetApp ประกาศเปิดตัว NetApp Novus สถาปัตยกรรมที่ออกแบบมาสำหรับ AI factory ของกลุ่ม neocloud และผู้ให้บริการ GPU-as-a-Service ซึ่งต้องป้อนข้อมูลให้ GPU จำนวนมากทำงานได้อย่างต่อเนื่อง NetApp ระบุว่าสถาปัตยกรรม storage แบบเดิมไม่ได้ออกแบบมารองรับสเกลระดับนี้ จึงเกิดคอขวดที่ทำให้ GPU utilization อาจตกลงไปต่ำกว่า 30% เมื่อระบบส่งข้อมูลให้ GPU ไม่ทัน ซึ่งกระทบทั้งต้นทุน infrastructure และผลตอบแทนจากการลงทุนใน GPU โดยตรง
ความแตกต่างหลักของ Novus คือการแยก metadata service ออกจาก data path ทำให้ performance, capacity และ concurrency ขยายตัวได้อย่างอิสระภายใต้ namespace เดียวผ่าน NFS มาตรฐาน เวอร์ชันแรกประกอบด้วย NetApp Novus Data Director ซึ่งเป็นซอฟต์แวร์จัดการ metadata ทำงานบน infrastructure ของ Supermicro ที่ผ่านการ qualify แล้ว โดยทำงานร่วมกับ data service ของ NetApp ONTAP ที่ส่งมอบผ่านระบบ AFF A90 ทั้งสองส่วนรวมกันเป็นสถาปัตยกรรมแบบ disaggregated ที่ออกแบบให้มี throughput เกิน 100 TB ต่อวินาที และรองรับ GPU ระดับหลายแสนตัว นอกจากนี้ยังรองรับ file system ระดับ zettabyte โดยยังคง enterprise data service ของ ONTAP ที่องค์กรใช้งานอยู่เดิมไว้ครบ
ประโยชน์ที่ NetApp ระบุไว้แบ่งเป็นสามด้าน ด้านแรกคือการรักษา GPU utilization ให้อยู่ในระดับสูงด้วยการลดคอขวดจากฝั่ง storage ด้านที่สองคือการขยายระบบได้โดยไม่เกิด fragmentation เพราะไฟล์จำนวนหลายพันล้านไฟล์และชุดข้อมูล AI ขนาดใหญ่อยู่ภายใต้ namespace เดียว ทำให้ metadata, bandwidth และ capacity ขยายแยกกันได้โดยไม่เกิด storage silo ด้านที่สามคือประสิทธิภาพของ infrastructure โดยผู้ดูแลระบบสามารถขยายเฉพาะทรัพยากรที่แต่ละ workload ต้องใช้จริง ช่วยลดการใช้พลังงานและพื้นที่ใน Data Center ขณะที่ยังคงความสามารถด้าน resiliency, security และ multi-tenant ที่จำเป็นต่อสภาพแวดล้อม AI แบบใช้งานร่วมกัน
ด้านการตรวจสอบจากภายนอก Omdia ระบุว่าการ audit พบว่า Novus ทำ performance scaling ได้ใกล้เคียงเชิงเส้นเมื่อเพิ่มจำนวน ONTAP cluster เข้าไปใน global namespace เดียว และจากการสร้างแบบจำลองคาดการณ์ว่าสถาปัตยกรรมนี้ขยายได้ถึงระดับ 100 TB ต่อวินาทีสำหรับ sequential read พร้อม effective capacity ระดับหลายสิบ exabyte ตัวเลขดังกล่าวจึงเป็นเป้าหมายการออกแบบและการคาดการณ์จากแบบจำลอง ไม่ใช่ผลวัดจากระบบที่ติดตั้งใช้งานจริง ขณะที่ Cisco ซึ่งร่วมมือกับ NetApp มาอย่างต่อเนื่องระบุว่าแนวทางนี้มุ่งรวม compute, networking และข้อมูลเข้าด้วยกันเพื่อลดความซับซ้อนของ infrastructure ทั้งนี้ Novus เปิดให้สั่งซื้อได้แล้ว ส่วนการ deploy แบบ software-defined เป็นแผนในอนาคตที่ยังไม่ระบุกำหนดเวลา โดยจะยังใช้ namespace, operating model และ data foundation เดิม ผู้ที่สนใจอ่านรายละเอียดเชิงสถาปัตยกรรมเพิ่มเติมได้ที่ บล็อกของ NetApp
ที่มา: https://www.netapp.com/newsroom/press-releases/news-rel-20260929-745367/
TechTalkThai ศูนย์รวมข่าว Enterprise IT ออนไลน์แห่งแรกในประเทศไทย






