Runware ผู้ให้บริการ AI Infrastructure เปิดตัว Sonic Inference Pod ศูนย์ข้อมูลแบบ Modular ที่ออกแบบมาให้เคลื่อนย้ายได้แบบเบ็ดเสร็จในตัว พร้อมวางตำแหน่งให้นวัตกรรมนี้เข้ามาเป็นทางเลือกในการประมวลผลที่เป็นอิสระ และยืดหยุ่น พร้อมท้าชนโปรเจกต์ Data Center ขนาดมหึมาของเหล่า Hyperscaler ในปัจจุบัน

Flaviu Radulescu ผู้ร่วมก่อตั้งและ CEO ของ Runware ระบุว่า การประมวลผลแบบกระจายศูนย์ที่ติดตั้งเข้าใกล้ผู้ใช้งานปลายทางมากขึ้นเพื่อการทำ AI Inference ที่รวดเร็วคือผู้ชนะในเกมระยะยาว โดย Data Center ในชื่อ Sonic Inference Pod ที่มีลักษณะคล้ายตู้ Container ถูกออกแบบมาให้เพิ่มขีดความสามารถได้ทันทีด้วยการติดตั้งยูนิตใหม่เพิ่มเติม แทนที่จะต้องขยาย Data Center แบบตายตัว ซึ่งกินเวลาและทรัพยากรมหาศาล
ระบบของ Runware นำเสนอจุดเด่นที่เหนือกว่าแพลตฟอร์ม Serverless Inference หรือ GPU Cloud ทั่วไปในตลาดดังนี้
- ตอบสนองความต้องการด้าน AI Inference ด้วยคุณภาพที่สูงกว่า ในต้นทุนที่ถูกลงอย่างมีนัยสำคัญ
- สามารถติดตั้งและเปิดใช้งานได้ทันทีในทุกพื้นที่ที่มีแหล่งจ่ายไฟ
- ไม่ใช้น้ำในการระบายความร้อน และใช้เวลาสร้างเสร็จภายในไม่กี่วัน เทียบกับ Data Center แบบดั้งเดิมที่ต้องใช้เวลานานนับเดือนหรือหลายปี
- ปรับตัวและสเกลระบบเพื่อรองรับฮาร์ดแวร์รุ่นใหม่ที่ออกสู่ตลาดได้อย่างรวดเร็ว
ปัจจุบัน AI Lab ระดับท็อปอย่าง OpenAI หรือ SpaceX กำลังเร่งสร้าง Data Center ขนาดใหญ่ทั่วสหรัฐอเมริกา แต่ Runware มองว่าโปรเจกต์เหล่านั้นไม่ใช่ความท้าทาย Sonic Inference Pod สร้างความแตกต่างด้วยความยืดหยุ่น โดยทุกยูนิตจะทำงานเชื่อมต่อกันเป็นเครือข่ายเดียว หากมี Pod ใดขัดข้อง ทราฟฟิกจะถูกโอนไปยังยูนิตอื่นที่มีความจุว่างทันที ทำให้ผลกระทบถูกจำกัดอยู่ในวงแคบ นอกจากนี้ ลูกค้าองค์กรที่ต้องการฮาร์ดแวร์เฉพาะยังสามารถเช่าเหมา Pod ทั้งยูนิตเพื่อใช้งานแบบส่วนตัวได้
ปัจจุบันอุตสาหกรรม AI กำลังเผชิญกระแสวิจารณ์เรื่องการใช้ทรัพยากร โดยเฉพาะเมื่อชุมชนที่ตั้ง Data Center เริ่มได้รับผลกระทบจากค่าสาธารณูปโภคที่พุ่งสูงขึ้น Runware แก้ปัญหานี้โดยการใช้พลังงานจากระบบกริดที่มีอยู่แล้ว แทนการร้องขอให้สร้างกำลังการผลิตใหม่ การเดินเครื่องแบบกระจายศูนย์ยังช่วยลดการสูญเสียพลังงานในระบบอย่างมีประสิทธิภาพ รวมถึงการตัดปัญหาสิ้นเปลืองน้ำในระบบระบายความร้อน
ปัจจุบัน Runware นำร่องใช้งานแล้ว 10 Pod ทั่วพื้นที่สหรัฐอเมริกา ยุโรป และเอเชียแปซิฟิก โดยมีพื้นที่รองรับกว่า 160 ไซต์ เป้าหมายระยะยาวของบริษัทตามเจตนารมณ์ของการระดมทุน Series A มูลค่า 50 ล้านดอลลาร์เมื่อเดือนธันวาคมที่ผ่านมา คือการเป็นโครงสร้างพื้นฐานระดับแกนกลางที่รองรับการรันโมเดล AI ของโลก ด้วยกำลังการประมวลผลที่สามารถขยายตัวตามความต้องการจริง โดยไม่เป็นคอขวดของอุตสาหกรรม
TechTalkThai ศูนย์รวมข่าว Enterprise IT ออนไลน์แห่งแรกในประเทศไทย







