Alibaba Cloud เปิดตัว “Qwen2-VL” วิเคราะห์วีดีโอได้มากกว่า 20 นาที

Alibaba Cloud ยักษ์ใหญ่ผู้ให้บริการ Cloud สัญชาติจีน ล่าสุดได้ประกาศเปิดตัว Qwen2-VL โมเดลภาพและภาษาล่าสุดที่มีการปรับปรุงเรื่องความเข้าใจในภาพและวีดีโอ ที่สามารถประมวลผลภาพและข้อความได้ในหลากหลายภาษา ที่สำคัญคือสามารถวิเคราะห์วีดีโอได้ยาวมากกว่า 20 นาทีด้วย

โดย Alibaba Cloud ได้เปิดตัว Qwen2-VL โมเดล Qwen เวอร์ชันล่าสุดที่จะมาแข่งขันกับฝั่งตะวันตก ไม่ว่าจะเป็น Llama 3.1 ของ Meta, GPT-4o ของ OpenAI หรือ Claude 3 Haiku ของ Anthropic ซึ่ง Alibaba Cloud เผยว่าประสิทธิภาพจากการ Benchmark นั้นไม่แพ้กับโมเดลชั้นนำเหล่านั้นเลย

แน่นอนว่า Qwen2-VL นั้นสามารถสรุปเนื้อหาในวีดีโอได้ พร้อมกับสามารถตอบคำถาที่เกี่ยวข้อง และสามารถสนทนาได้อย่างต่อเนื่อง ซึ่งสามารถนำไปต่อยอดทำแชทบอทได้อย่างแน่นอน ซึ่งจุดที่น่าสนใจคือ Qwen2-VL นี้สามารถเข้าใจและวิเคราะห์วีดีโอได้นานมากกว่า 20 นาที ที่จะสามารถสรุปและตอบคำถามได้

สำหรับผู้ที่สนใจ Qwen2-VL ทาง Alibaba Cloud มีให้ใช้งาน 3 ขนาด คือ 72b, 7b และ 2b โดยสามารถเข้าไปทดลองและดูรายละเอียดเพิ่มเติมได้ที่ Hugging Face 

ที่มา: https://venturebeat.com/ai/alibaba-releases-new-ai-model-qwen2-vl-that-can-analyze-videos-more-than-20-minutes-long/

About chatchai

Tech Writer แห่ง TechTalk Thai ที่สนใจในทุกนวัตกรรมและเทคโนโลยี

Check Also

Panduit และ Globaltronic ผนึกกำลังพัฒนาโครงสร้างพื้นฐานพร้อมรองรับ AI ในประเทศไทย [Guest Post]

Panduit ผู้นำระดับโลกด้านโซลูชันโครงสร้างพื้นฐานทางไฟฟ้าและเครือข่าย และ Globaltronic Intertrade (Globaltronic) ผู้ให้บริการโซลูชันด้านเทคโนโลยีและโครงสร้างพื้นฐานชั้นนำ มีความยินดีที่จะประกาศความร่วมมือเชิงกลยุทธ์ เพื่อเร่งการพัฒนาโครงสร้างพื้นฐานที่แข็งแกร่ง ชาญฉลาด และพร้อมรองรับอนาคตทั่วประเทศไทย

ถอดมุมมอง Data First สู่ AI That Works จากงาน Blendata – Data & AI Decoded 2026

เมื่อเม็ดเงินลงทุนด้าน AI ทั่วโลกเติบโตถึง 12 เท่าในช่วง 5 ปี แตะระดับ 52 พันล้านดอลลาร์สหรัฐ* ตัวเลขนี้สะท้อนชัดเจนว่าเทคโนโลยี AI กำลังเปลี่ยนผ่านสู่ยุคแห่งการนำไปใช้งานจริง แต่การจะนำ AI …