Xiaomi เปิดตัว MiMo-V2.6-Pro ขึ้นเป็นโมเดล open-weight อันดับ 1 ของโลก แซง DeepSeek
'Better than DeepSeek': Xiaomi's MiMo-V2.6-Pro debuts as the top open weights model in the world alongside cheaper V2.6-Flash

Xiaomi เปิดตัวโมเดลตระกูล MiMo-V2.6 โดยรุ่น MiMo-V2.6-Pro ขึ้นเป็นโมเดล open-weight ที่ได้คะแนนสูงสุดในโลกบน Artificial Analysis Intelligence Index ที่ 46 คะแนน เท่ากับ Grok 4.7 ของ xAI และสูงกว่า Grok 4.6 (44), Gemini 3.8 Flash (41), DeepSeek V4.1 Flash (39) และ DeepSeek V4.1 Pro (36)
MiMo-V2.6-Pro เป็นโมเดลแบบ Mixture-of-Experts มีพารามิเตอร์ทั้งหมด 1.02 ล้านล้าน แต่ใช้งานจริง 42 พันล้านพารามิเตอร์ต่อการประมวลผล รองรับ context 1 ล้านโทเคน ตอบได้ยาวสุด 128,000 โทเคน และรับอินพุตได้ทั้งข้อความ ภาพ เสียง และวิดีโอ ส่วนรุ่น Flash มีพารามิเตอร์ 310 พันล้าน (ใช้งานจริง 15 พันล้าน) และรองรับ context 1 ล้านโทเคนเช่นกัน ทั้งสองรุ่นใช้ MIT license และดาวน์โหลดได้บน Hugging Face
ราคา API ของรุ่น Pro อยู่ที่ 0.435 ดอลลาร์ต่อล้านโทเคนขาเข้า และ 0.87 ดอลลาร์ต่อล้านโทเคนขาออก รุ่น Flash อยู่ที่ 0.14 และ 0.28 ดอลลาร์ VentureBeat รายงานว่าต้นทุนการพัฒนารุ่น Pro อยู่ที่ราว 2.62 ล้านดอลลาร์ และรุ่น Flash ราว 850,000 ดอลลาร์ ทีมใช้ reinforcement learning ขนาดใหญ่ 30 รอบ รวมประมาณ 750,000 trajectories ในเวลาไม่ถึง 6 วัน
ในชุดทดสอบของ Xiaomi เอง รุ่น Pro ทำคะแนน DeepSWE v1.1 ได้ 71.9 เพิ่มจาก 19.0 ในรุ่น V2.5-Pro และได้ 89.9 บน Terminal Bench 2.1 นอกจากน้ำหนักโมเดลแล้ว Xiaomi ยังเผยแพร่รายงานทางเทคนิค สภาพแวดล้อมงาน RL กว่า 7,000 ชุด เฟรมเวิร์ก RL แบบครบวงจร และโมเดลขนาดเล็ก MiMo-V2.6-Distill-Qwen-9B
ทีม MiMo นำโดย Fuli Luo อดีตนักวิจัยของ DeepSeek เธอบอกว่านี่ “น่าจะเป็นหนึ่งในการเทรน reinforcement learning รอบเดียวที่ใหญ่ที่สุดเท่าที่ทีมโมเดลโอเพนซอร์สเคยทำ” ส่วน Tim Dettmers จาก Carnegie Mellon และ AI2 ชมรุ่น Flash ว่า “ดีที่สุดในคลาส 300B ถึง 550B”
แหล่งอ้างอิง
อ่านต้นฉบับที่ VentureBeathttps://venturebeat.com/technology/better-than-deepseek-xiaomis-mimo-v2-6-pro-debuts-as-the-top-open-weights-model-in-the-world-alongside-cheaper-v2-6-flash