ตัวแก้ไขธีม



Xiaomi เปิดหน้าจอฝึกโมเดล MiMo-2.6 โชว์ผลทดสอบ DeepSWE ดีขึ้นกว่ารุ่นก่อนหน้ามาก

ข่าว Xiaomi เปิดหน้าจอฝึกโมเดล MiMo-2.6 โชว์ผลทดสอบ DeepSWE ดีขึ้นกว่ารุ่นก่อนหน้ามาก

News News is verified member.

Active member
สมาชิกทีมงาน
Moderator
Distributor
เจ้าของกระทู้
Xiaomi เปิดหน้าจอฝึกโมเดล MiMo-2.6 โชว์ผลทดสอบ DeepSWE ดีขึ้นกว่ารุ่นก่อนหน้ามาก
Body

ทีมงาน Xiaomi MiMo เปิดเว็บ RL big runs แสดงผลการฝึกแบบสดๆ ของ mimo-v2.6-pro และ mimo-v2.6-flash ที่เป็นโมเดลรุ่นต่อไปของ Xiaomi หลังจากปล่อยโมเดลรุ่น 2.5 ตั้งแต่เดือนเมษายนที่ผ่านมา

แม้ Xiaomi จะไม่ได้ปล่อยโมเดลรุ่นอัปเดตบ่อยนักทำให้ไม่เป็นข่าว แต่ mimo-v2.5 ก็ได้รับความนิยมอย่างสูงต่อเนื่อง ปัจจุบันยังอยู่อันดับที่ 6 ของ OpenRouter เนื่องจากความได้เปรียบด้านราคา โดยเฉพาะค่าแคชที่ถูกกว่าโมเดลอื่นๆ มาก

ผลล่าสุดบนแดชบอร์ดแสดงว่า mimo-v2.6 สามารถทำคะแนนทดสอบ DeepSWE ได้มากกว่า 60% ใกล้เคียงกับ GLM-5.3-Flash ยังไม่แน่ชัดว่าทีมงานตั้งเป้าหมายจบการฝึกที่จุดใด

หน้าเว็บแสดงงบประมาณการฝึกตามจริง สองโมเดลเกิน 1.2 ล้านดอลลาร์ แต่การฝึกนี้เป็นการฝึก reinforcement learning ช่วงท้ายเท่านั้น การฝึกโมเดลเต็มๆ น่าจะใช้งบประมาณมากกว่านี้หลายเท่า

ที่มา - Xiaomi MiMo, @_LuoFuli

Nearly half a year of silence. We spent it studying one problem: how far RL can scale.MiMo-V2.6 is in the middle of its RL run right now. Three things we scaled: compute (~2B tokens per step, 1568 prompts × 16 rollouts, fully async), environments and harnesses (multi-task…

— Fuli Luo (@_LuoFuli) September 16, 2026
lew Thu, 17/09/2026 - 10:47

Continue reading...
 




กลับ
ยอดนิยม ด้านล่าง