小米发布新模型MiMo-2.6,DeepSWE测试成绩显著提升
Xiaomi เปิดหน้าจอฝึกโมเดล MiMo-2.6 โชว์ผลทดสอบ DeepSWE ดีขึ้นกว่ารุ่นก่อนหน้ามาก
小米发布了新模型MiMo-2.6,训练页面显示它在DeepSWE测试中比之前版本好很多,值得看看。
小米团队发布了其最新模型MiMo-2.6的实时训练页面,该模型在DeepSWE基准测试中表现优于上一代版本。数据显示,MiMo-2.6的测试得分超过60%,接近GLM-5.3-Flash的水平。尽管小米模型更新频率不高,但上一代MiMo-2.5凭借低廉的定价和缓存优势,在OpenRouter上排名第六。
Xiaomi เปิดหน้าจอฝึกโมเดล MiMo-2.6 โชว์ผลทดสอบ DeepSWE ดีขึ้นกว่ารุ่นก่อนหน้ามาก
Xiaomi เปิดหน้าจอฝึกโมเดล MiMo-2.6 โชว์ผลทดสอบ DeepSWE ดีขึ้นกว่ารุ่นก่อนหน้ามาก Body ทีมงาน Xiaomi MiMo เปิดเว็บ RL big runs แสดงผลการฝึกแบบสดๆ ของ mimo-v2.6-pro และ mimo-v2.6-flash ที่เป็นโมเดลรุ่นต่อไปของ Xiaomi หลังจาก ปล่อยโมเดลรุ่น 2.5 ตั้งแต่เดือนเมษายนที่ผ่านมา แม้ Xiaomi จะไม่ได้ปล่อยโมเดลรุ่นอัปเดตบ่อยนักทำให้ไม่เป็นข่าว แต่ mimo-v2.5 ก็ได้รับความนิยมอย่างสูงต่อเนื่อง ปัจจุบันยังอยู่อันดับที่ 6 ของ OpenRouter เนื่องจากความได้เปรียบด้านราคา โดยเฉพาะค่าแคชที่ถูกกว่าโมเดลอื่นๆ มาก ผลล่าสุดบนแดชบอร์ดแสดงว่า mimo-v2.6 สามารถทำคะแนนทดสอบ DeepSWE ได้มากกว่า 60% ใกล้เคียงกับ GLM-5.3-Flash ยังไม่แน่ชัดว่าทีมงานตั้งเป้าหมายจบการฝึกที่จุดใด หน้าเว็บแสดงงบประมาณการฝึกตามจริง สองโมเดลเกิน 1.2 ล้านดอลลาร์ แต่การฝึกนี้เป็นการฝึก reinforcement learning ช่วงท้ายเท่านั้น การฝึกโมเดลเต็มๆ น่าจะใช้งบประมาณมากกว่านี้หลายเท่า ที่มา - Xiaomi MiMo , @_LuoFuli Nearly half a year of silence. We spent it studying one problem: how far RL can scale.MiMo-V2.6 is in the middle of its RL run right now. Three things we scaled: compute (~2B tokens per step, 1568 prompts × 16 rollouts, fully async), environments and harnesses (multi-task… — Fuli Luo (@_LuoFuli) September 16, 2026 lew Thu, 17/09/2026 - 10:47