小米大模型团队宣布开源
官方数据显示,新版模型在学科推理、文档理解、图形界面定位及视频理解四项核心能力上全面刷新纪录,其中 MMMU 基准
此番迭代通过优化强化学习稳定性与监督微调流程,使模型在内部 VLMArena 评分从 1093.9 跃升至 1131.2。
尤为引人关注的是,用户可在提问时通过 「/no_think」 指令自由切换 「思考」 与 「非思考」 模式: 前者全程展示推理链条,控制成功率 100%,后者直接生成答案,响应更快,成功率 99.84%。
-
MiMo-VL-7B-RL-2508
-
推荐用户在大多数情况下体验使用该模型。
-
开源地址:https://huggingface.co/XiaomiMiMo/MiMo-VL-7B-RL-2508
MiMo-VL-7B-SFT-2508
用户可以根据实际需求,基于此模型进行 SFT 以及 RL。相比于上一版 SFT 模型,该模型的 RL 稳定性更高。
开源地址:https://huggingface.co/XiaomiMiMo/MiMo-VL-7B-SFT-2508









