当前位置: 首页 » 资讯 » 新科技 » 正文

小米开源最新多模态大模型 Xiaomi MiMo-VL-7B-2508

IP属地 中国·北京 编辑:沈瑾瑜 Chinaz 时间:2025-08-09 10:26:59

小米大模型团队宣布开源最新一代多模态大模型 Xiaomi MiMo-VL-7B-2508,包含 RL 与 SFT 两个版本。

官方数据显示,新版模型在学科推理、文档理解、图形界面定位及视频理解四项核心能力上全面刷新纪录,其中 MMMU 基准首次突破70分大关,ChartQA 升至94.4,ScreenSpot-v2达92.5,VideoMME 提升至70.8。

此番迭代通过优化强化学习稳定性与监督微调流程,使模型在内部 VLM Arena 评分从1093.9跃升至1131.2。

尤为引人关注的是,用户可在提问时通过“/no_think”指令自由切换“思考”与“非思考”模式:前者全程展示推理链条,控制成功率100%,后者直接生成答案,响应更快,成功率99.84%。

MiMo-VL-7B-RL-2508

推荐用户在大多数情况下体验使用该模型。

开源地址:https://huggingface.co/XiaomiMiMo/MiMo-VL-7B-RL-2508

MiMo-VL-7B-SFT-2508

用户可以根据实际需求,基于此模型进行SFT以及RL。相比于上一版SFT模型,该模型的RL稳定性更高。

开源地址:https://huggingface.co/XiaomiMiMo/MiMo-VL-7B-SFT-2508

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。