当前位置：首页 » 资讯 » 新科技 » 正文

小米声音理解大模型 MiDashengLM-7B 发布并全量开源

IP属地中国·北京 编辑：冯璃月 IT之家 时间：2025-08-04 12:12:52

IT之家 8 月 4 日消息，小米自研声音理解大模型 MiDashengLM-7B 今日正式发布，并全量开源。
据小米官方介绍，MiDashengLM-7B 速度精度上实现双突破：单样本首 Token 延迟仅为同类模型 1/4、同显存下并发超 20 倍，在 22 个公开评测集上刷新多模态大模型最好成绩（SOTA）。

MiDashengLM-7B 基于 Xiaomi Dasheng 作为音频编码器和 Qwen2.5-Omni-7B Thinker 作为自回归解码器，通过创新的通用音频描述训练策略，实现了对语音、环境声音和音乐的统一理解。
2024 年，小米发布的 Xiaomi Dasheng 声音基座模型在国际上首次突破 AudioSet 50+ mAP，在 HEAR Benchmark 环境声、语音、音乐三大领域建立领先优势并保持至今。
Xiaomi Dasheng 在小米的智能家居和汽车座舱等场景有超过 30 项落地应用。行业首发的车外唤醒防御、手机音箱全天候监控异常声音、“打个响指”环境音关联 IoT 控制能力，以及小米 YU7 上搭载的增强哨兵模式划车检测等，背后都有 Xiaomi Dasheng 作为核心算法的赋能。
MiDashengLM 的训练数据由 100% 的公开数据构成，模型以宽松的 Apache License 2.0 发布，同时支持学术和商业应用。

小米表示，不同于 Qwen2.5-Omni 等未公开训练数据细节的模型，MiDashengLM 完整公开了 77 个数据源的详细配比，技术报告中详细介绍了从音频编码器预训练到指令微调的全流程。

作为小米“人车家全生态”战略的关键技术，MiDashengLM 通过统一理解语音、环境声与音乐的跨领域能力，不仅能听懂用户周围发生了什么事情，还能分析发现这些事情的隐藏含义，提高用户场景理解的泛化性。
基于 MiDashengLM 的模型通过自然语言和用户交互，为用户提更人性化的沟通和反馈，比如在用户练习唱歌或练习外语时提供发音反馈并制定针对性提升方案，又比如在用户驾驶车辆时实时对用户关于环境声音的提问做出解答。
MiDashengLM 以 Xiaomi Dasheng 音频编码器为核心组件，是 Xiaomi Dasheng 系列模型的重要升级。在当前版本的基础上，小米已着手对该模型做计算效率的进一步升级，寻求终端设备上可离线部署，并完善基于用户自然语言提示的声音编辑等更全面的功能。
IT之家附 MiDashengLM 开源地址：
GitHub 主页：https://github.com/xiaomi-research/dasheng-lm技术报告：https://github.com/xiaomi-research/dasheng-lm/tree/main/technical_report模型参数（Hugging Face）：https://huggingface.co/mispeech/midashenglm-7b模型参数（魔搭社区）：https://modelscope.cn/models/midasheng/midashenglm-7b网页Demohttps://xiaomi-research.github.io/dasheng-lm交互Demohttps://huggingface.co/spaces/mispeech/MiDashengLM

免责声明：本网信息来自于互联网，目的在于传递更多信息，并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益，请及时联系我们，本站将会在24小时内处理完毕。

同类资讯

阿里巴巴蔡崇信：我也被马云「开除」过

斯瓦尔巴群岛，下一个北极区域热点？

CounterPoint报告2025全球手机存量：8大品牌破2亿

分析师：苹果iPhone 18 Pro系列起售价将与前代持平

“让国产大飞机护航万家团圆路”（新春走基层）

啥样的车，更受市场欢迎？

全站最新

阿里巴巴蔡崇信：我也被马云「开除」过

斯瓦尔巴群岛，下一个北极区域热点？

CounterPoint报告2025全球手机存量：8大品牌破2亿

分析师：苹果iPhone 18 Pro系列起售价将与前代持平

热门推荐

阿里巴巴蔡崇信：我也被马云「开除」过

Meta旗下子公司在与德国电信关于网络服务的上诉中败诉

三星GalaxyS26系列定档2月26日

特斯拉领导层最新变动，任命欧洲高管负责全球电动汽车销售

知情人士：Alphabet英镑债券发行获得创纪录的240亿英镑认购订单

福特汽车第四季度调整后息税前利润10.4亿美元，同比减少51%

五部门：2027年低空公共航路地面移动通信网覆盖率达90%以上

AI赋能招投标20个应用场景数智技术护航“阳光交易”

Strategy(MSTR.US)创始人塞勒“硬刚”空头：比特币跌90%也不抛售会通过再融资应对债务压力

斯瓦尔巴群岛，下一个北极区域热点？

CounterPoint报告2025全球手机存量：8大品牌破2亿

分析师：苹果iPhone 18 Pro系列起售价将与前代持平

“让国产大飞机护航万家团圆路”（新春走基层）

啥样的车，更受市场欢迎？

看展，AI讲解员做“搭子”