网易首页 > 网易号 > 正文 申请入驻

小米声音理解大模型 MiDashengLM-7B 发布并全量开源

0
分享至

IT之家 8 月 4 日消息,小米自研声音理解大模型 MiDashengLM-7B 今日正式发布,并全量开源

据小米官方介绍,MiDashengLM-7B 速度精度上实现双突破:单样本首 Token 延迟仅为同类模型 1/4、同显存下并发超 20 倍,在 22 个公开评测集上刷新多模态大模型最好成绩(SOTA)


MiDashengLM-7B 基于 Xiaomi Dasheng 作为音频编码器和 Qwen2.5-Omni-7B Thinker 作为自回归解码器,通过创新的通用音频描述训练策略,实现了对语音、环境声音和音乐的统一理解。

2024 年,小米发布的 Xiaomi Dasheng 声音基座模型在国际上首次突破 AudioSet 50+ mAP,在 HEAR Benchmark 环境声、语音、音乐三大领域建立领先优势并保持至今。

Xiaomi Dasheng 在小米的智能家居和汽车座舱等场景有超过 30 项落地应用。行业首发的车外唤醒防御、手机音箱全天候监控异常声音、“打个响指”环境音关联 IoT 控制能力,以及小米 YU7 上搭载的增强哨兵模式划车检测等,背后都有 Xiaomi Dasheng 作为核心算法的赋能。

MiDashengLM 的训练数据由 100% 的公开数据构成,模型以宽松的 Apache License 2.0 发布,同时支持学术和商业应用。


小米表示,不同于 Qwen2.5-Omni 等未公开训练数据细节的模型,MiDashengLM 完整公开了 77 个数据源的详细配比,技术报告中详细介绍了从音频编码器预训练到指令微调的全流程。


作为小米“人车家全生态”战略的关键技术,MiDashengLM 通过统一理解语音、环境声与音乐的跨领域能力,不仅能听懂用户周围发生了什么事情,还能分析发现这些事情的隐藏含义,提高用户场景理解的泛化性

基于 MiDashengLM 的模型通过自然语言和用户交互,为用户提更人性化的沟通和反馈,比如在用户练习唱歌或练习外语时提供发音反馈并制定针对性提升方案,又比如在用户驾驶车辆时实时对用户关于环境声音的提问做出解答。

MiDashengLM 以 Xiaomi Dasheng 音频编码器为核心组件,是 Xiaomi Dasheng 系列模型的重要升级。在当前版本的基础上,小米已着手对该模型做计算效率的进一步升级,寻求终端设备上可离线部署,并完善基于用户自然语言提示的声音编辑等更全面的功能

IT之家附 MiDashengLM 开源地址:

  • GitHub 主页:https://github.com/xiaomi-research/dasheng-lm
  • 技术报告:https://github.com/xiaomi-research/dasheng-lm/tree/main/technical_report
  • 模型参数(Hugging Face):https://huggingface.co/mispeech/midashenglm-7b
  • 模型参数(魔搭社区):https://modelscope.cn/models/midasheng/midashenglm-7b
  • 网页Demohttps://xiaomi-research.github.io/dasheng-lm
  • 交互Demohttps://huggingface.co/spaces/mispeech/MiDashengLM

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
东方电气,再签880亿订单!

东方电气,再签880亿订单!

投研邦V
2026-01-15 19:45:38
安东尼奥:对中国足球定位要现实;我们能在赛会制抗衡任何队

安东尼奥:对中国足球定位要现实;我们能在赛会制抗衡任何队

懂球帝
2026-01-15 21:59:40
数千万波斯人,不伺候阿塞拜疆权贵了?伊朗今夜,就是百年前清末

数千万波斯人,不伺候阿塞拜疆权贵了?伊朗今夜,就是百年前清末

南宗历史
2026-01-10 16:15:24
确认将关闭102家门店!贾国龙发声:西贝门店从不是预制菜

确认将关闭102家门店!贾国龙发声:西贝门店从不是预制菜

南方都市报
2026-01-15 17:42:08
王毅外长行程已变,外交部发通知,美国强制施压,中肯协议被叫停

王毅外长行程已变,外交部发通知,美国强制施压,中肯协议被叫停

知鉴明史
2026-01-14 22:19:32
惨败40分!广东输在哪?多位媒体人给出看法,有2人点评一针见血

惨败40分!广东输在哪?多位媒体人给出看法,有2人点评一针见血

后仰大风车
2026-01-15 22:24:59
湖北咸宁千名业主买“包租商铺”被“套牢”:12年只收到3万元返利

湖北咸宁千名业主买“包租商铺”被“套牢”:12年只收到3万元返利

封面新闻
2026-01-15 19:37:16
刘强东的物流巨头,要退市了

刘强东的物流巨头,要退市了

投资家
2026-01-15 21:32:39
什么事是你交了男朋友才知道的?网友:鼻子大的真的大还厉害

什么事是你交了男朋友才知道的?网友:鼻子大的真的大还厉害

带你感受人间冷暖
2025-11-12 00:05:08
基辛格离世前预测:若三战爆发,只有3个国家敢打美国,没有中国

基辛格离世前预测:若三战爆发,只有3个国家敢打美国,没有中国

芊芊子吟
2025-12-24 16:40:03
你在部队出过最离谱的公差是啥?网友:出了个差,意外娶了个媳妇

你在部队出过最离谱的公差是啥?网友:出了个差,意外娶了个媳妇

夜深爱杂谈
2026-01-13 20:06:20
多地现快递驿站转让帖,经营者直言太累,称每天工作十几个小时,每月只赚五六千,“不如去当保安”

多地现快递驿站转让帖,经营者直言太累,称每天工作十几个小时,每月只赚五六千,“不如去当保安”

大风新闻
2026-01-14 17:03:09
中国有源相控阵雷达真实水平:并非世界第一,和美差距有多大

中国有源相控阵雷达真实水平:并非世界第一,和美差距有多大

黑翼天使
2026-01-10 03:28:16
一夜间南海12岛礁合体,5800亿吨海水被吸走,东大这盘棋下得高明

一夜间南海12岛礁合体,5800亿吨海水被吸走,东大这盘棋下得高明

趣生活
2026-01-15 19:50:29
交易所出手:上调涨跌停板幅度!

交易所出手:上调涨跌停板幅度!

中国基金报
2026-01-15 18:24:43
6年了,郭麒麟的反击几乎断送了朱亚文的演艺生涯

6年了,郭麒麟的反击几乎断送了朱亚文的演艺生涯

小熊侃史
2025-12-25 11:24:12
章泽天的新播客,干翻了“高知人设”

章泽天的新播客,干翻了“高知人设”

文娱先声
2026-01-15 17:35:18
伊朗有救了!中俄联手尽力保下,普京划红线:美霸权踢到铁板了

伊朗有救了!中俄联手尽力保下,普京划红线:美霸权踢到铁板了

闻识
2026-01-15 17:40:09
随着上海40分狂胜广东,山东8连胜,CBA最新积分榜出炉:广厦领跑

随着上海40分狂胜广东,山东8连胜,CBA最新积分榜出炉:广厦领跑

侃球熊弟
2026-01-15 21:06:07
易炼红同志受邀回浙江开会!

易炼红同志受邀回浙江开会!

社评
2026-01-14 16:07:43
2026-01-15 23:15:00
IT之家
IT之家
爱科技,爱这里 - 前沿科技人气平台
324767文章数 606881关注度
往期回顾 全部

科技要闻

阿里最狠的一次“自我革命”

头条要闻

车主称4S店只卖套餐不给单换:刹车油线下价是线上3倍

头条要闻

车主称4S店只卖套餐不给单换:刹车油线下价是线上3倍

体育要闻

聂卫平:黑白棋盘上的凡人棋圣

娱乐要闻

传奇棋圣聂卫平离世,网友集体悼念

财经要闻

央行再次结构性降息0.25个百分点

汽车要闻

吉利帝豪/缤越推冠军一口价 起售价4.88万

态度原创

教育
旅游
健康
数码
军事航空

教育要闻

学习节奏乱了,怎么补都白搭

旅游要闻

人文经济激活消费新动能|重庆鲁祖庙传统风貌区:百年老街区蝶变烟火新潮地

血常规3项异常,是身体警报!

数码要闻

石头G30S Pro扫地机器人1月20日上市,越障高度突破8.8cm

军事要闻

美国已正式开始出售委内瑞拉石油

无障碍浏览 进入关怀版