小米AI实力再次得到验证,声音识别算法能力国际排名第一

小米自研声音识别算法取得最新进展,算法模型领先其他机构,性能国际排名第一。小米是在 Google 发布的 AudioSet 音频标记任务中获得的这一突破

近日,小米自研声音识别算法取得最新进展,算法模型领先其他机构,性能国际排名第一。小米是在 Google 发布的 AudioSet 音频标记任务中获得的这一突破。它是音频标记任务影响力最大的数据集,被认为是声音领域的 ImageNet (注:计算机视觉领域最著名的数据集,由著名学者李飞飞等主持发布),权威性颇高。

Google 将 AudioSet 数据集分为三个子集,前两个子集用于训练,被合并称为 “AudioSet-2M”。正是在这个合并后的训练集中,小米的声音识别算法模型首次在业界突破了50 mAP,刷新了音频标记技术指标,成为截至目前性能最好的模型。此外,小米还发布了一个 Mini 版模型,适合资源受限的场景。该模型的参数量被压缩到了原模型的约九分之一,远小于其他机构的模型,但性能却优于其他所有机构。

这项技术的突破意味着小米的声音识别算法能力再次精进,小米的众多智能硬件设备应用此项技术后,可以更敏锐地捕捉和识别环境声音,大幅提升硬件的智能化程度,从而为用户创造更加便捷的智能生活体验。

不仅如此,小米声音识别算法下的音频标记技术能力,还为业界的前沿研究提供了巨大的技术价值,有力推动了相关研发进程。

(9月11日,小米集团科协成立暨院士专家工作站授牌仪式在京举行)

中国科协党组成员、书记处书记殷皓在当天的授牌仪式活动中表示,小米集团科协的成立,体现了小米集团高管对科技创新工作的高度重视。他指出,期待小米集团科协充分发挥资源优势,大力普及科学知识,拓展开放合作,共同营造具有全球竞争力的开放创新生态。

中国工程院院士丁文华成为小米院士专家工作站的首位进站院士。他指出,在以手机镜头为代表的成像技术领域,小米实现了光学镜头小型化的重大突破,是行业的佼佼者。小米已经牵头成立了智能图像处理北京市工程研究中心,他希望未来能够努力升级为国家工程研究中心。他还表示,期待与小米科技工作者团队共同开展关键技术攻关,推动行业向前发展。

在新的科技战略指引下,小米正朝向着世界科技巨头的目标锐意进取。而在历经十三年的丰厚积淀,又汇聚起强大外部科研力量后,小米势必迸发出更加强劲的创新活力。

原创文章,作者:科技观察者,如若转载,请注明出处:https://www.kejixun.co/article/581230.html

科技观察者的头像科技观察者管理团队

相关推荐

发表回复

登录后才能评论