关闭广告

小米开源语音大模型Xiaomi-MiMo-Audio,对话自然度达拟人水准

IT之家123人阅读

IT之家 9 月 19 日消息,小米今天宣布开源首个原生端到端语音大模型 Xiaomi-MiMo-Audio,首次在语音领域实现基于 ICL 的少样本泛化

据小米介绍,五年前 GPT-3 首次展示了通过自回归语言模型 + 大规模无标注数据训练,获得 In-Context Learning(ICL,上下文学习)能力,而在语音领域,现有的大模型仍严重依赖大规模标注数据难以适应新任务达到类人智能

而 Xiaomi-MiMo-Audio 模型打破了这种瓶颈,它基于创新预训练架构和上亿小时训练数据,在智商、情商、表现力与安全性在内的跨模态对齐能力均有提升,在自然度、情感表达和交互适配方面呈现出拟人化水准

这款模型的具体创新点如下:

  • 首次证明把语音无损压缩预训练 Scaling 至 1 亿小时可以“涌现”出跨任务的泛化性,表现为 Few-Shot Learning 能力。

阅读全文
版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

外媒:越南在侵占的南海岛礁上建起对海空防御系统

环球军事时报 浏览 25689

美媒:美国欲在中东部署更多“海上机器人”

参考消息 浏览 17717

这条裙子又火了!穿得花一点才好看

LinkFashion 浏览 9953

夏天少穿短裤、短裙,跟着气质女神穿衣服,才能美得优雅得体

静儿时尚达人 浏览 9327

上海又现排队盛况 有人为赠送的LV帆布袋花880元买书

新民晚报 浏览 86102

俄专家:中国或提出俄乌谈判方案 但乌方可能拒绝

环球网资讯 浏览 18057

女主明明很漂亮却让人不想追剧 问题出在哪?

不八卦会死星人 浏览 15384

黑龙江发现罕见化石,国内首个白垩纪树蕨茎干化石生物群

趣看热点 浏览 24862

电讯报:面对球迷冲场+燃放烟花,欧足联对温布利安保总体满意

懂球帝 浏览 9776

出圈1年多后流量下滑?刘畊宏回应

新金牌娱乐观察家 浏览 12188

每公里仅需1毛钱 福田祥菱Q双排座纯电微卡实拍

提加商用车网 浏览 11756

专家:普京释放强烈信号 要将特别军事行动"进行到底"

看看新闻Knews 浏览 93398

进军游戏业!奈飞考虑战略转型 从视频游戏中获取新利润

第一财经资讯 浏览 11320

今年最火的5双鞋,承包一整年的好看时髦!

LinkFashion 浏览 11408

五六十岁男人:不建议留这3种发型,听着洋气,实际显老油腻

潮人志Fashion 浏览 9999

尤文伤情更新:小基耶萨麦肯尼已能合练,拉比奥特得等到周四

直播吧 浏览 11369

退市高危?证监会查明史上最贵ST股涉嫌重大财务造假

网易财经 浏览 11515

外媒:俄罗斯多家电台遭黑客攻击 伪造普京讲话

参考消息 浏览 15825

埃弗顿前锋莫派:哭泣并不可耻,C罗也是有感情的普通人

直播吧 浏览 9414

与英国意大利签署协议 日本拉北约两国造隐形战机

环球网资讯 浏览 12002

日本首次向海外部署F35战机

央视军事 浏览 13374
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除
沪ICP备20017958号-1