阿里巴巴开源“高情商”语音AI 交互体验直逼真人

小科同学 • 2025年12月25日 12:17:00 • AI

据报道，阿里巴巴通义实验室正式开源新一代端到端语音交互大模型Fun-Audio-Chat-8B，以超低延迟、自然流畅的交互体验，推动开源语音AI进入全新阶段。该模型不仅能实时理解用户语音，还具备强大情感感知能力，性能直逼闭源巨头GPT-4o Audio和Gemini2.5Pro，被AIbase誉为“AI语音伙伴”。

用户只需开口说话，模型即可即时理解并回应，彻底摆脱传统ASR+LLM+TTS多模块拼接的延迟痛点，实现端到端Speech-to-Speech架构。核心技术亮点包括：采用创新双分辨率架构，GPU计算资源节省近50%，响应速度大幅提升；能从语气、语速等细节感知用户情绪，提供共情回应；支持Voice Function Calling，通过语音指令执行复杂任务。

在OpenAudioBench等多项国际权威测试中，该模型同尺寸排名第一，综合能力超越GLM4-Voice等开源竞品，部分指标媲美或领先闭源顶级模型。其应用场景丰富，涵盖情感陪伴、智能设备控制等。

此次开源包括完整模型权重、推理代码和Function Call示例，极大降低开发者门槛。感兴趣的开发者可立即前往GitHub、Hugging Face或ModelScope下载体验，开启“高情商”语音AI时代。

原创文章，作者：小科同学，如若转载，请注明出处：https://www.kejixun.co/article/742028.html

AI Fun-Audio-Chat-8B 阿里巴巴

小科同学

0 0

AI

谷歌将计算机使用工具直接集成至Gemini，AI从对话者进化为数字同事

谷歌昨日对其人工智能生态系统进行重大升级，正式将原生的“计算机使用”工具直接集成至Gemini 3.5 Flash模型中，全面取代此前的Gemini 2.5测试框架。这一举措标志着…

Google
10小时前
新闻

美政府施压Meta提交AI模型接受安全审查

据《纽约时报》援引知情人士消息，美国政府正加紧向Meta公司施压，要求其主动提交人工智能模型供政府审查，以便评估这些前沿技术的功能表现与潜在安全漏洞。这一举措是美国政府强化AI监管…

好奇宝宝
2天前
AI

京东开源实时视频交互模型，让AI从“一问一答”走向“边看边说”

京东近日正式开源了实时视频视觉语言交互模型JoyAI-VL-Interaction，这是全球首个全栈开源的交互式视觉模型与可部署系统，并获得vLLM-Omni的day-0原生支持。…

小科同学
3天前
AI

Meta暂停监控员工键盘鼠标的AI项目，因数据泄露致内部敏感信息外泄

据Business Insider报道，Meta公司已紧急叫停一项名为“模型能力计划（MCI）”的AI训练项目，该项目原本用于记录公司内部员工的键盘敲击和鼠标操作轨迹，以收集训练数…

李小白
3天前
AI

亚马逊在ChatGPT打广告引流，却严防AI爬虫抓取自家数据

美国电商巨头亚马逊近日被曝已开始在ChatGPT平台投放广告，成为入驻OpenAI新兴广告业务中最具分量的零售企业。用户在使用ChatGPT搜索商品时，对话列表下方会直接出现亚马逊…

李森
3天前
AI

Getty Images牵手OpenAI：图库内容将融入ChatGPT搜索体验

全球视觉内容巨头Getty Images日前宣布与OpenAI达成一项展示合作协议，标志着AI对话工具与正版视觉素材的融合再进一步。根据协议，Getty Images获得授权的海量…

AI
4天前
AI

纽约大学教授警告：AI泡沫破裂后果或超互联网泡沫

据外媒昨日报道，纽约大学金融学教授阿斯沃斯·达摩达兰发出严厉警告，称若当前AI行业泡沫破裂，其冲击可能比2000年前后的互联网泡沫更为严重。达摩达兰指出，AI热潮与当年互联网泡沫存…

泡沫大盗
5天前
AI

微信原生AI助手“小微”扩大灰度测试，一句话即可生成小程序

近日，微信原生AI助手“小微”开始扩大灰度测试范围，多个平台上陆续有用户反馈获得了体验资格。腾讯客服确认，“小微”目前仍处于测试阶段，支持通过文字或语音对话操作微信原生功能，例如调…

AI
5天前
新闻

亚马逊工程师因公开批评AI数据中心扩张遭内部调查

美国CNBC当地时间18日报道，多名亚马逊工程师因在公开场合批评公司AI数据中心迅速扩张并呼吁政府加强监管，随后遭到亚马逊内部调查，甚至面临解雇风险。本月早些时候，5名亚马逊员工在…

若安丶
6天前
AI

黄仁勋呼吁社会全面拥抱AI，类比汽车适应时代

当地时间6月17日，英伟达CEO黄仁勋在接受美联社采访时再度为人工智能热情发声，他呼吁社会必须主动改变，更积极、更广泛地拥抱AI，以改善人们的生活并加速经济增长与科学突破。面对AI…

若安丶
2026年6月19日
AI

OpenRouter推出Fusion API复合模型服务多模型协同兼顾性能与成本

近日，知名AI模型聚合平台OpenRouter推出一项名为Fusion API的复合型模型服务，通过多模型协同的方式为用户提供兼具性能表现与成本效益的解决方案。该服务并非依赖单一模…

小丸子
2026年6月17日
AI

阿里巴巴发布千问具身智能大模型系列为机器人打造通用底座

昨日，阿里巴巴正式推出千问具身智能大模型Qwen-Robot系列，为各类机器人提供能够理解自然语言、感知三维环境并掌握物理规律的“通用底座”。该系列包含三款核心模型，既可独立执行…

AI
2026年6月17日
商业

DeepSeek完成逾70亿美元融资创始人梁文锋以特殊架构保持绝对控制权

据国外媒体报道，AI大模型独角兽DeepSeek（深度求索）日前以非常规交易架构顺利完成首轮逾70亿美元（约合500亿元人民币）融资，投后估值突破500亿美元大关。本轮融资的最大创…

商业头条
2026年6月17日
AI

豆包上线“任务模式”，从聊天助手向AI智能体进化

字节跳动旗下AI对话助手豆包近日正式推出“任务模式”入口，标志着这款产品正从单一的文本交互工具向具备复杂工作流处理能力的AI智能体演进。作为豆包功能拓展的重要一步，“任务模式”主打…

AI
2026年6月16日
AI

苹果或推AI智能体让Siri自主操作用户设备，古尔曼预测对标“OpenClaw”

彭博社知名记者马克·古尔曼近日预测，苹果公司最终可能推出一套能够代用户自主操作各类软件的智能体AI系统，直接对标业界关注的“OpenClaw”项目。古尔曼在其专栏《Power On…

Apple
2026年6月16日
AI

讯飞医疗发布星火大模型V3.5，AI医疗赛道迎来实用化转折

AI医疗行业的竞争逻辑正发生深刻变化。6月9日，讯飞医疗正式发布基于全国产算力底座训练的星火医疗大模型V3.5。与以往单纯追求参数规模的行业风向不同，这款新模型将目光锁定在临床诊疗…

AI
2026年6月15日
AI

高盛研报：市场低估AI需求，资本支出将远超预期

知名投行高盛近日发布行业研报指出，当前市场普遍低估了人工智能领域的发展需求，超大规模数据中心运营商的AI相关资本支出将大幅超出行业预期。数据显示，华尔街目前预估2027年相关资本支…

秋秋
2026年6月15日
新闻

谷歌CEO皮查伊斯坦福毕业演讲避谈AI，鼓励毕业生“选择乐观”

当地时间周日，谷歌首席执行官桑达尔·皮查伊在斯坦福大学毕业典礼上发表演讲。与近期其他科技领袖的毕业致辞不同，皮查伊对人工智能几乎只字未提，而是转而鼓励毕业生“选择乐观”。这一回避…

Google
2026年6月15日
新闻

Android安全负责人辞职，控诉谷歌“丧失道德底线”

据Business Insider周四报道，谷歌Android平台安全负责人、高级工程师René Mayrhofer已从公司离职。他在一封落款5月18日的内部告别信中直言，谷歌管理…

Android
2026年6月14日
商业

OpenAI收购云环境初创公司Ona，为编程助手Codex打造安全部署基石

OpenAI昨日宣布收购初创公司Ona，后者专注于为AI智能体提供安全、预配置的云环境。双方未披露交易金额，Ona团队将整体加入OpenAI并参与Codex项目研发。这项收购旨在帮…

野游栗
2026年6月12日

发表回复

登录后才能评论

阿里巴巴开源“高情商”语音AI 交互体验直逼真人

相关推荐

发表回复