苹果发布Audio Intelligence功能 端侧声学模型迎来系统级重塑

2026年09月10日 13:12 次阅读 稿源:cnBeta.COM 条评论

伴随全新硬件与操作系统的集中亮相,苹果公司正式揭晓了一系列基于端侧深度学习算法打造的“音频智能”(Audio Intelligence)前沿功能。这套全新声学技术体系深度整合至iOS 27、macOS Golden Gate以及新一代AirPods 5与AirPods Pro固件之中,将苹果的人工智能战略从传统的文本与图像模态进一步拓宽至听觉感知维度,带来了面对面实时翻译、动态智能降噪以及演播室级的人声与背景杂音智能分离体验。

作为音频智能体系的核心亮点,全新推出的实时同声传译功能彻底打破了穿戴设备在跨语言沟通中的交互瓶颈。依托搭载于设备本地的新一代神经处理引擎,佩戴兼容AirPods的用户在与使用不同语言的人士面对面交流时,系统可自动识别对方的语种并实时在耳机内进行低延迟的双向语言转译;而在需要时,用户亦可通过语音指令或轻按耳机柄,直接调用iPhone外放合成翻译后的自然语音。由于整套音频翻译管线在端侧芯片的超高带宽支持下本地闭环运行,整个传译过程不仅响应极为迅速,且完全无需将用户的私人语音对话上传至云端服务器,兼顾了即时性与严格的隐私安全防护。

除了跨语言传译,苹果还将计算声学深度下放至日常音频拾取与通话降噪场景。全新升级的“智能人声隔离”(Voice Isolation 2.0)技术利用经过数百万小时复杂环境声学数据训练的神经分离模型,能够在极其嘈杂的开放空间中精准剥离出扬声器的主要人声,将地铁呼啸声、餐厅盘碟碰撞声、呼啸的风噪以及周遭多重交谈声彻底压制为背景虚化底噪,使普通的免提通话、FaceTime视频会议乃至随手录制的语音备忘录都能呈现出媲美专业隔音录音棚的清澈收音质感。针对多方开会的复杂场景,该模型还支持智能识别人脸朝向与麦克风波束成形角,自适应追踪主要发言人的声音轨迹。

在针对创作者的音频处理方面,音频智能工具集也带来了革命性的内容重构能力。在搭载M系列芯片的Mac及最新一代iPhone设备上,用户在编辑视频或处理多音轨音频工程时,可通过原生集成的AI声学工具一键将单一音轨拆分为纯净的人声、伴奏乐器与环境音轨。这一“音轨剥离”功能不仅支持无损导出,还允许创作者针对不同成分独立调节音量增益或施加混响特效,大幅降低了影视后期配音替换、播客去噪以及混音创作的技术门槛。

此外,针对音乐与视频播放体验,音频智能还引入了进阶版“自适应听感”(Adaptive Hearing)算法。该系统能够利用耳机麦克风阵列实时检测用户当前的耳道密封状态、外部环境声级以及所处空间的声学混响反射,以每秒数千次的频率动态重构均衡曲线与空间音频定位,从而在不同佩戴姿态和复杂动态环境下,持续为用户提供高度一致且精准平衡的听觉声场。

声学与软件工程分析人士指出,苹果此次推出的音频智能功能集,标志着端侧AI在手机与耳机等边缘终端上的落地应用正变得愈发具象与实用。通过将自研芯片的超高带宽与极低功耗神经算力紧密咬合在系统声学底层,苹果不仅赋予了AirPods等传统音频配件更强的计算终端属性,也进一步巩固了其生态软硬件无缝协同的核心技术护城河。全套音频智能功能将随9月14日推送的系统正式版更新以及新硬件的发售逐步向全球用户正式开放。

对文章打分

苹果发布Audio Intelligence功能 端侧声学模型迎来系统级重塑

1 (50%)
已有 条意见

    最新资讯

    加载中...

    编辑精选

    加载中...

    热门评论

      Top 10

      招聘

      created by ceallan