关于ZAKER Skills 合作
钛媒体 1小时前

新 Siri 终于开始理解用户“个人上下文”了

文 | 字母 AI

北京时间 9 月 10 日凌晨 1 点,加州库比蒂诺还是上午 10 点,苹果一年一度的秋季发布会在 Apple Park 拉开帷幕。

熟悉的库克这次只在开头短暂露面,随后便把舞台交给了约翰 · 特努斯。这是特努斯接任苹果 CEO 之后的首场秋季发布会,也是他真正意义上的一次 " 首秀 "。

这场首秀里,激进和稳扎稳打同时出现。硬件上,苹果拿出了等待多年的首款折叠屏 iPhone Duo,自然抢走了最多目光。但如果把视线从那块可以对折的屏幕上移开,苹果在 AI 上的变化同样值得关注。

新 Siri 确定将在本月进入 Beta,Apple Watch 第一次开始通过音频智能感知用户周围的声音,特努斯还给 iPhone 确定了一个新的身份——目前世界上最好的 " 智能个人中枢 "。

特努斯将 AI 设备赋予了智能个人中枢的概念,表示如果想象其理想状态,iPhone 依然无出其右。

苹果过去两年一直在讲的 " 个人智能系统 ",到这场发布会终于有了更清楚的轮廓。iPhone 仍然处在中心,Siri 是用户最直接的 AI 入口,手表等设备则开始承担新的感知任务。

相比单个功能的更新,这种跨设备协同,可能才是苹果这次在 AI 上更值得关注的进展。

新 Siri 的大日子终于确定了

新 Siri 什么时候真正到普通用户手里,这个问题终于有了一个明确日期。

在刚刚结束的苹果秋季发布会上,Siri AI 再次被拉到台前。苹果没有花太多时间重新解释这套系统,而是直接把它放进 iPhone 18 Pro 的日常使用场景里,重点展示它对屏幕内容和个人信息的理解能力。

这也是新老 Siri 最明显的区别之一。

比如朋友几个月前在聊天里随手推荐过一家餐厅,你只记得 " 好像有人跟我提过 ",Siri 可以从历史消息里把它找出来。订酒店的确认邮件沉在邮箱深处,也可以直接问 Siri 要确认号码。想找上次旅行时和几个朋友一起拍的照片,也不需要再一张张翻相册。

Siri 第一次真正拥有了对用户 " 个人上下文 " 的理解。

它也能看懂 " 眼前 " 正在发生什么。比如聊天窗口里朋友突然约周末聚餐,Siri 可以根据屏幕里的对话帮你想带什么菜,接着再把找到的菜谱加进备忘录。打开相机后,新的 Siri 模式还能直接理解镜头前的东西:对着一盘食物拍一下,它可以提供营养信息。遇到需要 AA 的账单,也可以根据画面继续执行操作。

至于那些和 ChatGPT 更相似的能力,新 Siri 也补上了。它可以直接上网回答开放问题,比如下一次日食什么时候发生、某位歌手什么时候来当地演出,并且允许用户继续追问。写邮件、改文字这些生成式 AI 的常规工作,也被直接塞进了 Siri。苹果还给它做了一个独立的 Siri App,过去和 Siri 聊过什么,可以在不同苹果设备之间同步,再回头接着聊。

不过需要明确的是,从具体功能看,这次发布会并没有给 Siri AI 加什么新料。

个人上下文、屏幕理解、联网回答、跨 App 操作、相机里的视觉理解,包括独立 Siri App,苹果在 6 月 8 日的 WWDC 上就已经完整公布。当时苹果已经把 Siri AI 称为 " 一套全新的 Siri",并开放给开发者测试。

此次秋季发布会新增的关键信息,是苹果终于把面向普通用户的时间定了下来。

9 月 14 日,Siri AI 将随 iOS 27 正式进入 Beta 阶段。

首批要求设备支持 Apple Intelligence,同时系统和 Siri 设置为英语。法语、日语、韩语、葡萄牙语和西班牙语将在 10 月跟进。Apple Watch 这边同样会在 9 月 14 日随 watchOS 27 获得 Siri AI Beta。

但中国用户暂时还得继续等。

发布会的相关画面中明确写着 "Siri AI 在欧盟地区和中国将不可用 "。

苹果手表实时 " 偷听 "?

如果只看 Siri AI 本身,这场发布会带来的意外其实不算多。正如前文所说,新 Siri 在 6 月已经亮过相,这次更多是把上线时间敲定下来。

倒是苹果手表 Apple Watch 这边,苹果悄悄塞进了一个很值得关注的新东西:Audio Intelligence,即音频智能。

按照苹果自己的定义,它是一组利用苹果手表麦克风、苹果芯片,以及端侧和云端 AI 模型来理解周围声音的苹果智能的功能。

目前音频智能一共包含四项能力:

. Sound Recognition,声音识别

. Shazam 的自动音乐识别

. Live Rewind,实时回溯

. Siri Recap,Siri 摘要

声音识别负责识别重要的环境声音。门铃响了、警报器响了、附近传来婴儿哭声,手表都可以识别并向用户发出提醒,即使当时 iPhone 并不在身边。苹果尤其强调,这项功能是为失聪或听力障碍用户设计的。

Shazam 则把 " 听歌识曲 " 变得更无感丝滑。

Shazam 早就进入苹果手表了,但是以前想用它听歌识曲需要专门打开 Shazam,就像任何音乐 App 的识曲功能一样。现在新 Apple Watch 会自动识别周围正在播放的音乐。你不用点 " 听歌识曲 ",也不用问 Siri。它识别出来以后,会把歌名和歌手直接显示在智能叠放里的 " 音乐识别 " 小组件里。苹果专门强调 " 一下都不用点 "。

更有意思的是实时回溯。

假设你正在一家很吵的餐厅聊天,对方刚刚说了一句话,你没听清。只能再问一遍。现在双击手表的数码表冠,它可以把刚刚过去 15 秒里说过的话转成文字显示出来。你也可以继续追问 Siri 这句话是什么意思,或者把这段文字存进新的 Siri App,之后再看。

可以看出这个回溯功能和 Siri 是有联动的。

最后一个 Siri 摘要功能也是如此。

比如开会、和同事讨论事情,或者健身时教练连续交代了一串动作,只要用户提前开启 Siri Recap,Apple 智能就可以在谈话结束后自动生成一个标题和几个关键要点,放进 Siri App。

也就是说,手表会随时帮你 " 记笔记 "。

很明显,手表开始承担一种以前并不明显的角色,即替整个 Apple 智能系统感知用户身边的现实环境。

需要说明的是," 手表开始听周围世界 " 并不等于 " 苹果所有设备从此都在实时偷听 "。

苹果目前把音频智能(Audio Intelligence)严格限制在 Apple Watch Series 12 和 Apple Watch Ultra 4 上。

声音识别(Sound Recognition)和自动 Shazam 需要搭配 iPhone 11 或更新机型,或 iPhone SE 第二代及更新机型,并运行 iOS 27。而实时回溯(Live Rewind)和 Siri 摘要(Siri Recap)要求更高,需要一台支持 Apple Intelligence 的 iPhone 16 或更新机型,但不包括 iPhone 16e,同时开启苹果智能(Apple Intelligence)和 Siri AI。一名只有 iPhone、没有这两款新手表的用户,目前并不能使用回溯和摘要。

苹果也给这套能力加了不少限制。比如实时回溯只会在用户主动触发后调出此前 15 秒的内容,Siri 摘要也需要手动开启,还可以按时间和地点设置使用范围。

系统不会保存原始录音,涉及摘要时,音频会加密传到 iPhone 处理,必要时再调用苹果的私有云计算,处理完成后删除。苹果也很清楚,让 AI 走到感知现实环境的程度,隐私问题会敏感得多。

苹果手表这次承担的新角色尤其值得关注,这背后其实代表着苹果设想中那个横跨设备、深入生态的 " 个人智能系统 " 的逐渐成型。

特努斯说,iPhone 就是最好的 " 个人智能中枢 "

如果是这两年一直关注苹果 AI 动向的朋友,现如今可能已经被若干名词绕晕了。比如苹果智能(Apple Intelligence)、Siri AI、音频智能(Audio Intelligence),还有苹果反复提到的 " 个人智能系统(personal intelligence system)",以及这次发布会上新出现的 " 智能个人中枢(intelligent personal hub)"。

其实把这些概念之间的关系搞清楚,苹果目前的 AI 路线也就了然了。

苹果谈及 " 个人智能系统 " 这个概念最早可以追溯到 2024 年。那年苹果第一次发布苹果智能(Apple Intelligence)的时候,就把它定义为一套 " 个人智能系统 "。

两年后,特努斯在这场发布会上又补上了一个很重要的概念 " 智能个人中枢 ",而他给出的答案就是 iPhone。

所以苹果智能(Apple Intelligence)是覆盖整个苹果生态的 " 个人智能系统 ",iPhone 则被苹果明确放在了这套系统的中心位置。

特努斯先描述了自己心中理想的 AI 设备——它要了解用户的个人信息,随时待在身边。既有足够强的芯片在本地运行模型,也能联网调用云端。还要有屏幕、摄像头和麦克风,能够看见、听见周围的世界,并且可以和其他设备、App 及服务配合。

按照这套标准讲完,他最后把答案落到了一个非常熟悉的产品上:没有什么设备比 iPhone 更适合成为用户的 " 智能个人中枢 "。

苹果随后在 iPhone 18 Pro 的官方介绍中,也直接使用了这个定位。

Siri AI 则成为用户调用这些能力最直接的入口之一,可以理解个人上下文、看懂屏幕内容,再根据用户的要求继续完成操作。

这时再回头看前面提到的音频智能,苹果手表的新角色也就比较好理解了。

苹果手表过去已经可以接收 iPhone 上的部分苹果智能能力,这次又增加了对周围声音的感知。苹果自己的技术说明里表示,音频智能同时利用手表的麦克风和 S11 芯片、iPhone 上的 Apple Intelligence 模型,以及苹果的私有云计算。也就是说,一项功能可以横跨手表、手机和云端完成。

这正是苹果 " 个人智能系统 " 开始成型的一个具体例子。

如果苹果继续沿着这条路往下走,耳机、平板等设备未来也可能承担各自不同的任务,演化出不同的分支 "intelligence",变成 iPhone 这个 AI 中枢向外延伸的 " 感官 "。

苹果手里的硬件越多,这套个人智能系统可以获得的信息和交互入口也会越丰富。

AI 时代,不少公司都在寻找一种能够取代手机的下一代终端。特努斯在自己上任后的第一场产品发布会上,将信心给到 iPhone。

特努斯上任后的 " 首秀 ",或说首场 " 大考 ",亮点还是非常多的。更重要的是,苹果拿出了激进与稳扎稳打的双重姿态。

硬件上,苹果拿出了久违的全新品类 iPhone Duo,正式进入折叠屏手机市场。AI 这边,新 Siri 终于确定上线时间,手表也开始承担新的感知任务。

苹果这两年一直在讲的 " 个人智能系统 ",到这场发布会之后,总算变得更具体,也更容易看懂了。

看发布会的时候,不由得想起库克那句魔性的 " 只有苹果能做到(Only Apple can do)"。苹果向来不是一家搞 " 新发明 " 的公司,它从创立之初就多次展现 " 后发优势 ",也许它终于在 AI 时代咬合了齿轮,开始做最擅长的事。

相关标签

相关阅读

最新评论

没有更多评论了

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容