WWDC 最值得关注的三个细节和变化

2024-06-11

发布会内容的重新分类

不按照发布会的节奏和流程,把整体的发布会内容重新做了一个分类,大概可以分为系统,应用,硬件,以及新服务。

从它整个体系的产品更新和能力更新来看,苹果在这个维度的思考是同时兼顾了硬件和技术的发展进程来做的决定,当然更核心的点在于他如何思考硬件和 AI 的关系:是硬件加 AI 还是一个新的 AI 硬件,这是不同立场的问题。

开放还是封闭,这是一个权衡

这次苹果最大的亮点在于和模型厂商的接口互相调用,从今天的发展状态来说,模型为应用提供的能力和价值体系实际上超过过往系统为应用提供的范畴,从而从根本上提升用户体验,Siri 过往的目标也是如此,从系统层面直接为用户打造一个一体化的服务。

而硬件本身需要面临的问题是不要让自己只成为数据的输入输出终端,而不对整个应用的服务提升有改善,这一点其实是一个微妙的选择和平衡。用户对硬件需求,但是这个需求又不为硬件提供额外价值,服务体系全部由模型或应用来完成,在今天本身硬件体系的想象空间和发展的瓶颈越来越严重的时候,这一点是硬件厂商不愿意看到的,

过去硬件和系统本身的服务匹配,这套完整体验由封闭系统来垄断,但是如果模型能力可以创造更新的体验或者可以革新用户的整个使用流程,而基于硬件这套能力构建起来的体系和生态不能提供给用户超预期的需求和体验,用户就有可能会换新的平台。

所以这也是硬件厂商接下来需要思考的问题:如何处理自己和模型之间的关系,这个核心点在于硬件厂商如何处理自己硬件能力和模型厂商之间能力关系的定义,苹果的逻辑就是开放接口,你们来接入,在一定程度上互相配合。

个人感觉这是一个长期的状态,未来也取决于硬件本身的能力迭代和模型的能力迭代。

数据隐私的边界

苹果在另一个维度里面的努力是基于硬件本身来对用户的数据做一层隐私隔离,硬件作为数据的采集终端是数据的第一载体,用户在拥有这个硬件的时候,理论上对数据本身的权利也要做保护。而大部分的用户未必拥有对数据隐私很好的保护意识,所以硬件在这个维度里套了一层壳来帮助用户做数据维度的隐私保护。

举个例子,未来我在需要问模型一个关于图片细节的时候,是我把这个图片直接发给模型来帮我处理,还是硬件本身套了一层保护壳,把图片的关键数据丢给模型来处理就可以,虽然看起来只是处理方式不同,但它背后是对于数据的隐私要求属于完全不同的量级:一个是几乎没有隐私,而另一个是几乎不暴露隐私。

这个问题接下来会越来越突出和越来越明显,不管是用户的语音数据图片数据视频数据,还是所有通过硬件这个接口采集进来的所有数据,都会面临到是直接发给模型厂商(应用厂商)还是中间桥接一套用户的隐私保护体系,只提供关键要素来完成对用户的服务,除了数据处理维度之外,更重要的是不同的处理方式会面临不同的法规审查和不同场景里面对于隐私严苛程度的要求,也会一定程度上影响模型本身的能力进化和之后为用户提供服务的准确性。可能接下来隐私和体验的博弈不是用户和应用,而是用户和模型的直接博弈了。

今天看起来苹果是想要自己下场来处理关于这一部分的隐私问题,去定义用户数据和模型之间的隐私边界。

端侧模型的尝试逻辑

这次发布会还有一个关注点是端侧模型的尝试逻辑,手机今天的处理能力大部分时候是被限制并且没有很好的利用起来的。模型和应用今天选择使用云端来完成服务一定程度上也是考虑到用户体验和效果之后做的选择,但作为硬件厂商来说,如果能够把自己设备端侧的能力提供出来,降低应用的一部分服务成本,提升用户的使用体验,也会增加应用或者用户对于设备的依赖。

今天这个发布会里还没有看到苹果把手机硬件的处理能力打包成 API 出来让其他应用直接调用的这个过程,或者还不是特别明显的看到这个情况,但接下来苹果应该会着重在端侧的能力优化和 API 能力的输出。

比如今天苹果自带相册里关于图片处理的部分能力仅还只是在苹果自己的系统应用里做了集成,未来是不是有可能把这个能力开放为接口,让其他应用来集成或者直接让其他应用使用本地的能力,比如图片识别翻译,图片的背景抠图,甚至更高维度的关于内容识别和输出,这一点上相信苹果有意愿开放这个能力,微软已经把自己的做法公开了,一定程度上也证明了这条路径的可行性。

当然最悲伤的事情在于,过往一旦苹果的系统能力升级,有一堆应用宣告服务历程的结束,而在模型时代,这会是个常态。

5 月 23 日:微软给你人生的时光机

返回首页 · 全部文章 · 专题 · RSS