据《The Information》发布的最新报告,苹果为 Siri 打造的 AI 新版本在底层架构上有了更多细节曝光,其中涉及英伟达芯片的具体使用方式。
几天前,《The Information》就曾报道苹果在 WWDC 上 AI 规划的部分技术细节,包括苹果预计通过谷歌云借助英伟达芯片处理部分 Siri 查询请求。原报道内容如下:
根据知情人士透露,在苹果与谷歌达成的合作协议中,新版 Siri 的部分用户查询将在谷歌云上运行,使用谷歌 Gemini 模型的授权版本。苹果近期已批准在该场景中使用英伟达的一项隐私保护技术,这意味着苹果将在谷歌云中至少将英伟达 AI 芯片用于部分计算需求。
《The Information》随后发布的新报告进一步披露了英伟达芯片的具体使用方式:
苹果将接入谷歌部署的英伟达 Blackwell B200 数据中心芯片集群,并启用英伟达的机密计算功能,对芯片处理数据的过程进行加密保护。
英伟达 Blackwell B200 是英伟达面向大规模 AI 训练与推理的旗舰级数据中心 GPU,基于 Blackwell 架构打造,该架构是 Hopper 架构的升级继承版本。英伟达将 Blackwell 定位为运行和训练超大型 AI 模型(包括万亿参数规模模型)的核心平台,相较 Hopper 架构,在推理性能、内存带宽及多 GPU 扩展能力方面均有大幅提升。
关于机密计算功能,这是一套基于硬件的安全机制,专门保护英伟达 GPU 在主动处理数据期间的数据安全。根据英伟达官方说明,该功能"可保障部署在 Rubin、Blackwell 及 Hopper GPU 上的 AI 模型的机密性与完整性",使"敏感 AI 工作负载即便在共享或云环境中,也能以接近原生的性能安全运行"。英伟达已就该功能发布了专项白皮书。
报告还指出,苹果此举"与其一贯掌控产品核心要素的战略有所偏离",同时"苹果此前推出的服务器系统 Private Cloud Compute 将如何融入即将发布的新版 Siri 产品,目前尚不明朗"。
Q&A
Q1:苹果新版 Siri 为什么要用英伟达芯片?
A:根据苹果与谷歌达成的合作协议,新版 Siri 的部分用户查询将在谷歌云上借助 Gemini 模型处理。为支撑这一需求,苹果选择接入谷歌部署的英伟达 Blackwell B200 数据中心芯片集群。这一决定被外界视为苹果对其一贯"自研掌控核心部件"战略的一次偏离。
Q2:英伟达 Blackwell B200 芯片有哪些主要特点?
A:英伟达 Blackwell B200 是面向大规模 AI 训练与推理的旗舰数据中心 GPU,基于 Blackwell 架构研发,是 Hopper 架构的升级版本。它支持运行万亿参数级别的超大型 AI 模型,在推理性能、内存带宽和多 GPU 扩展能力方面相比上一代架构均有显著提升。
Q3:英伟达机密计算功能是如何保护用户数据的?
A:英伟达机密计算是一套基于硬件的安全机制,能够在 GPU 主动处理数据的过程中对数据进行加密保护。该功能可保障 AI 模型的机密性与完整性,使敏感 AI 工作负载即便在共享或云环境中,也能以接近原生的性能安全运行,有效防止数据在处理过程中遭到泄露或篡改。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。