Salesforce近日宣布了"Headless 360"计划,将Salesforce、Agentforce和Slack平台以API、MCP和CLI的形式对外开放,智能体可直接访问数据、工作流和任务,无需任何浏览器用户界面(UI)。
Salesforce的动作具有风向标意义。未来的UI走向正逐步转向服务于智能体,不再需要精美的图形、可点击的按钮或交互入口。WorkOS创始人Michael Grinich在4月旧金山举办的TypeScript AI Demo Day上对这一趋势进行了深入探讨,并直言:"我们正在告别UI时代。"
Grinich表示,UI正在从我们几十年来熟悉的固定静态界面,演变为"即时生成"的投影层,以简单文本框的形式呈现。在很多场景下,用户将不再直接与UI交互——应用程序将通过绑定AI输出或智能体的API来交付结果。用户所看到的界面,他解释道,将是"一次性的——一个按需生成、用完即弃的界面。当你需要新的,直接生成一个新的。"
这开启了软件开发的全新阶段——当下及未来的解决方案正变得更加自驱动、更具自主性。"软件正从你操作的界面,转变为能够产生结果的系统,"他说,"用户表达一个意图、一个想法,将其发送给模型,由模型来创建UI和执行操作。"
在这一过程中,AI正在重塑人机交互界面——而颇具讽刺意味的是,这反而让计算变得更以人为中心。生成式AI作为有史以来增长最快的技术之一,呈现给用户的只是一个简单的文本框,问道:"你想要什么?"
UI的演进历程经历了"从开关到命令行,从鼠标指针到触控,再到如今的自然语言",他说,"得益于语言模型,我们迎来了突破——UI现在是被合成出来的,根据每次请求即时生成,具备上下文感知能力,能够即时理解你的目标和所处环境。"
这也意味着用户角色的深刻转变。Grinich指出,"用户的角色已从操作者转变"——不再只是单纯的使用者,而是成为协作者,并最终成为AI智能体的指挥者。
Grinich为技术从业者提出了四条应对这一转型的建议:
硅谷知名创业孵化器Y Combinator有一句经典的单行指令:"做人们想要的东西。"Grinich对此略作修改:"我会稍作调整:'做智能体想要的东西。'智能体将替人们完成各种事务。如果你想服务于人,也需要同时服务于他们的智能体。"
Q&A
Q1:什么是"一次性UI"?它和传统UI有什么区别?
A:一次性UI是指由AI模型按需即时生成的用户界面,用完即弃,不再固定存在。与传统UI不同,它不依赖预先设计的固定界面,而是根据用户当下的意图和上下文动态生成,更灵活、更轻量。这一概念由WorkOS创始人Michael Grinich提出,代表了UI从静态界面向智能生成层的根本性转变。
Q2:Salesforce的"Headless 360"计划具体是什么?
A:Salesforce的"Headless 360"是指将Salesforce、Agentforce和Slack等平台以API、MCP和CLI的方式对外开放,使AI智能体可以直接访问数据、工作流和任务,完全不需要传统的浏览器用户界面。这标志着企业软件正式迈入以智能体为核心的无界面交互时代。
Q3:在UI进入智能体时代后,技术从业者应该如何转型?
A:根据WorkOS创始人Grinich的建议,技术从业者应将服务对象从"人"扩展到"智能体",即不仅要构建人类友好的产品,还要构建智能体可以调用和操作的接口与服务。用户角色也在从操作者转变为智能体的协作者乃至指挥者,开发者需要相应调整产品设计思路。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。