谷歌DeepMind推出全新AI智能体SIMA 2,该系统能够学会玩多款视频游戏,包括《无人深空》、《英灵神殿》和《山羊模拟器3》等,成为可行的"交互式游戏伙伴"。
SIMA 2基于早期版本构建
这款新智能体工具SIMA 2基于其早期版本SIMA(可扩展指令多世界智能体)构建,后者于2024年3月发布。SIMA 2首次整合了谷歌的Gemini AI技术,使智能体能够超越简单的指令执行,实现"理解用户的高级目标,进行复杂推理,并在游戏中熟练执行目标导向的行动",即使面对从未见过的游戏也能应对自如。目前该系统正以有限研究预览版的形式向部分学者和开发者开放。
DeepMind团队表示,尽管SIMA 2在游戏方面表现出色,但创建面向消费者的游戏助手并非其主要目标。DeepMind高级研究科学家Jane Wang将其称为"一个绝佳的训练场",有望将这些技能转移到现实世界环境中。
AGI竞赛的重要里程碑
正如往常一样,这一切都回到了谷歌、Meta、OpenAI、Anthropic等公司之间日益激烈的AGI竞赛。DeepMind在博客文章中表示:"这是朝着通用人工智能(AGI)方向迈出的重要一步,对未来机器人技术和AI实体化具有重要意义。"
DeepMind研究科学家Joe Marino进一步强调,SIMA 2在虚拟世界中采取行动并处理从未见过环境的能力,是迈向AGI的"基础"步骤,并可能为未来构建通用机器人奠定基础。
该智能体通过游戏世界的复杂环境进行学习和适应,展现了AI系统在动态环境中的学习能力和泛化能力。这种技术突破不仅推进了游戏AI的发展,更为实现真正的通用人工智能提供了重要的技术路径。
Q&A
Q1:SIMA 2是什么?它有什么特别之处?
A:SIMA 2是谷歌DeepMind开发的AI智能体,能够学会玩多款视频游戏。它首次整合了Gemini AI技术,能够理解用户高级目标,进行复杂推理,并在从未见过的游戏中熟练执行任务。
Q2:SIMA 2与通用人工智能有什么关系?
A:DeepMind认为SIMA 2是迈向AGI的重要步骤。它在虚拟世界中采取行动和处理未知环境的能力,为构建通用机器人和实现真正的通用人工智能提供了基础技术路径。
Q3:普通用户能使用SIMA 2吗?
A:目前SIMA 2仅以有限研究预览版形式向部分学者和开发者开放,尚未面向普通消费者发布。DeepMind表示创建消费级游戏助手并非主要目标。
好文章,需要你的鼓励
穆拉蒂时隔18个月首次接受重大媒体采访,介绍其创立的Thinking Machines Lab正在开发的"交互模型"。该模型能以200毫秒间隔处理音频、文本和视频流,捕捉人类交流中的中断、修正和停顿。她还谈及OpenAI"政变周"经历,强调行业决策权过于集中的担忧,并回应了公司近期研究人员离职问题,表示这是初创实验室的正常波动。
STATE16研究院这篇综述发现,物理AI系统存在"静默失效"风险——AI以高度自信执行基于错误世界信息的动作,却不触发任何报警,并提出在AI输出与物理执行之间建立独立授权层的框架。
本期《Quick Charge》播客涵盖多个热点话题:特斯拉疑似试图删除FSD欺诈相关证据以规避巨额赔付;卡特彼勒持续推进建筑领域电气化布局;住宅太阳能30%税收抵免即将到期。此外,嘉宾Tom Pacheco就高压系统与电池技术培训展开探讨,强调电动车技术人才培养的紧迫性。节目同时提醒有意安装太阳能的用户尽快行动,可通过EnergySage平台比较多家安装商报价。
UIUC与微软联合研发的OpenWebRL框架让4B小模型仅凭400条初始数据,通过在真实网站上边做边学的强化学习方式,在网页智能体基准上超越了用27万条数据训练的竞争对手。