谷歌DeepMind发布Genie 3模型用于生成交互式虚拟世界

谷歌DeepMind发布Genie 3人工智能模型，可基于自然语言提示生成交互式虚拟世界。该模型是Genie系列第三代产品，能够模拟森林、高山景观等室内外环境，支持用户通过指令修改天气、调整视角或添加物体。相比前代产品，Genie 3可持续渲染数分钟，分辨率提升至720p，并具备视觉记忆功能。该模型可用于训练具身智能体，为自主系统如工业机器人提供更高质量的训练环境。目前仅向有限测试者开放研究预览版。

谷歌DeepMind实验室发布了Genie 3人工智能模型，专门用于生成虚拟世界。

这是该公司自去年2月推出的算法系列的第三代产品。据DeepMind介绍，该技术可以为AI模型创建更高质量的训练环境，从而推动机器学习研究的发展。

Genie 3能够基于自然语言提示生成虚拟世界。它可以模拟海滩、阿尔卑斯山景观和其他户外场所以及室内空间。在一次内部测试中，DeepMind研究人员让Genie 3生成了一个精细的水下环境，其中包含一只巨大的水母。

用户可以通过提示来改变虚拟世界。Genie 3可以接受修改天气、调整摄像机角度或向环境中添加物体的指令。它还能够模拟这些物体之间的相互作用。

该算法的前身Genie 2每次可以渲染虚拟环境长达20秒。DeepMind表示，Genie 3可以管理长达数分钟的渲染。这家Alphabet旗下公司的研究人员还将渲染质量从360p提升到720p，对应分辨率为1280×720像素。

渲染一致性是Genie 3提供改进的另一个领域。在用户会话期间，该模型会分析过去的帧来确定未来帧应如何生成。

DeepMind研究人员Jack Parker-Holder和Shlomi Fruchter在今日的博客文章中解释道："自回归生成环境通常比生成整个视频在技术上更困难，因为不准确性往往会随着时间的推移而累积。尽管面临挑战，Genie 3环境在数分钟内保持基本一致，视觉记忆可以延续到一分钟前。"

Alphabet认为Genie 3可以用于训练具身智能体。这些是为工业机器人等自主系统提供动力而设计的AI智能体。通常，此类算法在模拟其预期导航的真实世界环境中进行训练。

DeepMind使用名为SIMA的AI模型测试了Genie 3的具身智能体训练功能。SIMA算法旨在在虚拟环境中自主执行任务。在测试中，DeepMind研究人员成功指示SIMA在Genie 3生成的环境中执行一系列动作。

Parker-Holder和Fruchter写道："在每个世界中，我们指示智能体追求一系列不同的目标，它通过向Genie 3发送导航动作来实现这些目标。像任何其他环境一样，Genie 3不知道智能体的目标，而是根据智能体的动作模拟未来。"

最初，DeepMind将向有限数量的测试人员提供Genie 3作为研究预览。该公司目前正在研究如何在未来向更多用户提供这项AI技术。

Q&A

Q1：Genie 3是什么？它能做什么？

A：Genie 3是谷歌DeepMind开发的第三代人工智能模型，专门用于生成虚拟世界。它能够基于自然语言提示生成各种虚拟环境，包括海滩、山景、室内空间和水下场景等，用户还可以通过提示修改天气、调整视角或添加物体。

Q2：Genie 3相比前代产品有什么改进？

A：相比前代Genie 2，Genie 3在多个方面有显著提升：渲染时长从20秒延长到数分钟，分辨率从360p提升到720p(1280×720像素)，并且大幅改善了渲染一致性，视觉记忆可以延续到一分钟前。

Q3：Genie 3如何用于AI训练？

A：Genie 3可以为具身智能体提供训练环境，特别适用于工业机器人等自主系统的AI算法训练。DeepMind已经使用SIMA智能体在Genie 3生成的环境中成功进行测试，智能体能够根据目标执行各种导航动作。

来源：SiliconANGLE

0赞

好文章，需要你的鼓励

谷歌DeepMind发布Genie 3模型用于生成交互式虚拟世界

来源：SiliconANGLE

2025

08/06

11:02

分享

点赞

数智时代，openGauss Summit 2025即将发布哪些技术创新破局

“算力+储能”深度融合：超智算发布分布式算力超级节点储能解决方案

联想推出DE6600系列：更智能的存储解决方案

创业公司如何在严格监管行业中实现生死攸关的创新

OpenAI发布GPT-5.2-Codex模型，软件工程自动化能力大幅提升

Waterfox浏览器宣布拒绝AI功能，瞄准Firefox忠实用户

TikTok美国业务出售交易将于下月完成

破局AI数据中心安全瓶颈：Fortinet联合NVIDIA引领隔离式加速新航向

智算中心进化论，科华数据如何做到“更懂”

更高负载、更快建设：2026年数据中心六大趋势

Snowflake数据库更新引发全球大规模服务中断

AI编程初创公司Lovable融资3.3亿美元，英伟达等科技巨头支持

闪迪发布256TB AI专用SSD，计划2026年出货

OpenAI发布两款开源大语言模型，今日可下载使用

MLPerf存储基准测试v2.0显示阵列性能大幅提升

谷歌推出Genie 3世界模型，可实时动态修改模拟环境状态

Aquant推出智能体AI平台助力服务团队构建定制化AI智能体

DeepMind发布Genie 3：通往AGI的关键世界模型

超越Meta Quest和Vision Pro的未来：智能眼镜将重新定义VR

IT职业发展新趋势：5个热门方向与5个冷门领域

DeepMind发布Genie 3"世界模型"，实现实时交互式模拟环境

博通发布Jericho4芯片助力多数据中心AI协同运算

如果您非常迫切的想了解IT领域最新产品与技术信息，那么订阅至顶网技术邮件将是您的最佳途径之一

2025 re:Invent ：亚马逊云科技把Agentic AI生态梳理明白了

电子竞技瞬息万变，Team Liquid的“数据+AI”制胜秘籍

中国移动呼和浩特数据中心：只有高效存力先行，AI才能跑出全力

从“支撑工具”到“智能中枢”，AI原生ERP进化

关注官方公众号

关注官方微博

关注官方喜马拉雅

友情链接

业界热点: