谷歌周二发布了其内部 AI 视频与图像生成器的最新版本——Imagen 3 Lite,据该公司介绍,这一版本相比前代产品速度更快、成本更低。
该模型延迟大幅降低,可在4秒内完成图像生成,非常适合需要快速迭代、批量产出图像的使用场景。每1000张图像的生成成本仅为0.034美元,对于需要大规模草稿创作和内容打磨的用户而言,性价比极高。
此次发布延续了谷歌过去一年多的产品迭代节奏。去年夏天,基于 Gemini 3.1 Flash 的初代 Imagen 3 正式上线;今年2月,Imagen 3 2 发布,引入了更多能力,包括生成更逼真图像的功能。此外,谷歌还提供定位高端的 Imagen 3 Pro,适用于更复杂的专业场景,功能更强但价格也更高。
与 Imagen 3 2 被定位为"通用型主力模型"不同,Imagen 3 Lite 专为高并发、高频次的工作流场景进行了优化。
尽管外界对图像生成模型产出"AI 泛滥内容"的质疑声不断,各大公司仍在持续加码 AI 图像与视频生成工具的投入。谷歌通常将旗下模型定位为辅助广告创意制作的高效工具。
与此同时,好莱坞与 AI 公司之间的合作关系持续深化,尽管这在部分创作者社群和受众中引发了明显不满。谷歌近期与广受好评的独立电影公司 A24 签署了一项7500万美元的合作协议,该合作遭到不少粉丝的强烈批评。
Imagen 3 Lite 目前已通过 Google AI Studio、Gemini API 以及谷歌 Gemini 企业级智能体平台正式上线。谷歌表示,该模型将取代初代 Imagen 3,后者现已被官方定义为"历史遗留模型"。
同日,谷歌还宣布更大范围开放 Veo 3 Flash。该模型最初于今年谷歌 I/O 大会上首次亮相,视频输出费用为每秒0.10美元。此外,谷歌还展示了一款全新演示应用 Veo Product Studio,该应用可将 Veo 生成的静态图像转化为"电影质感的电商视频"。
谷歌在一篇博客中表示:"生成式 AI 的内容创作本质上是一个创意迭代的过程。借助这两款模型,开发者可以构建完整的端到端多媒体体验,将快速图像生成与视频创作、编辑无缝衔接。"
Q&A
Q1:Imagen 3 Lite 的生成速度和价格是怎样的?
A:Imagen 3 Lite 可在4秒内完成一张图像的生成,延迟相比前代产品大幅降低。在价格方面,每1000张图像的生成成本仅为0.034美元,适合需要大规模批量生成图像的用户,性价比较高,尤其适用于广告创意、内容草稿等高频使用场景。
Q2:Imagen 3 Lite 和 Imagen 3 2 有什么区别?
A:Imagen 3 2 被定位为"通用型主力模型",具备生成更逼真图像等多项能力,适合多种通用场景。而 Imagen 3 Lite 则专为高并发、高频次的工作流进行了优化,强调速度快、成本低,更适合需要快速迭代和批量产出的场景。两者定位不同,用户可根据实际需求选择使用。
Q3:Imagen 3 Lite 在哪里可以使用?
A:Imagen 3 Lite 目前已通过 Google AI Studio、Gemini API 以及谷歌 Gemini 企业级智能体平台正式上线,开发者和企业用户均可通过上述渠道接入使用。谷歌表示,Imagen 3 Lite 将作为初代 Imagen 3 的替代产品,后者已被官方标记为"历史遗留模型"。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。