谷歌在年度Google I/O大会上宣布推出Pics,这是一款面向Google Workspace用户的全新AI图像生成与设计应用。谷歌表示,该应用的设计目标是让所有人都能轻松上手,无论是教师还是小企业主。
借助Pics,用户只需输入简单的文字提示,即可生成社交媒体图文、邀请函、营销素材和产品原型图等各类视觉内容,完全不需要具备任何设计技能或使用复杂工具。通过这种便捷的视觉内容生成方式,谷歌意图直接挑战Canva等主流设计工具,以及Anthropic旗下Claude Design等AI原生竞争产品。谷歌的入局也标志着AI驱动的设计领域正迅速成为各大科技公司的核心竞争赛道,对于任何依赖视觉内容的企业来说,这一变化都举足轻重。
目前,Pics已向I/O大会的部分测试用户开放,并将于今年夏天向Google AI Ultra订阅用户全面推出。
谷歌坦言,尽管当前的AI模型已能生成高质量图像,但对图像局部进行精准修改仍是一大难题。如果生成的图像已经接近理想效果,但用户想调整某个细节,往往需要重新编写提示词,还得祈望AI不会把其他地方也改掉。正因如此,Pics不仅具备图像生成能力,还内置了便捷的编辑功能。
用户输入提示词后,Pics会生成所需内容。Gemini为编辑层提供支持,使生成设计或图像中的每个元素都可以灵活调整。用户既可以通过新的提示词来修改内容,也可以直接点击想要更改的部分并留下批注——操作方式与在Google Docs中添加反馈意见如出一辙。
此外,用户还可以直接手动编辑,无需添加批注或输入提示词。例如,如果你制作了一张生日派对邀请函,想修改卡片上的时间,可以直接手动更改即可。
Pics由Nano Banana 2模型提供支持。谷歌表示,该模型非常契合这款应用的需求,因为它支持精准的文字渲染、具备现实世界知识,并能输出细节丰富的视觉内容。Pics还原生集成于Google Workspace,实现了跨应用的视觉协作能力。
当用户对设计成果满意后,可以选择下载、复制、打印或分享给他人。谷歌表示,用户也可以将设计稿转交给其他人进行最终轮次的修改,再正式发布。
Q&A
Q1:谷歌Pics应用主要面向哪些用户群体?
A:谷歌Pics定位为面向所有人的AI设计工具,不需要专业设计技能,目标用户涵盖教师、小企业主、内容创作者等各类群体。用户只需输入文字提示,即可生成社交媒体图文、邀请函、营销素材等视觉内容。目前该应用已向Google I/O大会测试用户开放,将于今年夏天向Google AI Ultra订阅用户全面推出。
Q2:谷歌Pics的图像编辑功能与其他AI设计工具有何不同?
A:谷歌Pics的核心优势在于其精细化的图像编辑能力。用户不仅可以通过新的提示词修改图像,还可以直接点击图像中想要更改的部分并留下批注,操作方式类似于Google Docs中的评论功能。此外,用户还可以直接手动修改文字等元素,无需重新生成整张图像,有效解决了当前AI图像生成工具难以精准修改局部内容的痛点。
Q3:谷歌Pics使用的是什么AI模型?
A:谷歌Pics由Nano Banana 2模型提供核心支持,该模型擅长精准文字渲染、具备现实世界知识,并能输出细节丰富的视觉内容。同时,编辑功能层由Gemini提供支持,使生成设计中的每个元素都能被灵活调整。Pics还原生集成于Google Workspace,支持跨应用的视觉协作。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。