微软于周一宣布,其 Copilot AI 助手迎来了重大升级,集成了 OpenAI 的 GPT-4o 模型,从而支持高级图像生成能力。此次更新让用户只需用文字描述所需图像,即可在 Microsoft 365 应用(包括 Word、Excel 和 Outlook)内直接创建精细化的视觉效果。
另见: Microsoft 告别 Skype:这款标志性应用在推出 23 年后正式关闭
Copilot 是什么?
Microsoft Copilot 是集成于 Microsoft 365 应用(如 Word、Excel、PowerPoint、Outlook 和 Teams)中的 AI 助手。
借助 GPT-4o 等大语言模型,Copilot 能够起草文档、分析数据、制作演示文稿以及管理电子邮件和会议。此次更新使得 Copilot 现在也能根据文字描述生成图像。
我可以用 Copilot 的 AI 图像生成功能做什么?
集成了 OpenAI 最新的 AI 模型 GPT-4o 后,Copilot 能够将文本描述转换为高质量、逼真的照片级图像,大大扩展了用户在视觉内容上的应用范围。用户可以无需借助外部设计工具,就生成定制的图形、插图和设计作品。用户还可以修改现有视觉内容、应用样式转换,并在图像中生成清晰可辨的文本。
微软最初于上个月通过 Microsoft 365 Copilot 向企业用户逐步推出了这些 GPT-4o 图像生成工具。如今,同样的功能也通过面向消费者的 Microsoft Copilot 推向了大众市场。
另见: OpenAI 推出全新 GPT-4.1 模型,本月末将停用 GPT-4
这一步骤使 Microsoft Copilot 超越了诸如 Microsoft Designer 和 Image Creator 等其他创意工具,这些工具仍依赖于 OpenAI 较旧的 DALL-E 模型。相比之下,GPT-4o 代表了 AI 图像生成的尖端技术,具备更快的响应速度和更精细的输出效果。
通过这些增强功能,微软正致力于将 Copilot 打造成一款全面的 AI 助手,以在市场上与 OpenAI 和 Google Gemini 等重量级竞争对手抗衡。
好文章,需要你的鼓励
谷歌CEO皮查伊在AI竞赛低谷期坚持"信号降噪"原则,顶住压力加倍投入,最终带领谷歌凭借Gemini系列重夺领先。他坚信AI将超越火与电的革命性影响,通过递归自我改进极大降低创意实现门槛,这场"创造力民主化"浪潮或将解锁80亿人的认知潜能。
浙江大学和吉利汽车研究院联合团队提出的FreeTimeGS是一种创新的动态3D场景重建方法。不同于传统方法,它允许高斯基元在任意时空位置自由出现,并赋予每个基元运动功能,使其能够随时间移动到相邻区域。研究通过4D正则化策略解决了高不透明度基元阻碍优化的问题。在多个数据集测试中,该方法在渲染质量和速度上均大幅超越现有技术,特别是在处理复杂动态场景时,使用单个RTX 4090 GPU能以467 FPS的速度实现1080p实时渲染,为电影制作、游戏和虚拟现实等应用提供了新可能。
李飞飞的World Labs以"空间智能"重新定义AI,专注3D物理世界理解,4个月估值飙至10亿美元,获科技巨头集体押注。她揭示语言无法编码物理世界,而DNA双螺旋等突破性发现都源于三维空间的深度认知。
这篇研究介绍了"对角线批处理"技术,该技术解决了循环记忆Transformer模型在处理长文本时的并行计算瓶颈。通过重新编排计算顺序,研究团队实现了在不破坏依赖关系的情况下进行并行计算,使LLaMA-1B模型处理长文本的速度提升3.3倍,同时内存使用减少167.1倍。这种纯运行时优化不需要重新训练模型,为实际应用中的长文本处理提供了高效解决方案。