微软于周一宣布,其 Copilot AI 助手迎来了重大升级,集成了 OpenAI 的 GPT-4o 模型,从而支持高级图像生成能力。此次更新让用户只需用文字描述所需图像,即可在 Microsoft 365 应用(包括 Word、Excel 和 Outlook)内直接创建精细化的视觉效果。
另见: Microsoft 告别 Skype:这款标志性应用在推出 23 年后正式关闭
Copilot 是什么?
Microsoft Copilot 是集成于 Microsoft 365 应用(如 Word、Excel、PowerPoint、Outlook 和 Teams)中的 AI 助手。
借助 GPT-4o 等大语言模型,Copilot 能够起草文档、分析数据、制作演示文稿以及管理电子邮件和会议。此次更新使得 Copilot 现在也能根据文字描述生成图像。
我可以用 Copilot 的 AI 图像生成功能做什么?
集成了 OpenAI 最新的 AI 模型 GPT-4o 后,Copilot 能够将文本描述转换为高质量、逼真的照片级图像,大大扩展了用户在视觉内容上的应用范围。用户可以无需借助外部设计工具,就生成定制的图形、插图和设计作品。用户还可以修改现有视觉内容、应用样式转换,并在图像中生成清晰可辨的文本。
微软最初于上个月通过 Microsoft 365 Copilot 向企业用户逐步推出了这些 GPT-4o 图像生成工具。如今,同样的功能也通过面向消费者的 Microsoft Copilot 推向了大众市场。
另见: OpenAI 推出全新 GPT-4.1 模型,本月末将停用 GPT-4
这一步骤使 Microsoft Copilot 超越了诸如 Microsoft Designer 和 Image Creator 等其他创意工具,这些工具仍依赖于 OpenAI 较旧的 DALL-E 模型。相比之下,GPT-4o 代表了 AI 图像生成的尖端技术,具备更快的响应速度和更精细的输出效果。
通过这些增强功能,微软正致力于将 Copilot 打造成一款全面的 AI 助手,以在市场上与 OpenAI 和 Google Gemini 等重量级竞争对手抗衡。
好文章,需要你的鼓励
多伦多大学研究团队提出Squeeze3D压缩框架,巧妙利用3D生成模型的隐含压缩能力,通过训练映射网络桥接编码器与生成器的潜在空间,实现了极致的3D数据压缩。该技术对纹理网格、点云和辐射场分别达到2187倍、55倍和619倍的压缩比,同时保持高视觉质量,且无需针对特定对象训练网络,为3D内容传输和存储提供了革命性解决方案。
浙江大学与腾讯联合研究团队提出MoA异构适配器混合方法,通过整合不同类型的参数高效微调技术,解决了传统同质化专家混合方法中的表征坍塌和负载不均衡问题。该方法在数学和常识推理任务上显著优于现有方法,同时大幅降低训练参数和计算成本,为大模型高效微调提供了新的技术路径。
耶鲁、哥大等四校联合研发的RKEFino1模型,通过在Fino1基础上注入XBRL、CDM、MOF三大监管框架知识,显著提升了AI在数字监管报告任务中的表现。该模型在知识问答准确率提升超过一倍,数学推理能力从56.87%提升至70.69%,并在新颖的数值实体识别任务中展现良好潜力,为金融AI合规应用开辟新路径。
加州大学圣巴巴拉分校研究团队开发出能够自我进化的AI智能体,通过《卡坦岛拓荒者》桌游测试,这些AI能在游戏过程中自主修改策略和代码。实验显示,具备自我进化能力的AI显著超越静态版本,其中Claude 3.7模型性能提升达95%。研究验证了AI从被动工具向主动伙伴转变的可能性,为复杂决策场景中的AI应用开辟新路径。