Microsoft 正在为其 AI 聊天助手应用 Microsoft 365 Copilot 引入一款 "深度研究" AI 工具。
最近,多个聊天机器人都推出了深度研究代理,包括 OpenAI 的 ChatGPT、Google 的 Gemini 和 xAI 的 Grok。这些工具背后的支撑是所谓的推理 AI 模型,它们具备思考问题和自我事实核查的能力——这些能力对于开展深入研究而言至关重要。
Microsoft 推出的两个版本分别名为 Researcher 和 Analyst。
Researcher 结合了 OpenAI 的深度研究模型 (该模型也为 OpenAI 自家的 ChatGPT 深度研究工具提供支持) 以及 "高级编排" 和 "深度搜索功能"。Microsoft 表示,Researcher 可以执行多种分析任务,包括制定市场进入策略和为客户创建季度报告。
至于 Analyst,它基于 OpenAI 的 o3-mini 推理模型构建,Microsoft 称其 "针对高级数据分析进行了优化"。Analyst 通过迭代方式处理问题,通过多个步骤来完善其 "思考" 过程,并为查询提供详细答案。Microsoft 还表示,Analyst 可以运行 Python 编程语言来处理复杂的数据查询,并能够展示其 "工作" 过程以供检查。
与竞争对手相比,Microsoft 的深度研究工具的独特之处在于它们不仅能访问互联网数据,还能访问工作数据。例如,Researcher 可以通过第三方数据连接器从 Confluence、ServiceNow 和 Salesforce 等 AI "代理"、工具和应用程序中获取数据。
当然,真正的挑战在于确保 Researcher 和 Analyst 等工具不会产生幻觉或编造内容。包括 o3-mini 和深度研究模型在内的模型并非完美无缺;它们有时会出现错误引用、得出错误结论,并从可疑的公共网站获取信息来支持其推理。
Microsoft 正在推出一个新的 Frontier 计划,Microsoft 365 Copilot 用户可以通过该计划获取 Researcher 和 Analyst 的使用权限。从 4 月开始,注册 Frontier 计划的用户将率先体验到 Researcher 和 Analyst 等实验性 Copilot 功能。
好文章,需要你的鼓励
浙江大学研究团队开发了ContextGen,这是首个能够同时精确控制多个对象位置和外观的AI图像生成系统。该系统通过情境布局锚定和身份一致性注意力两大创新机制,解决了传统AI在多对象场景中位置控制不准确和身份保持困难的问题,并创建了业界首个10万样本的专业训练数据集,在多项测试中超越现有技术。
谷歌推出升级版图像生成模型Nano Banana Pro,基于最新Gemini 3语言模型构建。新模型支持更高分辨率(2K/4K)、准确文本渲染、网络搜索功能,并提供专业级图像控制能力,包括摄像角度、场景光照、景深等。虽然质量更高但成本也相应增加,1080p图像费用为0.139美元。模型已集成到Gemini应用、NotebookLM等多个谷歌AI工具中,并通过API向开发者开放。
上海交通大学研究团队开发的SR-Scientist系统实现了人工智能在科学发现领域的重大突破。该系统能够像真正的科学家一样,从实验数据中自主发现数学公式,通过工具驱动的数据分析和长期优化机制,在四个科学领域的测试中比现有方法提高了6%-35%的精确度。这标志着AI从被动工具转变为主动科学发现者的重要里程碑。