总部位于巴黎的人工智能初创公司 Mistral AI 今天为其 AI 助手 Le Chat 推出了多项重大更新,包括新功能和移动应用,同时对其定价结构进行了全面调整。
新版 Le Chat 对其网页界面进行了升级,同时还为智能手机用户发布了 iOS 和 Android 版本的移动应用。
最引人注目的是,Mistral 为所有层级的用户提供了名为 "Flash Answers" 的 AI 助手功能升级,该功能每秒可提供多达 1,000 字的回答。据 Mistral 表示,这一速度使其助手能够比市面上任何其他聊天助手都更快地进行推理、思考和回应。
这仅适用于文本回答。如果请求图像,响应时间可能会更长。
该公司还为 Le Chat 引入了代码解释器,使其能够执行代码、分析数据、可视化展示和模拟计算。该助手可以直接在提示中生成 Python 代码,或上传逗号分隔的文件并将其可视化以生成见解。它让用户能够快速轻松地进行简单计算和绘图、数据分析和绘图,以及科学计算。
去年,Anthropic PDC 为其生成式 AI 聊天机器人 Claude 添加了类似功能,允许它使用 JavaScript 分析数据、执行复杂数学运算和创建可视化效果。
Mistral 使用 Black Forest Labs Inc. 的 Flux Ultra 模型升级了 Le Chat 的图像生成能力。Mistral 表示这是该公司领先的图像生成模型,可以生成从富有想象力的生动图片到逼真照片等各种图像。据该公司称,其图像生成效果优于 OpenAI 或 Grok。
Mistral 在 11 月为其 AI 助手添加了带有引用的网络搜索功能,类似于 ChatGPT、Gemini 和生成式 AI 搜索引擎 Perplexity。最近,该公司还与全球领先的新闻机构法新社签署了合作协议,该机构以提供快速、全面的新闻报道而闻名,为 Mistral 的 AI 助手提供新闻服务。这种整合使用户能够获得由当前新闻支持的最新事实信息。
虽然对大多数用户来说,与 AI 助手的大部分交互都是免费的,但 Mistral 推出了每月 14.99 美元的 Pro 订阅层级。购买 Pro 订阅的好处包括每天无限消息、无限网页浏览、扩展新闻访问、文件上传、数据分析和 Flash 答案功能。Pro 订阅用户还可以选择不与公司共享数据。
好文章,需要你的鼓励
香港中文大学与华为诺亚方舟实验室合作开发了PreMoe框架,解决了大型混合专家模型(MoE)在内存受限设备上的部署难题。研究团队发现MoE模型中的专家表现出明显的任务专业化特征,据此提出了概率专家精简(PEP)和任务自适应专家检索(TAER)两大核心技术。实验证明,DeepSeek-R1 671B模型在精简50%专家后仍保持97.2%的MATH500准确率,内存需求降至688GB;而更激进的精简方案(减少87.5%专家)也能保持72.0%的准确率。该方法适用于多种MoE架构,为强大AI系统的广泛部署铺平了道路。
SCIENCEBOARD是一项开创性研究,旨在评估多模态自主智能体在真实科学工作流中的表现。研究团队构建了一个包含169个高质量任务的基准测试,涵盖生物化学、天文学等六个科学领域,并开发了一个真实环境让智能体通过CLI或GUI接口与科学软件交互。实验评估表明,即使是最先进的模型在这些复杂科学任务上的成功率也仅为15%,远低于人类表现,揭示了当前技术的局限性并为未来科学智能体的发展提供了宝贵见解。
帝国理工学院的研究团队开发了AlphaMed,这是首个仅通过极简规则强化学习就能培养医疗推理能力的AI模型,无需依赖传统的思维链示范数据。通过分析数据信息丰富度和难度分布的影响,研究发现高信息量的医疗问答数据是推理能力的关键驱动因素。AlphaMed在六个医疗问答基准上取得了领先成绩,甚至超越了更大的封闭源模型,同时展现出自发的步骤推理能力,为医疗AI发展提供了更加开放、高效的新路径。
Alita是一种新型通用AI代理系统,采用极简设计理念,以"最小预定义,最大自我进化"为原则构建。由普林斯顿大学等多家机构研究团队开发的Alita,只配备一个核心能力和少量通用模块,能自主创建所需工具并重用为模型上下文协议(MCPs)。实验显示,Alita在GAIA基准测试上达到87.27%的通过率,超越包括OpenAI Deep Research在内的复杂系统,证明简约设计可带来卓越性能。