微软正逐步减少对OpenAI和Anthropic旗下顶级AI模型的依赖,转而使用自家研发的MAI模型家族,尽管该公司公开承认这些模型在技术成熟度上尚不及业内领先的前沿系统。
上述消息来自彭博社今日发布的一份报告。报告援引一名知情人士称,微软对采购OpenAI和Anthropic顶尖模型所产生的高昂费用愈发感到担忧。该知情人士表示,在Excel、Outlook等办公平台中,此前经由第三方模型处理的"数以万计的提示词",目前已转由微软MAI模型承接,以实现降本目标。不过,与微软Copilot每周处理数百万条提示词的整体规模相比,这一转变目前仍只占整体AI使用量的一小部分。
这份报告的发布距微软推出MAI家族七款新模型约有一个月。彼时,微软发布了其首款推理模型MAI-Thinking 1,定位为高性能、高效率、低Token成本的中型模型,拥有350亿个激活参数和25.6万Token的上下文窗口。在盲测中,该模型的代码能力与Anthropic的Claude Opus 4.6旗鼓相当。除此之外,此次MAI系列还涵盖图像生成、语音转录、语音识别及编程辅助等多类功能模型。
随着高端AI系统的成本压力逐渐显现,更经济实惠的AI模型正受到越来越多的关注。在今年早些时候短暂流行的"Token最大化"使用热潮之后,众多企业开始重新审视AI支出。近期,亚马逊、埃森哲、Meta和Uber等科技巨头均据报正在采取措施压缩AI开销。
部分美国企业已将目光转向价格更低廉的中国模型。中国深度求索(DeepSeek)年初凭借超高性价比的V4-Pro模型引发广泛关注——每百万输入Token仅需0.435美元、输出Token仅需0.87美元,远低于Anthropic旗下Fable 5模型每百万输入Token 10美元、输出Token 50美元的定价。
微软AI首席执行官穆斯塔法·苏莱曼上月在接受彭博社采访时直言:"Anthropic的费用极其高昂,我认为很多人都在迫切寻找替代方案。我们支付给Anthropic的钱数额巨大,因此我们的目标是逐步降低乃至最终消除这笔成本。"
相比之下,OpenAI的定价相对较低——GPT-5.5每百万输入Token收费5美元,输出Token收费30美元。凭借与OpenAI的合作关系,微软能以相当大的折扣获取其模型,但累计成本依然可观。此外,微软与OpenAI的合作协议将于2032年到期,这也进一步推动了微软加快培育自有AI能力的步伐。
Q&A
Q1:微软MAI-Thinking 1模型的性能和定价如何?
A:MAI-Thinking 1是微软首款推理模型,属于中型规模,拥有350亿个激活参数和25.6万Token的上下文窗口,主打高性能、低Token成本。在盲测中,其代码能力与Anthropic的Claude Opus 4.6表现相当。目前微软尚未公布该模型的对外定价,但主要定位是替代高价第三方模型,以降低内部AI使用成本。
Q2:微软为什么要减少使用Anthropic的模型?
A:核心原因是成本过高。Anthropic旗下模型定价昂贵,以Fable 5为例,每百万输入Token高达10美元,输出Token达50美元。微软AI首席执行官穆斯塔法·苏莱曼公开表示,公司向Anthropic支付了大量费用,目标是逐步降低乃至消除这部分开销。转向自研MAI模型是实现降本的重要举措。
Q3:DeepSeek V4-Pro模型的价格比Anthropic便宜多少?
A:差距相当悬殊。DeepSeek V4-Pro每百万输入Token仅需0.435美元,输出Token仅需0.87美元;而Anthropic的Fable 5模型每百万输入Token收费10美元,输出Token收费50美元,后者的价格约为前者的23至57倍。正因如此,不少美国企业开始考虑将部分AI工作负载迁移至DeepSeek等低成本模型。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。