xAI近日发布了其最新模型Grok 4.5,这也是该公司上市数周以来推出的首款新模型。
xAI在周三发布的博客文章中,将这款新模型定位为一款能够胜任AI行业典型任务的实用型产品,覆盖范围包括编程与应用开发、办公文书处理、研究分析、写作创作以及其他常规知识类工作。
在成本方面,xAI表示Grok 4.5的Token效率是其他主流模型的两倍,这一优势若能在实际应用场景中得到验证,将为xAI带来显著竞争力。随着Token使用成本成为AI用户日益关注的问题,更高的Token效率意味着更低的使用开销。
xAI同日公布的基准测试数据显示,Grok 4.5与竞争对手的顶尖模型相比具备较强竞争力,但尚未达到同类最优水平。
创始人埃隆·马斯克在其旗下社交平台X上发文,将该模型与Anthropic专为复杂高强度任务设计的大语言模型Opus进行了类比。他写道:"基于测试项目中客户的强烈正面反馈,xAI将于明日向公众开放Grok 4.5。它是一款Opus级别的模型,但速度更快、Token效率更高、成本更低。"
马斯克随后补充称:"我们内部评估认为,Grok 4.5的能力与Opus 4.7大致相当,但速度快得多。能力、速度与成本三者的结合,正是其核心竞争力所在。"
据xAI公布的定价,新模型的输入Token费用为每百万Token 2美元,输出Token费用为每百万Token 6美元,在同类产品中颇具价格优势。相比之下,Opus 4.7的输入Token定价为每百万5美元,输出Token则高达每百万25美元。OpenAI的定价则按模型版本分级:最高端的Sol版本输入费用为每百万5美元、输出每百万30美元;最低端的Luna版本输入费用为每百万1美元、输出每百万6美元。
本周是AI模型发布的密集时期。OpenAI计划于周四发布其迄今最强大的最新模型GPT 5.6。该模型此前曾因特朗普政府对其安全影响的担忧而受到发布限制,OpenAI将其称为"迄今最强大的模型"。
Q&A
Q1:Grok 4.5的Token定价是多少?和竞争对手比怎么样?
A:Grok 4.5的输入Token定价为每百万Token 2美元,输出Token为每百万6美元。相比之下,Anthropic的Opus 4.7输入定价为每百万5美元、输出每百万25美元;OpenAI最高端的Sol版本输入每百万5美元、输出每百万30美元。整体来看,Grok 4.5在定价上具有明显优势,尤其是输出Token的费用远低于主要竞争对手。
Q2:马斯克说Grok 4.5是"Opus级模型"是什么意思?
A:马斯克的意思是Grok 4.5在能力上与Anthropic的Opus 4.7大致相当,Opus系列是Anthropic专为复杂、高强度任务设计的大语言模型产品线。他同时强调,Grok 4.5在速度和成本方面比Opus 4.7更有优势,即以更低价格和更快速度提供相近水平的能力。
Q3:Grok 4.5主要能用来做什么?
A:根据xAI的介绍,Grok 4.5定位为通用型实用模型,支持多种典型AI应用场景,包括编程与应用开发、办公文书处理、研究分析、内容写作,以及各类常规知识工作。此外,xAI宣称其Token效率是同类主流模型的两倍,这意味着用户在完成相同任务时可以花费更少的费用。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。