OpenAI于周四正式发布了最新的GPT-5.6系列模型,向日益拥挤的AI市场再度投入重磅产品。
GPT-5.6共分三个版本:Sol(主力版本)、Terra(中间档位)以及Luna(经济实惠版)。这三款模型拓展了用户在多个领域的使用场景,公司承诺其在企业办公、代码开发乃至科学研究方面均具备强大能力。
首席执行官萨姆·奥特曼表示,新系列模型在效率和成本方面较前代有大幅提升。他近期在接受CNBC采访时透露,Sol在AI编程任务上的Token效率提升了54%。
值得关注的是,OpenAI将GPT-5.6称为"迄今为止最强的网络安全模型",称其"以明显更少的Token实现了前沿级别的表现"。
这款模型在网络安全领域的能力备受关注。此前,特朗普政府曾试图限制该模型的推出,理由是担忧其可能被滥用。GPT-5.6支持多种防御性安全活动,包括威胁建模、代码审查与漏洞修补,以及蓝队演练(即模拟攻击自身系统,提前发现潜在漏洞)。
与此同时,OpenAI还发布了一款名为ChatGPT Work的新工具,专为企业团队设计,支持桌面端、网页端和移动端运行,可协助处理日常事务,如起草文件、制作表格和演示文稿等。
GPT-5.6系列的发布,紧随竞争对手SpaceXAI和Meta本周的类似动作之后。
不过,GPT-5.6及其市场推广策略,似乎更多剑指OpenAI的主要竞争对手Anthropic。Anthropic凭借始终聚焦企业客户的策略,在AI竞赛中树立了颇具亲和力的"低调挑战者"形象,并赢得了越来越多用户的支持。
面对这一竞争态势,OpenAI援引业内知名评测指标"Artificial Analysis编程智能体指数",宣称其最新系列模型在各项指标上全面超越Anthropic的模型。
OpenAI将Sol定位为"迄今最强的编程模型",并将其与Anthropic近期推出的Fable进行了直接比较。根据编程智能体指数,OpenAI称"Sol以80分创下新的行业标杆,比Fable 5高出2.8分,同时输出Token用量不足其一半,耗时不及其一半,成本约低三分之一"。
OpenAI还补充道:"这一优势在整个系列中均有体现:Terra的得分略高于Fable 5,而Luna则超越了Opus 4.8。"
目前,GPT-5.6已在ChatGPT、Codex及OpenAI API上线。按每百万Token计费,具体价格如下:Sol为输入5美元/输出30美元,Terra为输入2.50美元/输出15美元,Luna为输入1美元/输出6美元。
Q&A
Q1:GPT-5.6有哪些版本,分别适合什么用户?
A:GPT-5.6共分三个版本:Sol是主力版,性能最强,适合对编程和网络安全有高要求的企业用户;Terra是中间档位,性能与成本兼顾;Luna是经济实惠版,适合预算有限的用户。三款模型均已在ChatGPT、Codex及OpenAI API上线,按每百万Token计费。
Q2:GPT-5.6在网络安全方面有哪些具体能力?
A:OpenAI将GPT-5.6定位为"迄今最强的网络安全模型"。它支持多种防御性安全活动,包括威胁建模、代码审查与漏洞修补,以及蓝队演练,即模拟黑客攻击自身系统,帮助用户在真实攻击发生前提前发现并修复安全漏洞。
Q3:ChatGPT Work是什么,有什么功能?
A:ChatGPT Work是OpenAI随GPT-5.6一同发布的企业办公工具,专为企业团队设计,支持桌面端、网页端和移动端使用。它可以协助用户处理日常事务,例如起草文件、制作电子表格和演示文稿,定位为企业团队的智能办公助手。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。