OpenAI 于近日正式推出全新 ChatGPT 模型家族,该系列此前已于 6 月 26 日对外宣布,并于周三提前预告发布时间。
ChatGPT-5.6 系列包含 Sol、Terra 和 Luna 三款模型,现已在 ChatGPT、Codex 及 OpenAI API 平台上正式上线。OpenAI 在官方博客中表示,该系列模型正在全球范围内陆续推送,预计将在"未来 24 小时内"向所有用户开放。
自近四年前推出 ChatGPT 以来,OpenAI 始终处于人工智能浪潮的前沿位置,尽管面临谷歌、Anthropic 等竞争对手的持续挑战,其在整体用户规模上仍保持领先。
(信息披露:CNET 母公司 Ziff Davis 已于 2025 年对 OpenAI 提起诉讼,指控其在训练和运营 AI 系统过程中侵犯了 Ziff Davis 的版权。)
Sol 为本次发布的旗舰模型,专为处理复杂推理、端到端技术执行与设计任务而构建。OpenAI 将其定位为公司迄今最强的编程模型,在 Artificial Analysis 编程智能体指数评测中表现优于 Anthropic 的 Fable 5 模型。基准测试同时显示,Sol 在 Token 输出、响应时间与使用成本方面均表现出更高的效率。
Terra 定位为中端模型,主要面向日常工作流程,有望成为大多数用户的首选。Luna 则以降低成本和提升速度为优先目标。
OpenAI 表示,ChatGPT-5.6 在设计能力方面有显著提升,能够主动检查渲染结果以发现视觉问题。此外,OpenAI 还将 5.6 系列称为其迄今最强的网络安全模型,可在使用更少 Token 的情况下实现高水平表现。
正是由于最新前沿模型——GPT-5.6 与 Anthropic 的 Mythos 5 和 Fable 5——具备强大的网络安全能力,相关公司在向公众开放这些模型时态度较为审慎。以 Anthropic 为例,该公司最初仅向特定用户开放了一个专供网络安全用途的版本;在面向公众推出时,特朗普政府下令要求该公司禁止任何外国公民使用,实际上相当于暂时封禁,待政府完成安全评估后方可解除。GPT-5.6 同样首先向网络安全和技术专业人员开放,政府官员也要求分阶段进行公开发布。
ChatGPT Work
此次 OpenAI 的发布内容不止于此,同步推出的还有 ChatGPT Work。这是一款内嵌于 ChatGPT 中的智能体,能够在用户的应用程序和文件中直接执行操作。
ChatGPT Work 由 5.6 系列新模型驱动,具备强大的推理能力,可跨应用收集信息、制定计划并自动执行,全程几乎无需用户干预。此外,用户还可通过"定时任务"功能让该智能体在离开电脑时持续在后台运行。
Q&A
Q1:ChatGPT-5.6 的三款模型 Sol、Terra 和 Luna 有什么区别?
A:Sol 是旗舰模型,专注于复杂推理、技术执行和设计任务,也是 OpenAI 目前最强的编程模型;Terra 是中端模型,面向日常工作流程,适合大多数普通用户使用;Luna 则主打低成本和高速度,适合对响应速度和使用成本敏感的场景。三款模型均已在 ChatGPT、Codex 及 OpenAI API 上正式提供。
Q2:ChatGPT Work 是什么?它能做哪些事情?
A:ChatGPT Work 是 OpenAI 新推出的一款智能体,直接内嵌在 ChatGPT 中,能够跨应用和文件执行操作。它由 ChatGPT-5.6 系列模型驱动,可自动收集信息、规划任务并独立完成执行,用户几乎不需要手动干预。此外,ChatGPT Work 还支持"定时任务"功能,可在用户离开电脑时在后台持续工作。
Q3:GPT-5.6 为什么没有一开始就向所有公众开放?
A:主要原因在于 GPT-5.6 具备强大的网络安全能力,引发了政府层面的安全关切。GPT-5.6 最初仅向网络安全和技术专业人员开放,政府官员要求分阶段向公众发布,以便在全面开放前完成安全评估和预防措施。Anthropic 的同类模型也经历了类似的审查流程。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。