OpenAI 首席执行官 Sam Altman 在 X 平台上发文表示:"我们本想同时向 Plus 和 Pro 用户推出,但由于公司发展迅速,我们的 GPU 资源已经告罄。这并非我们期望的运营方式,但很难完全预测导致 GPU 短缺的增长高峰。"他还将这个模型描述为"巨大"且"昂贵"。
尽管该模型是在之前的 GPT-4 基础上构建的,据 Altman 称,这是"第一个感觉像在与一个深思熟虑的人对话的模型",但他表示它"不会在基准测试中大放异彩"。
OpenAI 研究主管 Mia Glaese 在公司的直播发布会上表示:"我们仍在自行探索这个模型,特别是因为它不是一个推理模型,我们正在探索通过无监督学习出现的能力。我们非常高兴今天能够向世界推出这个模型,这样我们就可以一起探索它。"
根据 OpenAI 进行的准确性测试,GPT-4.5 的表现超过了之前的模型,明显减少了错误或缺乏依据的信息输出。据报道,该模型在理解细微差别,如微妙的暗示或隐含期望方面也有所提升。
据 Altman 透露,这个代号为 Orion 的模型将是公司最后一个非链式思维模型。未来的模型,如备受期待的 GPT-5(Altman 承诺将在未来几个月内发布)将是更先进的依赖推理能力的大语言模型。依赖推理能力的模型有望通过在产生响应前"思考"来更好地处理复杂问题。
Glaese 表示:"我们相信推理将成为我们未来模型的核心能力,但我们也认为今天讨论的两种范式,即无监督学习和推理是相辅相成的;像 GPT-4.5 这样具有更多世界知识且本质上更智能的模型将为未来的推理提供更强大的基础。"
随着包括中国的 DeepSeek 在内的竞争对手备受瞩目地崭露头角,ChatGPT 面临着持续提升性能的压力。
尽管如此,OpenAI 最近表示,尽管面临竞争,其用户增长仍然保持稳定。OpenAI 首席运营官 Brad Lightcap 上周告诉 CNBC,自去年 12 月以来,ChatGPT 的周活跃用户增长了 33%。
好文章,需要你的鼓励
苹果研究团队发布新论文,提出让专业设计师通过评论、草图和直接编辑等方式指导AI模型生成更好的用户界面。研究显示,基于设计师原生工作流程的反馈训练方法比传统强化学习效果更佳。21名设计师参与研究,提供1460个标注样本。最终训练的模型在界面设计质量上显著超越基础模型,甚至优于GPT-5。研究发现设计师通过草图和直接编辑提供反馈时,研究团队与设计师的一致性分别达到63.6%和76.1%。
英伟达团队通过44万小时人类日常视频训练出DreamDojo机器人世界模型,实现了机器人通过观察学习复杂操作技能的突破。该系统不仅能预测动作结果,还具备强大的泛化能力,可在未见过的环境中灵活操作新物体。通过创新的潜在动作学习和实时处理技术,为通用机器人智能开辟了新道路。
Atlassian首席执行官向投资者保证,公司能够在不大幅增加成本或压缩利润率的情况下将AI整合到服务中。该公司的Rovo智能AI产品已拥有500万用户,通过优化运营而非高价格策略保持了稳定的利润率。公司第二季度营收达16亿美元,同比增长23%,运营亏损从5750万美元收窄至4770万美元。
浙江大学联合蚂蚁集团推出的InftyThink+技术,通过让AI学会"分段思考、阶段总结"的方式,成功解决了AI推理过程冗长低效的问题。该方法在数学推理任务上将准确率提升21%,推理延迟减少32.8%,为AI实际应用扫清了重要技术障碍。