OpenAI 首席执行官 Sam Altman 在 X 平台上发文表示:"我们本想同时向 Plus 和 Pro 用户推出,但由于公司发展迅速,我们的 GPU 资源已经告罄。这并非我们期望的运营方式,但很难完全预测导致 GPU 短缺的增长高峰。"他还将这个模型描述为"巨大"且"昂贵"。
尽管该模型是在之前的 GPT-4 基础上构建的,据 Altman 称,这是"第一个感觉像在与一个深思熟虑的人对话的模型",但他表示它"不会在基准测试中大放异彩"。
OpenAI 研究主管 Mia Glaese 在公司的直播发布会上表示:"我们仍在自行探索这个模型,特别是因为它不是一个推理模型,我们正在探索通过无监督学习出现的能力。我们非常高兴今天能够向世界推出这个模型,这样我们就可以一起探索它。"
根据 OpenAI 进行的准确性测试,GPT-4.5 的表现超过了之前的模型,明显减少了错误或缺乏依据的信息输出。据报道,该模型在理解细微差别,如微妙的暗示或隐含期望方面也有所提升。
据 Altman 透露,这个代号为 Orion 的模型将是公司最后一个非链式思维模型。未来的模型,如备受期待的 GPT-5(Altman 承诺将在未来几个月内发布)将是更先进的依赖推理能力的大语言模型。依赖推理能力的模型有望通过在产生响应前"思考"来更好地处理复杂问题。
Glaese 表示:"我们相信推理将成为我们未来模型的核心能力,但我们也认为今天讨论的两种范式,即无监督学习和推理是相辅相成的;像 GPT-4.5 这样具有更多世界知识且本质上更智能的模型将为未来的推理提供更强大的基础。"
随着包括中国的 DeepSeek 在内的竞争对手备受瞩目地崭露头角,ChatGPT 面临着持续提升性能的压力。
尽管如此,OpenAI 最近表示,尽管面临竞争,其用户增长仍然保持稳定。OpenAI 首席运营官 Brad Lightcap 上周告诉 CNBC,自去年 12 月以来,ChatGPT 的周活跃用户增长了 33%。
好文章,需要你的鼓励
CoreWeave发布AI对象存储服务,采用本地对象传输加速器(LOTA)技术,可在全球范围内高速传输对象数据,无出口费用或请求交易分层费用。该技术通过智能代理在每个GPU节点上加速数据传输,提供高达每GPU 7 GBps的吞吐量,可扩展至数十万个GPU。服务采用三层自动定价模式,为客户的AI工作负载降低超过75%的存储成本。
莫斯科高等经济学院研究员尼古拉·斯克里普科开发了IFEval-FC基准测试,专门评估大语言模型在函数调用中遵循格式指令的能力。研究发现,即使是GPT-5和Claude Opus 4.1等最先进模型,在处理看似简单的格式要求时准确率也不超过80%,揭示了AI在实际应用中的重要局限性。
谷歌DeepMind与核聚变初创公司CFS合作,运用先进AI模型帮助管理和改进即将发布的Sparc反应堆。DeepMind开发了名为Torax的专用软件来模拟等离子体,结合强化学习等AI技术寻找最佳核聚变控制方式。核聚变被视为清洁能源的圣杯,可提供几乎无限的零碳排放能源。谷歌已投资CFS并承诺购买其200兆瓦电力。
上海人工智能实验室联合多家机构推出MinerU2.5文档解析模型,仅用12亿参数就在文本、公式、表格识别等任务上全面超越GPT-4o等大型模型。该模型采用创新的两阶段解析策略,先进行全局布局分析再做局部精细识别,计算效率提升一个数量级。通过重新定义任务标准和构建高质量数据引擎,MinerU2.5能准确处理旋转表格、复杂公式、多语言文档等挑战性内容,为文档数字化提供了高效解决方案。