OpenAI 首席执行官 Sam Altman 在 X 平台上发文表示:"我们本想同时向 Plus 和 Pro 用户推出,但由于公司发展迅速,我们的 GPU 资源已经告罄。这并非我们期望的运营方式,但很难完全预测导致 GPU 短缺的增长高峰。"他还将这个模型描述为"巨大"且"昂贵"。
尽管该模型是在之前的 GPT-4 基础上构建的,据 Altman 称,这是"第一个感觉像在与一个深思熟虑的人对话的模型",但他表示它"不会在基准测试中大放异彩"。
OpenAI 研究主管 Mia Glaese 在公司的直播发布会上表示:"我们仍在自行探索这个模型,特别是因为它不是一个推理模型,我们正在探索通过无监督学习出现的能力。我们非常高兴今天能够向世界推出这个模型,这样我们就可以一起探索它。"
根据 OpenAI 进行的准确性测试,GPT-4.5 的表现超过了之前的模型,明显减少了错误或缺乏依据的信息输出。据报道,该模型在理解细微差别,如微妙的暗示或隐含期望方面也有所提升。
据 Altman 透露,这个代号为 Orion 的模型将是公司最后一个非链式思维模型。未来的模型,如备受期待的 GPT-5(Altman 承诺将在未来几个月内发布)将是更先进的依赖推理能力的大语言模型。依赖推理能力的模型有望通过在产生响应前"思考"来更好地处理复杂问题。
Glaese 表示:"我们相信推理将成为我们未来模型的核心能力,但我们也认为今天讨论的两种范式,即无监督学习和推理是相辅相成的;像 GPT-4.5 这样具有更多世界知识且本质上更智能的模型将为未来的推理提供更强大的基础。"
随着包括中国的 DeepSeek 在内的竞争对手备受瞩目地崭露头角,ChatGPT 面临着持续提升性能的压力。
尽管如此,OpenAI 最近表示,尽管面临竞争,其用户增长仍然保持稳定。OpenAI 首席运营官 Brad Lightcap 上周告诉 CNBC,自去年 12 月以来,ChatGPT 的周活跃用户增长了 33%。
好文章,需要你的鼓励
Allen AI研究所联合多家顶尖机构推出SAGE智能视频分析系统,首次实现类人化的"任意时长推理"能力。该系统能根据问题复杂程度灵活调整分析策略,配备六种智能工具进行协同分析,在处理10分钟以上视频时准确率提升8.2%。研究团队创建了包含1744个真实娱乐视频问题的SAGE-Bench评估平台,并采用创新的AI生成训练数据方法,为视频AI技术的实际应用开辟了新路径。
联想推出新一代NVMe存储解决方案DE6600系列,包含全闪存DE6600F和混合存储DE6600H两款型号。该系列产品延迟低于100微秒,支持多种连接协议,2U机架可容纳24块NVMe驱动器。容量可从367TB扩展至1.798PiB全闪存或7.741PiB混合配置,适用于AI、高性能计算、实时分析等场景,并配备双活控制器和XClarity统一管理平台。
中科院团队首次系统评估了AI视觉模型在文本压缩环境下的理解能力,发现虽然AI能准确识别压缩图像中的文字,但在理解深层含义、建立关联推理方面表现不佳。研究通过VTCBench测试系统揭示了AI存在"位置偏差"等问题,为视觉文本压缩技术的改进指明方向。