OpenAI 已开始向 ChatGPT Plus 会员用户推出其最新的 AI 模型 GPT-4.5。
OpenAI 在 X 平台上发布的一系列帖子中表示,此次推广将持续 "1-3 天",并预计访问频率限制会有所调整。GPT-4.5 上周首先向每月支付 200 美元的 ChatGPT Pro 计划订阅用户开放。
公司在一篇帖子中写道:"我们希望为所有能访问 GPT-4.5 的用户提供较大的访问频率限制,但随着我们对需求了解的加深,这些限制可能会发生变化。"
GPT-4.5 是 OpenAI 迄今为止最大的 AI 模型,其训练所需的计算能力和数据量超过了公司之前的所有版本。但这并不意味着它是 OpenAI 最优秀的模型。在多个 AI 基准测试中,GPT-4.5 的表现不如来自中国 AI 公司 DeepSeek、Anthropic 以及 OpenAI 自己开发的新型 AI "推理" 模型。
OpenAI 承认 GPT-4.5 的运营成本非常高昂——如此昂贵以致于公司正在评估是否要在长期继续通过其 API 提供 GPT-4.5 服务。为了覆盖成本,公司对输入模型的每百万个 token (约 75 万字) 收取 75 美元,对模型生成的每百万个 token 收取 150 美元,这分别是 OpenAI 主力模型 GPT-4o 输入成本的 30 倍和输出成本的 15 倍。
尽管如此,OpenAI 表示 GPT-4.5 更大的规模使其具备了 "更深入的世界知识" 和 "更高的情商"。根据 OpenAI 的说法,GPT-4.5 的幻觉(产生虚假信息)频率也低于大多数模型——这理论上意味着它不太可能编造内容。
GPT-4.5 还具有很强的说服力。OpenAI 的一项内部基准测试发现,该模型特别擅长说服其他 AI 给它现金。
好文章,需要你的鼓励
CoreWeave发布AI对象存储服务,采用本地对象传输加速器(LOTA)技术,可在全球范围内高速传输对象数据,无出口费用或请求交易分层费用。该技术通过智能代理在每个GPU节点上加速数据传输,提供高达每GPU 7 GBps的吞吐量,可扩展至数十万个GPU。服务采用三层自动定价模式,为客户的AI工作负载降低超过75%的存储成本。
莫斯科高等经济学院研究员尼古拉·斯克里普科开发了IFEval-FC基准测试,专门评估大语言模型在函数调用中遵循格式指令的能力。研究发现,即使是GPT-5和Claude Opus 4.1等最先进模型,在处理看似简单的格式要求时准确率也不超过80%,揭示了AI在实际应用中的重要局限性。
谷歌DeepMind与核聚变初创公司CFS合作,运用先进AI模型帮助管理和改进即将发布的Sparc反应堆。DeepMind开发了名为Torax的专用软件来模拟等离子体,结合强化学习等AI技术寻找最佳核聚变控制方式。核聚变被视为清洁能源的圣杯,可提供几乎无限的零碳排放能源。谷歌已投资CFS并承诺购买其200兆瓦电力。
上海人工智能实验室联合多家机构推出MinerU2.5文档解析模型,仅用12亿参数就在文本、公式、表格识别等任务上全面超越GPT-4o等大型模型。该模型采用创新的两阶段解析策略,先进行全局布局分析再做局部精细识别,计算效率提升一个数量级。通过重新定义任务标准和构建高质量数据引擎,MinerU2.5能准确处理旋转表格、复杂公式、多语言文档等挑战性内容,为文档数字化提供了高效解决方案。