在生成式 AI 领域热闹非凡的一周里,科技行业正在权衡这位大语言模型领域新玩家带来的影响。中国的 DeepSeek 周一震惊股市,导致曾经的 AI 明星企业 Nvidia 市值蒸发 6000 亿美元。
随着市场逐渐平静并开始恢复,业界开始质疑这些影响的深远意义,以及中国表面上的 AI 复兴是否真如表象所示。
对 DeepSeek 的关注度可见一斑,一位投资分析师甚至不问 ServiceNow 公司的业绩表现,而是询问 CEO Bill McDermott 如何看待在其工作流解决方案中整合大语言模型时对 DeepSeek 的看法。
McDermott 在公司第四季度财报会议上对分析师表示:"这些模型正在以惊人的速度商品化,可能比任何人想象的都要快。"
"这对像我们这样的平台和应用程序供应商来说令人兴奋,因为竞争优势将体现在我们的应用程序、业务流程层面...最终实现业务成果。"
McDermott 向与会者表示,他不仅考虑到了客户的利益,还着眼于更便宜的大语言模型可能为 ServiceNow 带来的"毛利率效益"。
然而,这位 CEO 也表达了谨慎态度:"关于 DeepSeek,我认为我们需要三思而后行。我们坚信要充分了解实际情况,并且我们高度重视负责任的 AI。" 他表示 ServiceNow 团队正在研究 DeepSeek 出现带来的影响。
McDermott 的热情源于 DeepSeek 声称其最新的 R1 模型的开发成本仅为竞争对手的一小部分。While 欧美竞争对手在训练大语言模型上投入数十亿美元,据称 DeepSeek 仅花费约 558 万美元就达到了相当的性能。
DeepSeek R1 推理模型的定价可能比 OpenAI 的 o1 API 便宜 27 倍,但一些人对其声称表示怀疑。
首先,有人认为它是其他供应商提供的大语言模型的一个不错的开源替代品。虽然一些美国供应商宣称他们具有开源特性,但学术研究发现它们并不是真正开放的。
同样,DeepSeek 的开源声明也值得审视。系统集成商和 IT 服务供应商 Version1 指出,虽然 DeepSeek 发布了模型权重,但并未公开其训练数据和训练代码。
在 OpenAI 的 Reddit 讨论组中,有网友分享证据表明 DeepSeek R1 可能在基准答案上训练其模型,从而可能在不生产通用模型的情况下操纵市场。
用户称一些答案与基准答案显示 50-90% 的相似度。讨论组中的其他人质疑使用这种方法是否可能获得任何类似通用大语言模型的效果。
无论其性能和开源声明是否站得住脚,DeepSeek 的安全信誉也受到了打击,因为据称由于正在进行的网络攻击,该公司限制了其模型网络界面的新用户注册。
该公司在其状态页面上的说明称:"由于针对 DeepSeek 服务的大规模恶意攻击,我们暂时限制注册以确保服务持续运行。"
无论对股票估值的影响如何,随着中国继续推进进军西方软件市场,科技用户必将产生更多疑问。
好文章,需要你的鼓励
AI颠覆预计将在2026年持续,推动企业适应不断演进的技术并扩大规模。国际奥委会、Moderna和Sportradar的领导者在纽约路透社峰会上分享了他们的AI策略。讨论焦点包括自建AI与购买第三方资源的选择,AI在内部流程优化和外部产品开发中的应用,以及小型模型在日常应用中的潜力。专家建议,企业应将AI建设融入企业文化,以创新而非成本节约为驱动力。
字节跳动等机构联合发布GAR技术,让AI能同时理解图像的全局和局部信息,实现对多个区域间复杂关系的准确分析。该技术通过RoI对齐特征重放方法,在保持全局视野的同时提取精确细节,在多项测试中表现出色,甚至在某些指标上超越了体积更大的模型,为AI视觉理解能力带来重要突破。
Spotify在新西兰测试推出AI提示播放列表功能,用户可通过文字描述需求让AI根据指令和听歌历史生成个性化播放列表。该功能允许用户设置定期刷新,相当于创建可控制算法的每周发现播放列表。这是Spotify赋予用户更多控制权努力的一部分,此前其AI DJ功能也增加了语音提示选项,反映了各平台让用户更好控制算法推荐的趋势。
Inclusion AI团队推出首个开源万亿参数思维模型Ring-1T,通过IcePop、C3PO++和ASystem三项核心技术突破,解决了超大规模强化学习训练的稳定性和效率难题。该模型在AIME-2025获得93.4分,IMO-2025达到银牌水平,CodeForces获得2088分,展现出卓越的数学推理和编程能力,为AI推理能力发展树立了新的里程碑。