在生成式 AI 领域热闹非凡的一周里,科技行业正在权衡这位大语言模型领域新玩家带来的影响。中国的 DeepSeek 周一震惊股市,导致曾经的 AI 明星企业 Nvidia 市值蒸发 6000 亿美元。
随着市场逐渐平静并开始恢复,业界开始质疑这些影响的深远意义,以及中国表面上的 AI 复兴是否真如表象所示。
对 DeepSeek 的关注度可见一斑,一位投资分析师甚至不问 ServiceNow 公司的业绩表现,而是询问 CEO Bill McDermott 如何看待在其工作流解决方案中整合大语言模型时对 DeepSeek 的看法。
McDermott 在公司第四季度财报会议上对分析师表示:"这些模型正在以惊人的速度商品化,可能比任何人想象的都要快。"
"这对像我们这样的平台和应用程序供应商来说令人兴奋,因为竞争优势将体现在我们的应用程序、业务流程层面...最终实现业务成果。"
McDermott 向与会者表示,他不仅考虑到了客户的利益,还着眼于更便宜的大语言模型可能为 ServiceNow 带来的"毛利率效益"。
然而,这位 CEO 也表达了谨慎态度:"关于 DeepSeek,我认为我们需要三思而后行。我们坚信要充分了解实际情况,并且我们高度重视负责任的 AI。" 他表示 ServiceNow 团队正在研究 DeepSeek 出现带来的影响。
McDermott 的热情源于 DeepSeek 声称其最新的 R1 模型的开发成本仅为竞争对手的一小部分。While 欧美竞争对手在训练大语言模型上投入数十亿美元,据称 DeepSeek 仅花费约 558 万美元就达到了相当的性能。
DeepSeek R1 推理模型的定价可能比 OpenAI 的 o1 API 便宜 27 倍,但一些人对其声称表示怀疑。
首先,有人认为它是其他供应商提供的大语言模型的一个不错的开源替代品。虽然一些美国供应商宣称他们具有开源特性,但学术研究发现它们并不是真正开放的。
同样,DeepSeek 的开源声明也值得审视。系统集成商和 IT 服务供应商 Version1 指出,虽然 DeepSeek 发布了模型权重,但并未公开其训练数据和训练代码。
在 OpenAI 的 Reddit 讨论组中,有网友分享证据表明 DeepSeek R1 可能在基准答案上训练其模型,从而可能在不生产通用模型的情况下操纵市场。
用户称一些答案与基准答案显示 50-90% 的相似度。讨论组中的其他人质疑使用这种方法是否可能获得任何类似通用大语言模型的效果。
无论其性能和开源声明是否站得住脚,DeepSeek 的安全信誉也受到了打击,因为据称由于正在进行的网络攻击,该公司限制了其模型网络界面的新用户注册。
该公司在其状态页面上的说明称:"由于针对 DeepSeek 服务的大规模恶意攻击,我们暂时限制注册以确保服务持续运行。"
无论对股票估值的影响如何,随着中国继续推进进军西方软件市场,科技用户必将产生更多疑问。
好文章,需要你的鼓励
月之暗面Kimi K2技术报告:解读万亿参数的智能体模型(含K2与DeepSeek R1对比)
约翰霍普金斯大学研究团队开发了ETTIN模型套件,首次实现了编码器和解码器模型的公平比较。研究发现编码器擅长理解任务,解码器擅长生成任务,跨界训练效果有限。该研究为AI模型选择提供了科学依据,所有资料已开源供学术界使用。
Colt科技服务公司推出超低延迟云连接服务Colt ULL DCA,专门面向加密货币交易商和AI应用开发企业的高速需求。该服务结合超低延迟网络和专用云接入平台,绕过公共互联网提供专用高速路径。在AWS亚洲区域测试中,平均延迟比原生路由降低15%。随着亚太地区数字资产交易成熟和AI需求爆发,企业对安全高性能连接需求激增,Colt正加速在东南亚扩张布局。
博洛尼亚大学团队开发出情感增强的AI系统,通过结合情感分析和文本分类技术,显著提升了新闻文章中主观性表达的识别准确率。该研究覆盖五种语言,在多项国际评测中取得优异成绩,为打击虚假信息和提升媒体素养提供了新工具。