Grok 3 已开始推出。xAI 创始人 Elon Musk 将这款聊天机器人描述为"一个追求最大程度真相的 AI,即便这些真相有时与政治正确相悖"。
Grok 3 的预训练工作于今年一月初完成,不过 xAI 团队表示训练仍在继续。为此,他们专门建造了一个大型数据中心。该项目从去年四月开始开发,xAI 表示在 122 天内,该设施就达到了 10 万个 GPU 同步训练的规模。随后又用了 92 天将设施扩展到 20 万个 GPU。
这个数字听起来很大,但实际上呢?与竞争对手相比并不算什么。虽然发展速度令人瞩目,但 xAI 仍落后于 OpenAI。不过,他们试图通过一系列基准测试来证明 Musk 的 AI 平台优于竞争对手。
在简短的演示中,xAI 团队着重强调了 Grok 3 在科学、数学和编程方面相比其他模型 (如 OpenAI 的产品) 的优势。当然,我们在看待科技行业的任何基准测试时都需要持谨慎态度,而不仅仅是 AI 领域。
xAI 表示,Grok 3 的计算能力是其前代产品的 10 倍。而在演示中,Musk 声称这个数字接近 15 倍。
演示内容虽然引人注目但并非突破性的。在编程演示中,团队要求 Grok 3 开发一个结合俄罗斯方块和宝石迷阵的游戏,经过短暂停顿后,系统确实制作出了一个融合两款游戏精华的可玩游戏。
为呼应 Musk 的火星梦想,团队还要求计算往返火星的轨道,Grok 3 随即生成了一份包含动画的任务计划。它还报告了 Musk 另一个项目 - SpaceX 的 Starship 的进展情况。
尽管这些演示并不惊艳,但它们突显了 Grok 飞速发展的步伐。2024 年推出的 Grok 2 将在 Grok 3 被认定为成熟稳定后开源。
X 平台的 Premium+ 订阅用户将率先体验这项更新服务。此外还推出了"SuperGrok"升级版,根据 xAI 的说法,这将让用户提前体验新功能,并提供更高的图像生成限制。演示中没有透露 SuperGrok 的价格,不过 X 平台的 Premium+ 订阅在美国每月 40 美元,在英国为 17 英镑。
Musk 表示对话版本正在开发中,并提醒本周部署的更像是测试版。他说:"如果你想要更完善的版本,也许可以等一周。"
未来几周和几个月将推出的其他功能包括在 xAI 企业 API 中的 Grok 3 模型,以及对话中的记忆功能实现。
即使 Grok 3 具备搜索互联网寻找问题答案的能力,也不太可能引起太大轰动,我们完全可以想象 OpenAI 等竞争对手会迅速发布展示自身优势的基准测试结果。
然而,正是这种发展速度会让竞争对手深思。即便在快速发展的 AI 领域,Grok 3 的快速面世(虽然比 Musk 2024 年吹嘘的年底时间表稍晚)以及相比前代产品的改进,都令人印象深刻。
好文章,需要你的鼓励
传统数据工程面临数据质量差、治理不善等挑战,成为AI项目的最大障碍。多智能体AI系统通过协作方式正在彻底改变数据准备、治理和应用模式。Google Cloud基于Gemini大语言模型构建协作生态系统,让不同智能体专门负责数据工程、科学、治理和分析等任务。系统通过分层架构理解组织环境,自主学习历史工作流程,能够预防问题并自动处理重复性任务,大幅提升效率。
中科大团队开发出LongAnimation系统,解决了长动画自动上色中的色彩一致性难题。该系统采用动态全局-局部记忆机制,能够为平均500帧的动画进行稳定上色,性能比现有方法提升35-58%。核心创新包括SketchDiT特征提取器、智能记忆模块和色彩优化机制,可大幅提升动画制作效率。
微软推出Copilot调优功能,让企业通过低代码工具利用自动化微调技术训练企业数据。与基于公开数据的通用AI模型不同,企业需要理解内部数据和流程的专业化模型。Gartner预测专业化GenAI模型市场将在2026年翻倍至25亿美元。这些模型通常基于开源模型构建,部署为小语言模型,提供更好的成本控制和数据安全性,同时更易符合欧盟AI法案要求。
南开大学团队开发出DepthAnything-AC模型,解决了现有AI距离估算系统在恶劣天气和复杂光照条件下性能下降的问题。通过创新的扰动一致性训练框架和空间距离约束机制,该模型仅用54万张图片就实现了在雨雪、雾霾、夜晚等复杂环境下的稳定距离判断,同时保持正常条件下的优秀性能,为自动驾驶和机器人导航等应用提供了重要技术支撑。