Grok是马斯克旗下公司xAI在去年11月发布的,一款类ChatGPT产品,可以提供生成文本、代码、邮件、信息检索等功能。其测试性能超过GPT-3.5、LLaMA 2 70B,弱于GPT-4。
目前,该产品仅为X Premium+客户提供服务,至今没有大范围对外开放使用非常神秘。

Grok简单介绍
根据xAI在官网公布的早期模型卡显示,首先开发团队先训练了一个330亿参数的原始大模型Grok-0,其性能相当于700亿参数的LLaMA 2,但仅使用其一半的训练资源。
然后基于Grok-0进行蒸馏、微调开发了Grok-1,在GSM8k、MMLU、HumanEval等多个测试平台显示,其性能全面超过了LLaMA 2-70B、GPT-3.5。但与Claude 2、GPT-4还有较大的距离。

由于这些基准测试是公开的,Grok-1的训练数据可能已经包含了测试答案。
随后,开发团队使用了2023年匈牙利全国高中决赛的数学题对Grok-1、Claude 2、GPT-4进行了人工测试。
结果显示,Grok-1 以 C (59%) 的成绩通过了考试,而 Claude-2取得了差不多的成绩 (55%),GPT-4 以 68% 的成绩获得了B,其推理能力还是挺不错的。

训练数据方面,Grok-1 发布版本所使用的训练数据截至 2023 年第三季度的互联网数据以及xAI人工智能导师提供的数据。

局限性,虽然 Grok-1 在信息处理方面表现出色,但需要对 Grok-1生成的内容进行审核。Grok-1 语言模型不具备独立搜索网络的能力,不是一个多模态的产品。
马斯克为什么开源Grok
本月初,马斯克正式起诉了OpenAI以及其联合创始人Sam Altman和Greg Brockman。
原因是,OpenAI违反合同协议、违反信托义务和不公平的商业行为,在发布ChatGPT等爆火产品后转向闭源并开始盈利。这与最初的开放AI造福人类理念截然相反。
马斯克作为OpenAI最初创始人之一,表示Altman 和 Brockman 在 2015 年说服他帮助创立OpenAI并为其提供资金,同时承诺该公司将是一家非营利性AI研究机构,专注于对抗来自谷歌等科技公司的竞争。诉讼称,基于创始协议要求 OpenAI 向公众 免费提供 其技术成果。
但根据OpenAI最新发布的回应邮件来看,为了更好的开发AGI,获取更多资金壮大产品线走营利模式,当时马斯克是同意的。
所以,马斯克在这个时间点选择开源Grok,估计和前几天起诉OpenAI的案件有关,兑现自己当年联合创立OpenAI时的“开源”诺言。
关于xAI
xAI成立于2023年7月13日,隶属于马斯克旗下。其核心团队成员曾经分别在DeepMind、OpenAI、谷歌研究、微软研究、特斯拉等前沿公司或多伦多大学等学术机构任职过。
好文章,需要你的鼓励
芬兰阿尔托大学研究团队开发出革命性光学计算方法,利用单束光线实现复杂张量运算。该技术将数字信息编码到光波的振幅和相位中,通过光波相互作用自动完成深度学习所需的矩阵和张量乘法运算。与传统GPU逐步处理不同,光学系统可同时并行执行所有计算操作,运算速度达到光速级别。研究显示该方法具有被动处理、低功耗等优势,预计3-5年内可集成到现有硬件平台,为AI计算带来重大突破。
新加坡科技设计大学研究团队发现,通过控制大型语言模型的"思考语言"可显著提升输出多样性。研究显示,AI用非英语语言思考时能产生更多样化的答案,且距离英语越远的语言效果越好。混合多种语言思考的策略表现最佳,不仅提升创意输出,还增强了文化多元化表达能力,为解决AI输出同质化问题提供了简单有效的方案。
科学家成功将传统公里级粒子加速器缩小至房间大小,并实现商业化。TAU Systems公司开发的激光驱动尾场加速器利用超强激光脉冲产生等离子体,将电子加速至相对论速度。该设备首先用于航天电子设备的辐射测试,能量范围60-100兆电子伏特,成本约1000万美元起。未来还可应用于医疗成像、芯片检测和X射线光刻等领域,有望大幅降低粒子加速器的使用门槛。
浙江大学研究团队开发了PhyRPR三阶段视频生成系统,解决AI视频中物理规律违背问题。该方法将物理理解与视觉生成分离处理:首先用大型语言模型进行物理推理和关键帧生成,然后规划连续运动轨迹,最后通过运动感知技术精化视觉效果。实验证明该方法在物理一致性和视觉质量方面均优于现有技术。