Grok是马斯克旗下公司xAI在去年11月发布的,一款类ChatGPT产品,可以提供生成文本、代码、邮件、信息检索等功能。其测试性能超过GPT-3.5、LLaMA 2 70B,弱于GPT-4。
目前,该产品仅为X Premium+客户提供服务,至今没有大范围对外开放使用非常神秘。
Grok简单介绍
根据xAI在官网公布的早期模型卡显示,首先开发团队先训练了一个330亿参数的原始大模型Grok-0,其性能相当于700亿参数的LLaMA 2,但仅使用其一半的训练资源。
然后基于Grok-0进行蒸馏、微调开发了Grok-1,在GSM8k、MMLU、HumanEval等多个测试平台显示,其性能全面超过了LLaMA 2-70B、GPT-3.5。但与Claude 2、GPT-4还有较大的距离。
由于这些基准测试是公开的,Grok-1的训练数据可能已经包含了测试答案。
随后,开发团队使用了2023年匈牙利全国高中决赛的数学题对Grok-1、Claude 2、GPT-4进行了人工测试。
结果显示,Grok-1 以 C (59%) 的成绩通过了考试,而 Claude-2取得了差不多的成绩 (55%),GPT-4 以 68% 的成绩获得了B,其推理能力还是挺不错的。
训练数据方面,Grok-1 发布版本所使用的训练数据截至 2023 年第三季度的互联网数据以及xAI人工智能导师提供的数据。
局限性,虽然 Grok-1 在信息处理方面表现出色,但需要对 Grok-1生成的内容进行审核。Grok-1 语言模型不具备独立搜索网络的能力,不是一个多模态的产品。
马斯克为什么开源Grok
本月初,马斯克正式起诉了OpenAI以及其联合创始人Sam Altman和Greg Brockman。
原因是,OpenAI违反合同协议、违反信托义务和不公平的商业行为,在发布ChatGPT等爆火产品后转向闭源并开始盈利。这与最初的开放AI造福人类理念截然相反。
马斯克作为OpenAI最初创始人之一,表示Altman 和 Brockman 在 2015 年说服他帮助创立OpenAI并为其提供资金,同时承诺该公司将是一家非营利性AI研究机构,专注于对抗来自谷歌等科技公司的竞争。诉讼称,基于创始协议要求 OpenAI 向公众 免费提供 其技术成果。
但根据OpenAI最新发布的回应邮件来看,为了更好的开发AGI,获取更多资金壮大产品线走营利模式,当时马斯克是同意的。
所以,马斯克在这个时间点选择开源Grok,估计和前几天起诉OpenAI的案件有关,兑现自己当年联合创立OpenAI时的“开源”诺言。
关于xAI
xAI成立于2023年7月13日,隶属于马斯克旗下。其核心团队成员曾经分别在DeepMind、OpenAI、谷歌研究、微软研究、特斯拉等前沿公司或多伦多大学等学术机构任职过。
好文章,需要你的鼓励
微软宣布为Word和Excel推出基于OpenAI的AI代理模式,通过简单提示即可自动生成文档和分析数据。Word用户可享受"氛围写作"功能,利用现有文档组装报告和提案。Excel代理能分析电子表格数据并生成可视化报告。尽管在SpreadsheetBench基准测试中准确率仅为57.2%,低于人类平均水平71.3%,但微软强调其针对实际工作场景优化。此外,微软还发布了基于Anthropic的Office代理,显示其正逐步减少对OpenAI的依赖。
苹果与清华合作提出EpiCache技术,解决AI长期对话中的记忆管理难题。该方法将对话自动分割成话题片段,为每个话题建立专门记忆库,实现智能匹配和高效检索。实验显示,EpiCache比传统方法准确率提高40%,内存使用减少4-6倍,响应速度提升2.4倍,为资源受限环境下的AI对话系统提供了实用解决方案。
OpenAI为美国ChatGPT用户推出"即时结账"功能,用户可在对话中直接购买Etsy和Shopify商品,无需跳转至外部网站。该功能支持Apple Pay、Google Pay等多种支付方式,并计划接入超过100万家Shopify商户。OpenAI还将开源其代理商务协议技术,与谷歌的代理支付协议形成竞争。这标志着电商购物模式的重大转变,AI聊天机器人可能重塑在线零售发现和支付生态系统。
清华大学与英伟达合作提出DiffusionNFT,一种革命性的AI图像生成训练方法。该方法通过对比正负样本进行学习,避免了复杂的概率计算,训练效率比传统方法提升25倍。研究团队在多项测试中验证了其优越性,不仅大幅提升了图像质量和文字渲染能力,还实现了无需分类器引导的高效训练,为AI图像生成技术的普及和应用奠定了重要基础。