OpenAI神秘模型，再次被Sam Altman提及

OpenAI首席执行官Sam Altman在社交平台提及GPT-2模型，引发猜测是否为即将发布的新模型。Altman否认了这些猜测，但GPT-2的性能表现令人关注。OpenAI可能正在开发适用于移动设备的高性能、低消耗模型，以应对硬件限制和提高推理效率。这种模型可能会被用于苹果iOS 18中，以增强用户体验。

5月6日，OpenAI首席执行官Sam Altman在社交平台分享了一条推文“我是一个优秀的GPT-2聊天机器人”。

而在4月30日，Altman就提起过该模型非常喜欢GPT-2。按道理说一个只有15亿参数在2019年发布的开源模型，被反复提及两次就很不寻常。

更意外的是GPT-2曾短暂上榜LMSYS的聊天机器人竞技场性能媲美GPT-4、Claude Opus等模型。

很多人猜测，难道这是OpenAI即将发布的GPT-4.5、GPT-5？但在5月2日的一场公开演讲中，Altman否认了这个说法。

GPT-2开源地址：https://github.com/openai/gpt-2

论文地址：https://cdn.openai.com/better-language-models/language_models_are_unsupervised_multitask_learners.pdf

OpenAI神秘模型，再次被Sam Altman提及

从GPT-2展示出的性能来看有一点是可以肯定的，OpenAI掌握了一种新的训练、微调模型方法，可将小参数模型的性能训练的和大参数模型一样优秀，就像微软刚发布的Phi-3系列模型。

所以，这可能是一款针对手机、平板等移动设备的高性能、低消耗模型。因为，微软、谷歌、Meta等科技巨头都发布了针对移动端的大模型，唯独OpenAI迟迟没有发布。

加上苹果正在与OpenAI、谷歌洽谈希望在iOS 18中使用GPT系列模型来增强用户体验和产品性能。非常善于营销的Altman用这种“新锅抄旧菜”的方法进行病毒式宣传来赢得苹果的信任。

一方面，可以极大展示自己模型的性能与技术实力；另一方面给谷歌造成压力，虽然其Gemini系列是针对移动端的，但在市场应用方面并没有太多的反响。

OpenAI神秘模型，再次被Sam Altman提及

开发移动端的大模型都有一个非常相似的技术特点，就是参数都非常小。例如，微软刚发布的Phi-3系列模型，最小的只有13亿参数；谷歌的Gemini系列模型最小的只有18亿。

这是因为，参数越大模型的神经元就越多对硬件的要求也就越高。如果想部署在移动端的大模型需要考虑电池、存储空间、算力、延迟、推理效率等因素，才能在有限的硬件空间内发挥出最大的性能。例如，直接使用一个1000亿参数的模型，可能还没问几下电池先耗尽了。

此外，在移动设备对推理的效率要求也很高。目前手机端的延迟大概是web、PC端的数倍，如果想更好地使用语音助手、实时翻译、文本问答这些功能，也是使用小参数模型的主要原因之一。

OpenAI神秘模型，再次被Sam Altman提及

所以，OpenAI使用在2019年开源的15亿参数GPT-2模型来实验最合适不过了，并且架构也是基于Transformer，基本上是GPT-3、GPT-4的先辈模型。

当然，如果未来OpenAI真的发布面向移动端的小参数模型，名字肯定不会再叫GPT-2，大概会起GPT-4 mini/little一类的吧。

来源：AIGC开放社区

0赞

好文章，需要你的鼓励

OpenAI神秘模型，再次被Sam Altman提及

来源：AIGC开放社区

NHS

wing

Apian

英国NHS无人机快递医疗样本服务正式落地伦敦

人工智能

智能体评测

代码质量评估

Explyt团队打造的代码智能体评测新标准：光靠“通过/失败“根本不够用

英伟达

Jetson T3000

Aetina

Aetina宣布支持英伟达Jetson T3000和T2000 AI模块

多模态大语言模型

触觉感知

掩码隔离训练

机器人的“触觉觉醒“：韩国梨花女子大学如何让小型AI模型在不忘记视觉的前提下学会“感受“材质

2024

05/07

15:04

分享

点赞

AIGC开放社区

专注AIGC领域的专业社区，关注微软OpenAI、百度文心一言、讯飞星火等大语言模型（LLM）的发展和应用落地，聚焦LLM的市场研究和AIGC开发者生态，欢迎关注！

关注官方公众号

关注官方微博

关注官方喜马拉雅

友情链接

业界热点: