Ai2 全新小型 AI 模型表现优于 Google、Meta 等同类规模模型

Ai2 最近发布了名为 Olmo 2 1B 的 10 亿参数小型 AI 模型，在算术推理与事实核查测试中表现优于 Google、Meta 与阿里，尽管存在潜在风险，不建议商业应用。

看起来本周是小型 AI 模型的风头时刻。

周四，非营利 AI 研究机构 Ai2 发布了 Olmo 2 1B，这是一款拥有 10 亿参数的模型。Ai2 声称，在多个基准测试中，Olmo 2 1B 的表现超越了 Google、Meta 和阿里巴巴等公司推出的同等规模模型。参数（有时称为权重）是模型内部用于指导其行为的组成部分。

Olmo 2 1B 采用宽松的 Apache 2.0 许可证通过 AI 开发平台 Hugging Face 发布。与大多数模型不同，Olmo 2 1B 可以从零开始复现；Ai2 已经提供了用于开发该模型的代码和数据集 ( Olmo-mix-1124 , Dolmino-mix-1124 )。

虽然小型模型在能力上可能不及那些巨型模型，但重要的是，它们不需要高性能硬件运行。这使得开发人员和爱好者在面对较低端以及消费级设备的限制时，更容易使用它们。

在过去几天中，陆续发布了许多小型模型，包括 Microsoft 的 Phi 4 推理系列和 Qwen 的 2.5 Omni 3B。这些模型中的大多数——以及 Olmo 2 1B——都可以轻松在现代笔记本甚至移动设备上运行。

Ai2 表示，Olmo 2 1B 使用了由公开可用、AI 生成及人工创建的资料构成的 4 万亿 Token 数据集进行训练。Token 是模型接收并生成的原始数据单位—— 100 万个 Token 大约相当于 75 万个单词。

在衡量算术推理能力的基准测试 GSM8K 上，Olmo 2 1B 的得分优于 Google 的 Gemma 3 1B、Meta 的 Llama 3.2 1B 以及阿里巴巴的 Qwen 2.5 1.5B。在 TruthfulQA （一项评估事实准确性的测试）上，Olmo 2 1B 的表现同样超越了这三款模型。

不过，Ai2 警告称 Olmo 2 1B 也存在一定风险。该组织表示，像所有 AI 模型一样，它可能会产生“问题输出”，包括有害及“敏感”内容，以及事实不准确的陈述。因此，Ai2 建议不要在商业环境中部署 Olmo 2 1B。

来源：Techcrunch

0赞

好文章，需要你的鼓励

Ai2 全新小型 AI 模型表现优于 Google、Meta 等同类规模模型

来源：Techcrunch

2025

05/02

09:40

分享

点赞

数智惠闽企，展车进福州｜华为坤灵中国行2025·福建站成功举办，推动闽企智能化发展新征程

AI时代的影像实验：记录你眼中的“变化”

大象转身，亦或重塑大象：Unity团结引擎的“中国本土”进化

无万卡，不VLA：元戎启行与阿里云的“想法”和“解法”

AI爬虫让“价格战”变成“算法战”，利润正在被看不见的流量吞噬 AI 爬虫程序流量在短短一年内暴增 300%

做好可持续数字化转型的“必答题”

SUSE Linux Enterprise Server (SLES) 16全新发布：AI赋能，智领企业管理

SAP商业AI获乌镇峰会精品案例奖，助推中国企业实现确定性增长

专访｜Cloudera致力于打造AI时代的企业级“数据操作系统”

专访｜AI浪潮下的“卖水人”：Cloudera解构企业AI的“源”与“治”

SAP TechEd柏林观察：企业AI如何发挥飞轮效应?

CIO策略观察——软件测试：从传统困局到 AI 无人测试转型

数据中心绕过电网获得所需电力

一项新研究指责 LM Arena 操纵其热门 AI 基准评测

AI 稳健发展，云加速助力微软大数据中心跃升

Google 的 AI 模式获扩展访问权限和新增功能

什么才是真正的 AI 代理？CIO 在炒作中迷失定义

AI生成的代码可能成为软件供应链的灾难 —— 原因解析

他们正在为人工智能构建 TCP/IP —— 叫做 NANDA

Anthropic 联合创始人 Jared Kaplan 将出席 TechCrunch Sessions: AI

AI 在网络安全的未来：乐观

芝加哥大学赵燕斌：我们做的是让AI看不见的“艺术”

如果您非常迫切的想了解IT领域最新产品与技术信息，那么订阅至顶网技术邮件将是您的最佳途径之一

中国移动呼和浩特数据中心：只有高效存力先行，AI才能跑出全力

从“支撑工具”到“智能中枢”，AI原生ERP进化

阿里要用AI将云计算重做一遍

PEC 2025 AI创新者大会

关注官方公众号

关注官方微博

关注官方喜马拉雅

友情链接

业界热点: