Ai2 全新小型 AI 模型表现优于 Google、Meta 等同类规模模型

Ai2 最近发布了名为 Olmo 2 1B 的 10 亿参数小型 AI 模型，在算术推理与事实核查测试中表现优于 Google、Meta 与阿里，尽管存在潜在风险，不建议商业应用。

看起来本周是小型 AI 模型的风头时刻。

周四，非营利 AI 研究机构 Ai2 发布了 Olmo 2 1B，这是一款拥有 10 亿参数的模型。Ai2 声称，在多个基准测试中，Olmo 2 1B 的表现超越了 Google、Meta 和阿里巴巴等公司推出的同等规模模型。参数（有时称为权重）是模型内部用于指导其行为的组成部分。

Olmo 2 1B 采用宽松的 Apache 2.0 许可证通过 AI 开发平台 Hugging Face 发布。与大多数模型不同，Olmo 2 1B 可以从零开始复现；Ai2 已经提供了用于开发该模型的代码和数据集 ( Olmo-mix-1124 , Dolmino-mix-1124 )。

虽然小型模型在能力上可能不及那些巨型模型，但重要的是，它们不需要高性能硬件运行。这使得开发人员和爱好者在面对较低端以及消费级设备的限制时，更容易使用它们。

在过去几天中，陆续发布了许多小型模型，包括 Microsoft 的 Phi 4 推理系列和 Qwen 的 2.5 Omni 3B。这些模型中的大多数——以及 Olmo 2 1B——都可以轻松在现代笔记本甚至移动设备上运行。

Ai2 表示，Olmo 2 1B 使用了由公开可用、AI 生成及人工创建的资料构成的 4 万亿 Token 数据集进行训练。Token 是模型接收并生成的原始数据单位—— 100 万个 Token 大约相当于 75 万个单词。

在衡量算术推理能力的基准测试 GSM8K 上，Olmo 2 1B 的得分优于 Google 的 Gemma 3 1B、Meta 的 Llama 3.2 1B 以及阿里巴巴的 Qwen 2.5 1.5B。在 TruthfulQA （一项评估事实准确性的测试）上，Olmo 2 1B 的表现同样超越了这三款模型。

不过，Ai2 警告称 Olmo 2 1B 也存在一定风险。该组织表示，像所有 AI 模型一样，它可能会产生“问题输出”，包括有害及“敏感”内容，以及事实不准确的陈述。因此，Ai2 建议不要在商业环境中部署 Olmo 2 1B。

来源：Techcrunch

0赞

好文章，需要你的鼓励

Ai2 全新小型 AI 模型表现优于 Google、Meta 等同类规模模型

来源：Techcrunch

2025

05/02

09:40

分享

点赞

联想集团混合式AI实践获权威肯定，CES期间获评“全球科技引领企业”

CES上杨元庆首谈AGI，碾压人类的叙事不会让AI更聪明

CES 2026 | 重大更新：NVIDIA DGX Spark开启“云边端”模式

Gmail新增Gemini驱动AI功能，智能优先级和摘要来袭

研究发现商业AI模型可完整还原《哈利·波特》原著内容

Razer在2026年CES展会推出全息AI伴侣项目

CES 2026：英伟达新架构亮相，AMD发布新芯片，Razer推出AI奇异产品

通过舞蹈认识LimX Dynamics的人形机器人Oli

谷歌为Gmail搜索引入AI概览功能并推出实验性AI智能收件箱

DuRoBo Krono：搭载AI助手的智能手机尺寸电子阅读器

OpenAI推出ChatGPT Health医疗问答功能

Anthropic寻求3500亿美元估值融资100亿美元

数据中心绕过电网获得所需电力

一项新研究指责 LM Arena 操纵其热门 AI 基准评测

AI 稳健发展，云加速助力微软大数据中心跃升

Google 的 AI 模式获扩展访问权限和新增功能

什么才是真正的 AI 代理？CIO 在炒作中迷失定义

AI生成的代码可能成为软件供应链的灾难 —— 原因解析

他们正在为人工智能构建 TCP/IP —— 叫做 NANDA

Anthropic 联合创始人 Jared Kaplan 将出席 TechCrunch Sessions: AI

AI 在网络安全的未来：乐观

芝加哥大学赵燕斌：我们做的是让AI看不见的“艺术”

如果您非常迫切的想了解IT领域最新产品与技术信息，那么订阅至顶网技术邮件将是您的最佳途径之一

CES 2026

2025 re:Invent ：亚马逊云科技把Agentic AI生态梳理明白了

电子竞技瞬息万变，Team Liquid的“数据+AI”制胜秘籍

中国移动呼和浩特数据中心：只有高效存力先行，AI才能跑出全力

关注官方公众号

关注官方微博

关注官方喜马拉雅

友情链接

业界热点: