亚马逊网络服务(AWS)今日宣布,在其AI模型组合中新增两款全托管开放权重模型——Qwen3和DeepSeek-V3.1。
这些新模型为依赖Amazon Bedrock生成式AI服务的客户提供了更大的灵活性,以满足其不断发展的业务需求。
开放权重模型为开发者提供了关于模型权重的更高透明度,这使得为特定用例定制模型变得更加容易。Amazon Bedrock中的这些新开放权重模型与来自Meta Platforms、Mistral AI和OpenAI等领先开发商的其他模型共同组成了丰富的模型生态系统。
不同模型在各个领域都有其独特优势。来自阿里巴巴的Qwen3为复杂编程和通用推理提供了模型选项,而DeepSeek-V3.1模型在数学、编程和智能体任务方面表现出色。Qwen3是Amazon Bedrock产品组合中首个全托管的Qwen模型系列。
虽然这些模型可以免费获得,但通过在Bedrock中使用这些模型,客户可以利用亚马逊的企业级安全性,包括数据加密和严格的访问控制,这有助于维护数据隐私和法规合规性。客户保持对其数据的完全控制,AWS不会与模型提供商共享模型输入和输出数据,也不会用于改进基础模型。
AWS技术总监Shaown Nandi表示,AWS将在亚洲、拉丁美洲、欧洲和北美等关键全球市场推出这些新模型。他指出,大型通用AI模型对于许多企业中常见的窄用例来说可能过于庞大。"你想要一个更小的模型,或者更便宜的模型,这是可以的,因为用例的多样性,"Nandi说。"我们在开放权重模型中看到的是成本优势和选择优势。"
Qwen3系列提供四个新的开放权重模型,这些多语言模型可以规划多步骤工作流程,与工具和API集成,并在任务中处理长上下文窗口。两个通用模型提供"思考"和"非思考"推理模式。
DeepSeek-V3.1模型的优势在于混合推理能力,能够平衡快速响应与深度、透明的思考,使客户能够根据要解决的问题类型在模式之间切换。该模型能耗效率很高,很少将基本查询转化为冗长的讨论,同时在制定战略决策方面保持高水平的专业性。
AWS通过客户反馈、使用情况分析和对部署及更新计划的educated guess来决定在哪些市场推出什么模型。目前,AWS提供数百种模型,并正在扩大添加新模型的区域范围。
Q&A
Q1:Qwen3和DeepSeek-V3.1模型有什么特色功能?
A:Qwen3是来自阿里巴巴的多语言模型,擅长复杂编程和通用推理,可以规划多步骤工作流程,提供"思考"和"非思考"推理模式。DeepSeek-V3.1则在数学、编程和智能体任务方面表现出色,具有混合推理能力,能够平衡快速响应与深度思考。
Q2:开放权重模型相比其他模型有什么优势?
A:开放权重模型提供更高的透明度,使开发者更容易为特定用例定制模型。它们具有成本优势和选择优势,通过模型蒸馏技术,客户可以将模型训练到更小尺寸,保持准确性的同时运行成本可降低多达30倍。
Q3:AWS在哪些地区提供这些新的AI模型服务?
A:AWS将在亚洲、拉丁美洲、欧洲和北美等关键全球市场推出这些新模型。特别是拉丁美洲和亚洲部分地区的客户对能够为本地需求调优模型表现出特别的兴趣,而开放权重模型更容易实现这一点。
好文章,需要你的鼓励
AI颠覆预计将在2026年持续,推动企业适应不断演进的技术并扩大规模。国际奥委会、Moderna和Sportradar的领导者在纽约路透社峰会上分享了他们的AI策略。讨论焦点包括自建AI与购买第三方资源的选择,AI在内部流程优化和外部产品开发中的应用,以及小型模型在日常应用中的潜力。专家建议,企业应将AI建设融入企业文化,以创新而非成本节约为驱动力。
字节跳动等机构联合发布GAR技术,让AI能同时理解图像的全局和局部信息,实现对多个区域间复杂关系的准确分析。该技术通过RoI对齐特征重放方法,在保持全局视野的同时提取精确细节,在多项测试中表现出色,甚至在某些指标上超越了体积更大的模型,为AI视觉理解能力带来重要突破。
Spotify在新西兰测试推出AI提示播放列表功能,用户可通过文字描述需求让AI根据指令和听歌历史生成个性化播放列表。该功能允许用户设置定期刷新,相当于创建可控制算法的每周发现播放列表。这是Spotify赋予用户更多控制权努力的一部分,此前其AI DJ功能也增加了语音提示选项,反映了各平台让用户更好控制算法推荐的趋势。
Inclusion AI团队推出首个开源万亿参数思维模型Ring-1T,通过IcePop、C3PO++和ASystem三项核心技术突破,解决了超大规模强化学习训练的稳定性和效率难题。该模型在AIME-2025获得93.4分,IMO-2025达到银牌水平,CodeForces获得2088分,展现出卓越的数学推理和编程能力,为AI推理能力发展树立了新的里程碑。