总部位于上海的人工智能公司MiniMax发布了一款开源推理模型,在性能和成本方面对中国竞争对手DeepSeek以及美国的Anthropic、OpenAI和Google发起挑战。
MiniMax-M1于周一基于Apache软件许可证发布,因此是真正的开源模型,这与Meta的Llama系列(采用非开源的社区许可证)和DeepSeek(仅部分采用开源许可证)形成鲜明对比。
MiniMax在博客文章中自豪地表示:"在复杂的生产力导向场景中,M1的能力在开源模型中名列前茅,超越了国内闭源模型,接近领先的海外模型,同时提供业界最佳的成本效益。"
根据博客文章,M1在多个基准测试(AIME 2024、LiveCodeBench、SWE-bench Verified、Tau-bench和MRCR)上与OpenAI o3、Gemini 2.5 Pro、Claude 4 Opus、DeepSeek R1、DeepSeek R1-0528和Qwen3-235B展开竞争,在不同程度上领先或落后于其他模型。虽然供应商提供的基准测试结果需要谨慎对待,但源代码已在GitHub上公开,用户可以独立验证其性能。
MiniMax明确表示要取代DeepSeek成为行业颠覆者,特别强调其上下文窗口(能够处理的输入量)达到100万个token,与Google Gemini 2.5 Pro相当,是DeepSeek R1容量的八倍。
在输出方面,该模型可以处理8万个token,优于DeepSeek的6.4万token容量,但略逊于OpenAI o3的10万token输出能力。
得到阿里巴巴集团、腾讯和IDG资本支持的MiniMax声称,其Lightning Attention机制通过改善注意力矩阵计算方式,提高了训练和推理效率,使M1模型在处理长上下文输入和推理时具有优势。
该公司声称:"例如,在执行8万token的深度推理时,它只需要DeepSeek R1约30%的计算能力。这一特性使我们在训练和推理方面都具有显著的计算效率优势。"
这种更高效的计算方法,结合名为CISPO的改进强化学习算法(详见M1技术报告),转化为更低的计算成本。
MiniMax声称:"整个强化学习阶段仅使用512块英伟达H800芯片运行三周,租赁成本仅为53.74万美元。这比最初预期少了一个数量级。"
好文章,需要你的鼓励
第二届欧洲健康大会汇聚了全球健康领域领导者、初创企业、投资者和开发者,对当前医疗创新现状及未来发展进行年中评估。在经济不确定性和监管优先级变化的背景下,制药、健康科技和医疗服务领域都在竞相证明价值并扩大创新规模。会议涵盖了GLP-1药物兴起、真正的患者中心化、AI的潜力与陷阱,以及为大胆创新想法提供资金的途径等热点话题。
华盛顿大学研究团队开发出世界首个主动式耳机AI助手LLAMAPIE,能够在用户对话中主动提供简短关键词提醒,无需用户主动询问。该系统采用双模型架构,在真人测试中将问答准确率从37%提升至87%,同时保持对话自然流畅。这项技术为人机交互带来新突破,在教育、商务和辅助医疗等领域具有广阔应用前景。
全球风险投资资金在今年第二季度表现强劲,总资金从去年同期的820亿美元增长至910亿美元。AI公司获得400亿美元投资,占季度全球总额的45%。其中Scale AI单笔融资143亿美元创纪录。美国初创企业获得600亿美元,占全球风投资金的三分之二。2025年上半年全球风投总额达2050亿美元,同比增长32%,显示投资环境日益偏向大规模融资。
这项由Kaggle团队主导的重要研究揭示了生成式AI评估面临的严重危机。传统的测试方法在面对训练于海量互联网数据的AI模型时失效,数据泄露问题普遍存在。研究团队提出AI竞赛平台作为解决方案,其并行评估结构和成熟的防作弊机制为GenAI评估提供了可靠途径,对整个AI领域的发展方向具有重要指导意义。