[中国,上海,2022年9月1日] 2022世界人工智能大会(WAIC)在上海隆重召开。WAIC的最高奖项——卓越人工智能引领者奖(Super AI Leader,简称SAIL奖)正式揭晓,基于昇腾AI的全球首个三模态大模型“紫东.太初”,从众多国内外参评项目中脱颖而出,荣获SAIL大奖。

SAIL奖作为人工智能领域高规格、国际化的奖项之一,以其“高层次”、“应用性”、“创新性”、“引领性”为主要导向。自2018年以来,吸引了众多海内外优秀项目参评,包括国内外知名学术科研机构和企业。“紫东.太初”由中科院自动化所与华为基于全栈自主创新的昇腾AI基础软硬件平台联合打造,是全球首个图、文、音三模态大模型,开创性地实现了图像、文本、语音三模态数据间的统一表示与相互生成,更加接近人类真正的感情和思考,灵活性更高,通用性更强,让AI从“一专一能”迈向“多专多能”,并为多模态人工智能行业应用提供创新基础,其技术的创新性、行业影响力获得评委的一致认可,最终获得SAIL大奖。
紫东.太初凭借四大突破,助力以多模态认知为核心的通用AI发展:首次提出多层次、多任务跨模态自监督学习框架,支持从Token级(单词级)走向模态级、样本级的三级预训练自监督学习方式;首次完成弱关联多模态数据语义统一表示,减少数据收集与清洗代价;首次实现多模态理解与生成任务的统一建模,支持跨模态检索、多模态分类、语音识别、图像生成等理解与生成任务;首次实现无监督超越有监督方法,基于1%数据标注实现100%有监督学习效果。截至目前,“紫东.太初”在2021年ACM Multimedia(国际多媒体大会) 和ICCV(国际计算机视觉大会)等人工智能领域国际比赛中多次夺魁,其相关研究论文发表多达20余篇,专利近20个,充分彰显其创新性和先进性。
去年底,国内首个多模态人工智能产业联盟成立,至今已吸引了包括新华社技术局、长安汽车、中国移动、千博手语等在内的41家成员单位加盟,通过开源的多模态大模型快速进行自身业务AI融合创新,陆续孵化出新媒体内容检索平台、智能座舱、南宋御街数字人、手语教考一体机等场景化行业应用。同时,在智能制造、智慧医疗、智慧文旅、社会公益等领域打造的创新行业应用也已经或即将上线,充分展现出人工智能大模型的产业价值。
从“紫东.太初”大模型的研发,到产业联盟的组建与行业应用的落地,都在不断开创产业聚集新模式。AI研发规则和产业应用模式迎来深刻变革,昇腾AI正在加速推动AI产业化和产业AI化,助力中国人工智能抢占智能时代新高地。
好文章,需要你的鼓励
惠普企业(HPE)发布搭载英伟达Blackwell架构GPU的新服务器,抢占AI技术需求激增市场。IDC预测,搭载GPU的服务器年增长率将达46.7%,占总市场价值近50%。2025年服务器市场预计增长39.9%至2839亿美元。英伟达向微软等大型云服务商大量供应Blackwell GPU,每周部署约7.2万块,可能影响HPE服务器交付时间。HPE在全球服务器市场占13%份额。受美国出口限制影响,国际客户可能面临额外限制。新服务器将于2025年9月2日开始全球发货。
阿里巴巴团队提出FantasyTalking2,通过创新的多专家协作框架TLPO解决音频驱动人像动画中动作自然度、唇同步和视觉质量的优化冲突问题。该方法构建智能评委Talking-Critic和41万样本数据集,训练三个专业模块分别优化不同维度,再通过时间步-层级自适应融合实现协调。实验显示全面超越现有技术,用户评价提升超12%。
安全专业协会ISACA面向全球近20万名认证安全专业人员推出AI安全管理高级认证(AAISM)。研究显示61%的安全专业人员担心生成式AI被威胁行为者利用。该认证涵盖AI治理与项目管理、风险管理、技术与控制三个领域,帮助网络安全专业人员掌握AI安全实施、政策制定和风险管控。申请者需持有CISM或CISSP认证。
UC Berkeley团队提出XQUANT技术,通过存储输入激活X而非传统KV缓存来突破AI推理的内存瓶颈。该方法能将内存使用量减少至1/7.7,升级版XQUANT-CL更可实现12.5倍节省,同时几乎不影响模型性能。研究针对现代AI模型特点进行优化,为在有限硬件资源下运行更强大AI模型提供了新思路。