[中国,上海,2022年9月1日] 2022世界人工智能大会(WAIC)在上海隆重召开。WAIC的最高奖项——卓越人工智能引领者奖(Super AI Leader,简称SAIL奖)正式揭晓,基于昇腾AI的全球首个三模态大模型“紫东.太初”,从众多国内外参评项目中脱颖而出,荣获SAIL大奖。

SAIL奖作为人工智能领域高规格、国际化的奖项之一,以其“高层次”、“应用性”、“创新性”、“引领性”为主要导向。自2018年以来,吸引了众多海内外优秀项目参评,包括国内外知名学术科研机构和企业。“紫东.太初”由中科院自动化所与华为基于全栈自主创新的昇腾AI基础软硬件平台联合打造,是全球首个图、文、音三模态大模型,开创性地实现了图像、文本、语音三模态数据间的统一表示与相互生成,更加接近人类真正的感情和思考,灵活性更高,通用性更强,让AI从“一专一能”迈向“多专多能”,并为多模态人工智能行业应用提供创新基础,其技术的创新性、行业影响力获得评委的一致认可,最终获得SAIL大奖。
紫东.太初凭借四大突破,助力以多模态认知为核心的通用AI发展:首次提出多层次、多任务跨模态自监督学习框架,支持从Token级(单词级)走向模态级、样本级的三级预训练自监督学习方式;首次完成弱关联多模态数据语义统一表示,减少数据收集与清洗代价;首次实现多模态理解与生成任务的统一建模,支持跨模态检索、多模态分类、语音识别、图像生成等理解与生成任务;首次实现无监督超越有监督方法,基于1%数据标注实现100%有监督学习效果。截至目前,“紫东.太初”在2021年ACM Multimedia(国际多媒体大会) 和ICCV(国际计算机视觉大会)等人工智能领域国际比赛中多次夺魁,其相关研究论文发表多达20余篇,专利近20个,充分彰显其创新性和先进性。
去年底,国内首个多模态人工智能产业联盟成立,至今已吸引了包括新华社技术局、长安汽车、中国移动、千博手语等在内的41家成员单位加盟,通过开源的多模态大模型快速进行自身业务AI融合创新,陆续孵化出新媒体内容检索平台、智能座舱、南宋御街数字人、手语教考一体机等场景化行业应用。同时,在智能制造、智慧医疗、智慧文旅、社会公益等领域打造的创新行业应用也已经或即将上线,充分展现出人工智能大模型的产业价值。
从“紫东.太初”大模型的研发,到产业联盟的组建与行业应用的落地,都在不断开创产业聚集新模式。AI研发规则和产业应用模式迎来深刻变革,昇腾AI正在加速推动AI产业化和产业AI化,助力中国人工智能抢占智能时代新高地。
好文章,需要你的鼓励
Allen AI研究所联合多家顶尖机构推出SAGE智能视频分析系统,首次实现类人化的"任意时长推理"能力。该系统能根据问题复杂程度灵活调整分析策略,配备六种智能工具进行协同分析,在处理10分钟以上视频时准确率提升8.2%。研究团队创建了包含1744个真实娱乐视频问题的SAGE-Bench评估平台,并采用创新的AI生成训练数据方法,为视频AI技术的实际应用开辟了新路径。
联想推出新一代NVMe存储解决方案DE6600系列,包含全闪存DE6600F和混合存储DE6600H两款型号。该系列产品延迟低于100微秒,支持多种连接协议,2U机架可容纳24块NVMe驱动器。容量可从367TB扩展至1.798PiB全闪存或7.741PiB混合配置,适用于AI、高性能计算、实时分析等场景,并配备双活控制器和XClarity统一管理平台。
中科院团队首次系统评估了AI视觉模型在文本压缩环境下的理解能力,发现虽然AI能准确识别压缩图像中的文字,但在理解深层含义、建立关联推理方面表现不佳。研究通过VTCBench测试系统揭示了AI存在"位置偏差"等问题,为视觉文本压缩技术的改进指明方向。