[中国,上海,2022年9月1日] 2022世界人工智能大会(WAIC)在上海隆重召开。WAIC的最高奖项——卓越人工智能引领者奖(Super AI Leader,简称SAIL奖)正式揭晓,基于昇腾AI的全球首个三模态大模型“紫东.太初”,从众多国内外参评项目中脱颖而出,荣获SAIL大奖。
SAIL奖作为人工智能领域高规格、国际化的奖项之一,以其“高层次”、“应用性”、“创新性”、“引领性”为主要导向。自2018年以来,吸引了众多海内外优秀项目参评,包括国内外知名学术科研机构和企业。“紫东.太初”由中科院自动化所与华为基于全栈自主创新的昇腾AI基础软硬件平台联合打造,是全球首个图、文、音三模态大模型,开创性地实现了图像、文本、语音三模态数据间的统一表示与相互生成,更加接近人类真正的感情和思考,灵活性更高,通用性更强,让AI从“一专一能”迈向“多专多能”,并为多模态人工智能行业应用提供创新基础,其技术的创新性、行业影响力获得评委的一致认可,最终获得SAIL大奖。
紫东.太初凭借四大突破,助力以多模态认知为核心的通用AI发展:首次提出多层次、多任务跨模态自监督学习框架,支持从Token级(单词级)走向模态级、样本级的三级预训练自监督学习方式;首次完成弱关联多模态数据语义统一表示,减少数据收集与清洗代价;首次实现多模态理解与生成任务的统一建模,支持跨模态检索、多模态分类、语音识别、图像生成等理解与生成任务;首次实现无监督超越有监督方法,基于1%数据标注实现100%有监督学习效果。截至目前,“紫东.太初”在2021年ACM Multimedia(国际多媒体大会) 和ICCV(国际计算机视觉大会)等人工智能领域国际比赛中多次夺魁,其相关研究论文发表多达20余篇,专利近20个,充分彰显其创新性和先进性。
去年底,国内首个多模态人工智能产业联盟成立,至今已吸引了包括新华社技术局、长安汽车、中国移动、千博手语等在内的41家成员单位加盟,通过开源的多模态大模型快速进行自身业务AI融合创新,陆续孵化出新媒体内容检索平台、智能座舱、南宋御街数字人、手语教考一体机等场景化行业应用。同时,在智能制造、智慧医疗、智慧文旅、社会公益等领域打造的创新行业应用也已经或即将上线,充分展现出人工智能大模型的产业价值。
从“紫东.太初”大模型的研发,到产业联盟的组建与行业应用的落地,都在不断开创产业聚集新模式。AI研发规则和产业应用模式迎来深刻变革,昇腾AI正在加速推动AI产业化和产业AI化,助力中国人工智能抢占智能时代新高地。
好文章,需要你的鼓励
本文评测了六款控制台平铺终端复用器工具。GNU Screen作为老牌工具功能强大但操作复杂,Tmux更现代化但学习曲线陡峭,Byobu为前两者提供友好界面,Zellij用Rust编写界面简洁易用,DVTM追求极简主义,Twin提供类似TurboVision的文本界面环境。每款工具都有各自特点和适用场景。
韩国汉阳大学联合高通AI研究院开发出InfiniPot-V框架,解决了移动设备处理长视频时的内存限制问题。该技术通过时间冗余消除和语义重要性保留两种策略,将存储需求压缩至原来的12%,同时保持高准确性,让手机和AR眼镜也能实时理解超长视频内容。
网络安全公司Snyk宣布收购瑞士人工智能安全研究公司Invariant Labs,收购金额未公开。Invariant Labs从苏黎世联邦理工学院分拆成立,专注于帮助开发者构建安全可靠的AI代理工具和框架。该公司提供Explorer运行时观察仪表板、Gateway轻量级代理、Guardrails策略引擎等产品,并在工具中毒和模型上下文协议漏洞等新兴AI威胁防护方面处于领先地位。此次收购将推进Snyk保护下一代AI原生应用的使命。
纽约大学研究团队通过INT-ACT测试套件全面评估了当前先进的视觉-语言-动作机器人模型,发现了一个普遍存在的"意图-行动差距"问题:机器人能够正确理解任务和识别物体,但在实际动作执行时频频失败。研究还揭示了端到端训练会损害原有语言理解能力,以及多模态挑战下的推理脆弱性,为未来机器人技术发展提供了重要指导。