快速发布求购 登录 注册
行业资讯行业财报市场标准研发新品会议盘点政策本站速递

自动化所研发出跨模态通用人工智能平台“紫东太初”

仪表研发 2021年07月14日 11:50:23来源:自动化研究所 20532
摘要中国科学院自动化研究所在2021世界人工智能大会(WAIC2021)上就人工智能的最新进展进行报告,发布了自动化所研发的跨模态通用人工智能平台——“紫东太初”。

  【仪表网 仪表研发】7月9日,中国科学院自动化研究所在2021世界人工智能大会(WAIC2021)上就人工智能的最新进展进行报告,发布了自动化所研发的跨模态通用人工智能平台——“紫东太初”。
 
  “紫东太初”跨模态通用人工智能平台以多模态大模型为核心,基于全栈国产化基础软硬件平台,可支撑全场景AI应用。多模态预训练模型被广泛认为是从限定领域的弱人工智能迈向通用人工智能路径的探索。“紫东太初”跨模态通用人工智能平台瞄准成为实现通用人工智能的目标,对促进智能世界的发展具有重要意义。
 
  依托面向超大规模的高效分布式训练框架,自动化所构建了具有性能优良的中文预训练模型、语音预训练模型和视觉预训练模型,并开拓性地通过跨模态语义关联实现了视觉-文本-语音三模态统一表示,构建了三模态预训练大模型,赋予跨模态通用人工智能平台多种核心能力。
 
  “紫东太初”兼具跨模态理解和生成能力。与单模态和图文两模态相比,其采用一个大模型就能够灵活支撑图-文-音全场景AI应用,具有了在无监督情况下多任务联合学习、并快速迁移到不同领域数据的能力。引入语音模态后的多模态预训练模型,可实现共性图文音语义空间表征和利用,并直接实现三模态的统一表示。特别的是,该研究使“以图生音”和“以音生图”成为现实,为更广泛、更多样的下游任务提供了模型基础支撑,达成AI在如视频配音、语音播报、标题摘要、海报创作等更多元场景的应用。
 
  此外,自动化所研发团队还提出了弱关联三模态数据的语义统一表达,可同时支持三种或任两种模态弱关联数据进行预训练,有效降低了多模态数据收集与清洗成本。
 
  总结来说,此跨模态通用人工智能平台包括三大关键技术和六大核心能力。三大关键技术是多模态理解与生成的多任务统一建模、面向国产化软硬件的高效训练与部署、多模态预训练模型架构设计与优化。六大核心能力体现为多模态统一表示与语义关联、跨模态内容转化与生成、预训练模型网络架构设计、标注受限自监督模型学习、模型适配与分布式训练、模型轻量化与推理加速。
 
  会上,自动化所长徐波展示了基于“紫东太初”平台打造的虚拟人“小初”,并进行通用多模态大模型的人机对话演示,展示了不同模态间的互相转换和生成实例,涵盖视频描述、智能问答、图像检索、吟诗作赋、中文续写、双语翻译、语音识别等多个功能。这表明,通过图文音三模态的关联与协同能够有效提升机器的理解和生成能力。
 
  “大数据+大模型+多模态”将改变当前单一模型对应单一任务的人工智能研发范式,多模态大模型将成为不同领域的共性平台技术,是迈向通用人工智能路径的探索,具有广阔的应用前景;全栈国产化通用人工智能平台的实践对我国实现AI领域科技创新具有重要意义。

我要评论
文明上网,理性发言。(您还可以输入200个字符)

所有评论仅代表网友意见,与本站立场无关。

版权与免责声明
  • 凡本网注明"来源:仪表网"的所有作品,版权均属于仪表网,未经本网授权不得转载、摘编或利用其它方式使用上述作品。已经本网授权使用作品的,应在授权范围内使用,并注明"来源:仪表网"。违反上述声明者,本网将追究其相关法律责任。
  • 本网转载并注明自其它来源的作品,目的在于传递更多信息,并不代表本网赞同其观点或证实其内容的真实性,不承担此类作品侵权行为的直接责任及连带责任。其他媒体、网站或个人从本网转载时,必须保留本网注明的作品来源,并自负版权等法律责任。
  • 如涉及作品内容、版权等问题,请在作品发表之日起一周内与本网联系,否则视为放弃相关权利。
  • 合作、投稿、转载授权等相关事宜,请联系本网。联系电话:0571-87759945,QQ:1103027433。
广告招商
今日换一换
新发产品更多+

客服热线:0571-87759942

采购热线:0571-87759942

媒体合作:0571-87759945

  • 仪表站APP
  • 微信公众号
  • 仪表网小程序
  • 仪表网抖音号
Copyright ybzhan.cn    All Rights Reserved   法律顾问:浙江天册律师事务所 贾熙明律师   仪表网-仪器仪表行业“互联网+”服务平台
意见反馈
我知道了