多媒体分析与理解 | 浏览量 : 0 下载量: 991 CSCD: 0
  • 导出

  • 分享

  • 收藏

  • 专辑

    • 融合知识表征的多模态Transformer场景文本视觉问答

    • Knowledge-representation-enhanced multimodal Transformer for scene text visual question answering

    • 2022年27卷第9期 页码:2761-2774   

      收稿:2022-01-05

      修回:2022-6-1

      录用:2022-6-8

      纸质出版:2022-09-16

    • DOI: 10.11834/jig.211213     

    移动端阅览

  • 余宙, 俞俊, 朱俊杰, 匡振中. 融合知识表征的多模态Transformer场景文本视觉问答[J]. 中国图象图形学报, 2022,27(9):2761-2774. DOI: 10.11834/jig.211213.
    Zhou Yu, Jun Yu, Junjie Zhu, Zhenzhong Kuang. Knowledge-representation-enhanced multimodal Transformer for scene text visual question answering[J]. Journal of Image and Graphics, 2022, 27(9): 2761-2774. DOI: 10.11834/jig.211213.
  •  
  •  
icon
试读结束,您可以激活您的VIP账号继续阅读。
去激活 >
icon
试读结束,您可以通过登录账户,到个人中心,购买VIP会员阅读全文。
已是VIP会员?
去登录 >
文章被引用时,请邮件提醒。
提交

相关作者

钱孟豪 安庆师范大学人工智能与计算机学院
刘奎 安庆师范大学人工智能与计算机学院
章丰博 安庆师范大学人工智能与计算机学院
苏本跃 铜陵学院数学与计算机学院
张冀 华北电力大学计算机系;华北电力大学复杂能源系统智能计算教育部工程研究中心
朱晓昀 华北电力大学计算机系
曹锦纲 华北电力大学计算机系;华北电力大学复杂能源系统智能计算教育部工程研究中心
翟清剑 华北电力大学计算机系

相关机构

安庆师范大学人工智能与计算机学院
铜陵学院数学与计算机学院
华北电力大学计算机系
华北电力大学复杂能源系统智能计算教育部工程研究中心
武汉大学计算机学院国家多媒体软件工程技术研究中心
0