文字多模态大模型 | 浏览量 : 0 下载量: 1625 CSCD: 0
  • 导出

  • 分享

  • 收藏

  • 专辑

    • 多模态大模型面向电子文档视觉问答的数据生成

    • Multimodal large model-based method for generating visual Q&A data for electronic document images

    • 2025年30卷第9期 页码:3083-3096   

      收稿:2024-10-16

      修回:2025-02-16

      录用:2025-02-25

      网络首发:2025-02-26

      纸质出版:2025-09-16

    • DOI: 10.11834/jig.240610     

    移动端阅览

  • 黎宇哲, 伏凌, 朱泠皞, 罗琪頔, 涂来. 2025. 多模态大模型面向电子文档视觉问答的数据生成. 中国图象图形学报, 30(9):3083-3096 DOI: 10.11834/jig.240610.
    Li Yuzhe, Fu Ling, Zhu Linghao, Luo Qidi, Tu Lai. 2025. Multimodal large model-based method for generating visual Q&A data for electronic document images. Journal of Image and Graphics, 30(9):3083-3096 DOI: 10.11834/jig.240610.
  •  
  •  
文章被引用时,请邮件提醒。
提交

相关作者

尹文体 华中科技大学人工智能与自动化学院
武美奇 中国科学院自动化研究所
王翔 华中科技大学人工智能与自动化学院
谭创创 北京交通大学计算机 科学与技术学院
考月英 北京市科学技术研究院信息与人工智能技术研究所
高常鑫 华中科技大学人工智能与自动化学院
赵耀 北京交通大学计算机 科学与技术学院
黄凯奇 中国科学院自动化研究所

相关机构

中国科学院自动化研究所
北京交通大学计算机科学与技术学院
北京市科学技术研究院信息与人工智能技术研究所
西北工业大学
华南理工大学电子与信息学院
0