文字多模态大模型 | 浏览量 : 0 下载量: 1754 CSCD: 0
  • 导出

  • 分享

  • 收藏

  • 专辑

    • 多模态大模型面向电子文档视觉问答的数据生成

    • Multimodal large model-based method for generating visual Q&A data for electronic document images

    • 2025年30卷第9期 页码:3083-3096   

      收稿:2024-10-16

      修回:2025-02-16

      录用:2025-02-25

      网络首发:2025-02-26

      纸质出版:2025-09-16

    • DOI: 10.11834/jig.240610     

    移动端阅览

  • 黎宇哲, 伏凌, 朱泠皞, 罗琪頔, 涂来. 2025. 多模态大模型面向电子文档视觉问答的数据生成. 中国图象图形学报, 30(9):3083-3096 DOI: 10.11834/jig.240610.
    Li Yuzhe, Fu Ling, Zhu Linghao, Luo Qidi, Tu Lai. 2025. Multimodal large model-based method for generating visual Q&A data for electronic document images. Journal of Image and Graphics, 30(9):3083-3096 DOI: 10.11834/jig.240610.
  •  
  •  
文章被引用时,请邮件提醒。
提交

相关作者

杨易 浙江大学脑机智能全国重点实验室;浙江大学人工智能学院
王俊 OPPO研究院
王文冠 浙江大学脑机智能全国重点实验室;浙江大学人工智能学院
刘锐 浙江大学脑机智能全国重点实验室;浙江大学人工智能学院
尹文体 华中科技大学人工智能与自动化学院
武美奇 中国科学院自动化研究所
王翔 华中科技大学人工智能与自动化学院
谭创创 北京交通大学计算机 科学与技术学院

相关机构

浙江大学脑机智能全国重点实验室
浙江大学人工智能学院
OPPO研究院
中国科学院自动化研究所
北京交通大学计算机科学与技术学院
0