CCIG2023圆满落幕，合合信息智能图像处理技术破解文档处理行业性难题

近日，中国图象图形大会（CCIG 2023）（简称“大会”）在苏州圆满落幕。本届大会以“图象图形·向未来”为主题，由中国科学技术协会指导，中国图象图形学学会主办，苏州科技大学承办，特邀谭铁牛院士、赵沁平院士、吴一戎院士等百余位国内外知名学者，来自代表企业的技术专家，共话图像图形学术研究与技术创新趋势，共谋行业新发展。

（金连文主持《文档图像智能分析与处理》论坛）

技术论坛《文档图像智能分析与处理》是本次大会的亮点之一，由华南理工大学二级教授、中国图象图形学学会常务理事金连文担任主持，合合信息智能技术平台事业部副总经理、高级工程师丁凯博士出席该论坛，并与来自中科院自动化所、北大、中科大的学术专家，华为等知名企业的研究者们，围绕文档图像处理的前沿技术展开“头脑风暴”，寻找文档图像处理领域的未来进阶方向。

(资料图)

大模型技术提升文字识别效率，智能文档处理难题被突破

近期，ChatGPT的爆火让“大模型”技术进入了公众的视野。随着人工智能技术的飞速发展，作为图像图形技术的重要应用场景之一，文档图像智能处理逐步应用到医疗、教育等诸多领域，为各行各业提供更加高效、智能的文档管理和数据分析解决方案，大模型技术的崛起也为文档处理带来了新的机遇。

中国科学院自动化研究所副所长刘成林认为，大模型与光学字符识别（OCR）技术的结合，能够对海量数据进行理解、处理。具体到实践层面，大模型技术还有可观的提升空间。从识别性能来说，大模型技术在场景文本、逻辑版面、文档问答等方面还有很多工作可以做；此外，大模型的可解释性、安全度十分重要，还需要研究者们进行更为深入的探讨。

（刘成林就《人工智能大模型时代的文档识别与理解》研究课题进行分享）

北京大学邹月娴教授认为，在与文档图像处理技术密切相关的OCR领域中，专业化大规模的预训练模型是可行的。“大模型是一个大的趋势，对于小团队来说做工具是一个非常好的方法，做工具对大家都是有好处的。”邹月娴说。

（邹月娴就《视觉-语言预训练模型及迁移学习方法》研究课题进行分享）

华为AI研究员廖明辉提到，企业作为文档图像处理的应用方，普遍面临一个挑战：当有众多API时，维护难度较高，急需一个垂直领域的通用的OCR大模型，能够覆盖所有的使用场景。廖明辉认为，OCR垂直领域的大模型在数据量方面，数据的数量不是最关键的，最关键的是数据的多样性。

除了引入大模型等新技术外，如何实现文档图像的智能分析与处理还面临着诸多来自现实的挑战。丁凯博士认为，文档的多样性和复杂性是文档图像处理中的难点：文档类型和格式繁多，包括报告、合同、发票、证明、证件等。不同类型的文档有不同的格式和布局，例如文档中常常包含图片、表格、图形等各种图像，难以用统一的方法处理。

（丁凯就《智能文档处理技术在工业界的应用与挑战》研究课题进行分享）

丁凯提到，文档图像中的弯曲、阴影、摩尔纹，字迹不清晰等问题对文档图像的识别与处理产生了影响，刘成林也表示，“过去我们只关注文字，现在文档中的图像也十分重要。但是，现有文档图像识别技术在识别精度和可靠性、可解释性、自适应性等方面还有明显不足，还有很多技术问题有待解决。”

值得关注的是，人工智能大模型的快速发展为文档分析与识别带来了一些机遇，除了解决识别层次的遗留问题，在性能提升、应用拓展上大有可为。合合信息通过ROI提取、干扰去除、形变矫正、图像恢复以及图像增强这一整体架构对文档进行智能扫描与识别分析，将文档图像的弯曲矫正、摩尔纹去除，图像质量大幅提升。

除文档图像的通用场景外，合合信息对特定垂直场景下的图像也能进行预处理，针对手写板图片中出现的反光问题，通过算法模型对反光进行“擦除”。

由于版面复杂多变、文本内容多样化等原因，文档被拍照、扫描成电子文档过程中时常出现漏字、错位，合合信息持续突破版面分析技术在版面分割、区域间的逻辑关系处理等方面的难题，通过智能文字识别、智能图像处理等核心技术，确定文档中的文字位置、字体、大小和排版方式等信息，实现版面的分析和还原。

文档篡改检测技术为视觉内容安全提供保障

目前，人工智能的合成技术导致伪造的多媒体信息在网络上泛滥成灾，文本图像显然是重灾区之一。针对资质证书、文案、聊天截图等文本图像的伪造被用于散播谣言、经济诈骗、编造虚假新闻，给个人、社会造成恶劣的负面影响。图像内容安全是AI安全的重点领域，如可对文本篡改痕迹进行精准检测，将为图像内容安全提供保障。

中科大教授谢洪涛指出，随着基于深度学习的伪造与取证技术的出现，目前文本图像的真伪鉴定问题进入了攻防博弈阶段。“文本图像的篡改生成视觉质量高、字体风格统一、背景纹理协调、篡改字迹清晰，文本图像的篡改检测可以说是‘道高一尺、魔高一丈’，适应多种篡改方法、多域空间感知、区域文理区分、时间复杂度适中。”谢洪涛表示。

（谢洪涛就《篡改文本图像的生成与检测》研究课题进行分享）

谢洪涛所在的课题组正在探索基于文本笔迹的文本图像生成，以及基于频域关系的局部纹理差异性建模，最终实现高质量的场景文本图像篡改生成、准确的场景文本图像篡改检测。相关研究可应用于文本图像的多个领域，例如文档图像、自然场景图像、票据图像等。

合合信息在文档图像内容安全领域也进行了深入的部署。据丁凯介绍，合合信息研发了基于深度学习的图像篡改检测技术及相关系统，通过学习图像被篡改后统计特征的变化，该系统智能捕捉图像在篡改过程中留下的细微痕迹，可检测出复制粘贴、拼接、擦除等多种篡改形式，让人工智能准确识别出图片篡改的不同类型，并进行针对性的处理，提升识别精度和场景通用性。据悉，合合信息图像篡改检测技术已被银行、保险、制造业等多个行业引入。

作为一家人工智能企业，合合信息依托智能文档处理技术，对复杂场景下的多版式、多语种文字内容进行精准提取，打造的合同机器人、财报机器人及行业解决方案，已在金融、政务、制造、物流等30个行业落地，服务的世界500强公司超过80家。未来，合合信息将持续为全球C端用户和多元行业B端客户提供数字化、智能化的产品及服务，促进AI技术在文档处理领域的应用落地与信息安全保障。

CCIG2023圆满落幕，合合信息智能图像处理技术破解文档处理行业性难题

国家金融监督管理总局揭牌|环球短讯

Haynes：泰伦-卢的经纪人本周和快船进行了会面 讨论了卢的未来-当前讯息

隋唐演义李元霸介绍_隋唐演义李元霸介绍简述 天天资讯

共建共治解民忧，宝山这个居民区的水箱大变身

美纳斯mega进化图鉴_美纳斯mega进化

福立旺（688678）5月17日主力资金净买入115.48万元

你看微信视频号么？腾讯：粉丝破万创作者是去年三倍_世界今热点

欧冠决赛对阵出炉：曼城完胜皇马晋级，PK国米冲击队史首冠

小米又搞事，这限定款新机要卖爆？-天天热消息

中国铁建（01186.HK）：5月17日南向资金减持880.1万股

江阴人社局胡伟_江阴人社

詹姆斯夹胳膊一幕曝光：约基奇险受伤复制乐福悲剧 他成湖人眼中钉_环球头条

焦点观察：微软总裁：欧盟云协议全球使用 竞争对手自动获得授权

陌生男子凌晨闯白宫国安顾问住宅，特勤探员守门懵然不知

5月17日广发医疗保健股票C净值下跌1.11%

【全球新视野】佛教说的三宝是哪三宝_佛教中的三宝是哪三宝

全球热议:巴厘岛命案背后真相令人毛骨悚然!

河南机电职业学院校园图片卡_前沿资讯

美国债务上限僵局有望化解，双方会做出哪些妥协？-世界速看料

全球快资讯：詹姆斯：浓眉今年季后赛一直发挥出色 我们要给他提供帮助

泰国举办传统春耕节仪式 当前热文

【新视野】日经225指数收于3万点之上 为2021年9月来首次

全球快讯:北巴传媒（600386）5月17日13点57分触及跌停板

让自动体外除颤仪成为学校标配

不用为阿什拉夫担心️巴黎昨日无训练安排&上轮未输球不用加练

交了诉讼费是不是就代表立案了-环球视点

知情人称年租金284万西湖商亭不贵 68次竞价溢价近50%_当前信息

环球播报:水砂纸怎么用_水砂纸

全能新品猎杀行业痛点 石头科技刷新洗地行业新标准|当前热文

Shopify升级资产URL 环球微资讯

报喜鸟(002154)：公司及下属子公司实际发生担保余额为2.24亿元 全球视点

博努奇宣布：我将踢到2024年6月，下赛季结束后退役

东方盛虹：5月16日融券卖出金额6.18万元，占当日流出金额的0.05%

赛微电子：相关工作正在努力推动中，公司将严格按照相关法律法规的规定履行信息披露义务 全球快报

债务上限对美债意味着什么？部分美债收益率可能冲到10%

美银客户四周来首次抛美股，机构、对冲基金、散户全在抛，医疗保健成避风港

全球速递！luvias_luv

世界观热点：偏债型基金债券配置比例_偏债基金是什么意思

美媒：枪支暴力是公共卫生紧急事件 但美国阻碍实施应对措施

分析师：加拿大通胀存在上行风险； 世界热点评

【环球报资讯】辽宁两名年轻女子进成人用品店砸售卖机，盗走商品得手后大笑离去

今日看点：掌趣科技：公司正在尝试将AIGC相关技术接入游戏产品

不愧安卓“亲儿子”：谷歌迅速修复Pixel系列耗电Bug|全球即时

即时看！清远多部门联合举办“反洗钱知识进校园”宣教活动

今日聚焦!太康县属于哪个市县_太康县属于哪个市

环球速递！陕西省2023年4月自学考试成绩查询入口已开通

图文世界帮帮阿强通关攻略分享 天天通讯

国债期货各主力合约涨跌不一 -环球今日报

迁安：芍药花开_全球看点

每日观点：主场2-0击败梅州客家，青岛海牛终结三连败迎来赛季第二场胜利

文人笔下的浪漫情话，哪句戳到了你？|今日精选

骑游北京，边骑边逛！21条北京文旅骑游线路发布 热闻

360与智谱AI达成战略合作，已形成“自研+合作”的大模型布局

中泰证券：给予华电重工增持评级

晋中市首届“5.15政务公开日”-当前速读

全球头条：周二分析：防流感概念股报跌，中牧股份跌4.3%

消费者权益保护状况年度报告发布 “一老一小”消费权益保障取得新成绩 环球观焦点

新西兰惠灵顿旅馆火灾事故死亡人数升至10人|每日头条

澳洲联储将公布政策会议 很可能保持政策利率不变

焦点热门:基层监督执纪多了一双“眼睛”

融捷股份：5月15日获融资买入1945.50万元，占当日流入资金比例6.19% 天天动态

蚂蚁链与汇电云联、一村资本三方合作 共同提升储能产业链协作效率

世界微资讯！制度创新成果294项 新增企业超10万家 湖北自贸区变“营商”为“赢商”

险企陆续下架预定利率3.5%产品 分红险或是未来主流|全球聚看点

jason是什么意思_jason aldean-全球热点评

19省市援疆干部人才满怀激情、铆足干劲——携手建设美好新疆|当前通讯

三箭齐发 首批央企股东回报ETF产品开售-世界微速讯

无营业执照经营怎么处罚依据_无营业执照经营该怎么处罚 最新

全球速看：小孩脸上长白斑是蛔虫病还是蛲虫病_小孩脸上长白斑

环球实时：深圳地铁罗宝线正常运行了吗_深圳地铁罗宝线

外媒：美两党对攻，操起了这把“危险武器”_天天即时看

微观察｜“大上海”如何改造“老破小”，提升市民居住质量？

林肯Z对沃尔沃S60的较量，豪华与豪华的对决

石家庄鹿泉区税务局：纳税服务做加法 企业发展做乘法|世界头条

头条焦点：都快 3.5 吨了！仰望 U8 更多信息曝光 5 块大屏 / 可拖房车？

央行发布2023年第一季度中国货币政策执行报告

全球关注：重要消息 A股再迎两大利好！

【当前独家】蓝莓一次吃半盒还是一盒好 蓝莓一次吃一盒还是两盒好

刘丹聊孙女小糯米笑容满面 刘丹母亲节拒谈杨幂_世界观热点

Haynes：泰伦-卢的经纪人本周和快船进行了会面讨论了卢的未来-当前讯息

隋唐演义李元霸介绍_隋唐演义李元霸介绍简述天天资讯

詹姆斯夹胳膊一幕曝光：约基奇险受伤复制乐福悲剧他成湖人眼中钉_环球头条

焦点观察：微软总裁：欧盟云协议全球使用竞争对手自动获得授权

全球快资讯：詹姆斯：浓眉今年季后赛一直发挥出色我们要给他提供帮助

泰国举办传统春耕节仪式当前热文

【新视野】日经225指数收于3万点之上为2021年9月来首次

全能新品猎杀行业痛点石头科技刷新洗地行业新标准|当前热文

报喜鸟(002154)：公司及下属子公司实际发生担保余额为2.24亿元全球视点

赛微电子：相关工作正在努力推动中，公司将严格按照相关法律法规的规定履行信息披露义务全球快报

美媒：枪支暴力是公共卫生紧急事件但美国阻碍实施应对措施

分析师：加拿大通胀存在上行风险；世界热点评

图文世界帮帮阿强通关攻略分享天天通讯

骑游北京，边骑边逛！21条北京文旅骑游线路发布热闻

消费者权益保护状况年度报告发布 “一老一小”消费权益保障取得新成绩环球观焦点

澳洲联储将公布政策会议很可能保持政策利率不变

蚂蚁链与汇电云联、一村资本三方合作共同提升储能产业链协作效率

世界微资讯！制度创新成果294项新增企业超10万家湖北自贸区变“营商”为“赢商”

险企陆续下架预定利率3.5%产品分红险或是未来主流|全球聚看点

三箭齐发首批央企股东回报ETF产品开售-世界微速讯

无营业执照经营怎么处罚依据_无营业执照经营该怎么处罚最新

石家庄鹿泉区税务局：纳税服务做加法企业发展做乘法|世界头条

【当前独家】蓝莓一次吃半盒还是一盒好蓝莓一次吃一盒还是两盒好

刘丹聊孙女小糯米笑容满面刘丹母亲节拒谈杨幂_世界观热点

中小企业有哪些公司适合写内部控制的论文中小企业有哪些公司

孟州：打造政务服务新模式实现“小事不出村大事不出镇”

目标“破10”！短跑小将陈冠锋冲击巴黎奥运会

阿里P9下岗再就业天天最新

多家银行今起正式调整两类存款利率有银行下调幅度达55个基点