腾讯OCR团队斩获ICDAR大赛四项冠军

sxkk20081年前AI生活110
腾讯OCR团队斩获ICDAR大赛四项冠军

在全球文字识别(OCR)领域顶级盛会ICDAR 2023上,腾讯OCR团队基于自研算法,斩获四项冠军,这是继2017年、2019年、2021年以来,连续四届参会同时创造佳绩,共获得18项官方认证冠军,展示了腾讯OCR技术在全球的一流水平。

ICDAR大会是全球文档图像分析识别领域公认的权威学术会议,每两年举办一次,赛事举办至今已经吸引了超过100多个国家的近8000支队伍参与其中。ICDAR竞赛因其极高的技术难度和强大的实用性享誉国内外,与赛后非正式刷榜不同,ICDAR官方认证的正式竞赛采用全新的数据集,并且在比赛期间不公布参赛团队的信息和成绩,同时限制了结果提交时间和次数,属于高难度的“盲打”。

今年,腾讯OCR参赛团队是由腾讯数据平台部、微信技术架构部联合组成,重点参加了DSText(稠密小文本视频文本识别)和SVRD(结构化信息抽取)两大项目的比赛,取得4项赛道冠军。

DSText赛道,腾讯包揽全部两项冠军

DSText(稠密小文本视频文本识别)竞赛设置了2个任务:视频文本跟踪、视频文本端到端识别。由于文字非常密集且非常小,再加上环境干扰(相机抖动、运动模糊、光照变化等)与后期编辑(多镜头切屏、人工背景、游戏界面切换等),从视频帧中准确检测、跟踪、识别文本对算法鲁棒性要求很高,挑战性极大。部分比赛视频帧展示如下:

腾讯OCR团队斩获ICDAR大赛四项冠军

ICDAR-DSText竞赛示意帧

在DSText竞赛的全部2个任务中,腾讯OCR团队均以绝对领先的优势获得冠军。

其中,任务1中,旨在跟踪视频中所有文本流,将视频帧间属于同一个文本实例的检测框聚合起来,评价指标是MOTA,腾讯以领先第二名12.04%的成绩取得冠军。

腾讯OCR团队斩获ICDAR大赛四项冠军

视频文本跟踪:冠军证书

在任务2中,旨在评估视频文本识别的端到端性能,任务要求在每一帧上正确检测文本,在视频帧上正确跟踪,并在序列级别正确识别,评价指标是OCR-MOTA,腾讯以领先第二名11.93%的成绩取得冠军。

腾讯OCR团队斩获ICDAR大赛四项冠军

视频文本端到端识别:冠军证书

SVRD赛道,腾讯以绝对优势获得两项冠军

SVRD(结构化信息抽取)竞赛包含HUST-CELL和BAIDU-FEST两大赛道共4个任务: 复杂文档实体关系提取(E2E Complex Entity Linking)、复杂文档实体语义提取(E2E Complex Entity Labeling)、零样本结构化信息抽取(E2E Zero-shot Structured Text Extraction)和小样本结构化信息提取(Few-shot Structured Text Extraction)。由于文档图像版式复杂、结构多样,自然场景图像采集不规范、存在背景复杂、折损、弯曲、形变等问题,竞赛存在较大的挑战难度。部分比赛图片展示如下:

腾讯OCR团队斩获ICDAR大赛四项冠军

ICDAR-SVRD结构化信息抽取大赛样例

在SVRD竞赛中腾讯OCR团队共获得了2个冠军。

其中,任务2 (E2E Complex Entity Labeling)旨在提取复杂文档图像上的语义实体,如标题、机构名、日期、金额、数字、商品名、人名等,腾讯在这个任务上以较大优势取得了冠军。

腾讯OCR团队斩获ICDAR大赛四项冠军

E2E Complex Entity Labeling:冠军证书

 

任务4 (E2E Few-shot Structured Text Extraction)赛题需要在提供非常少量训练数据的前提下,提取10个不同场景下的图像的关键信息,如银行卡、营业执照、出租车发票、购物小票、交通发票、定额发票、论文等场景下的关键信息,腾讯同样取得了冠军。

腾讯OCR团队斩获ICDAR大赛四项冠军

E2E Few-shot Structured Text Extraction:冠军证书

据介绍,腾讯OCR团队是腾讯内部致力于研究和开发OCR技术的专业团队,团队在技术上自主研发了高精准度、高稳定性的文本检测和识别技术,在应用上,支持了腾讯内数百个业务场景,如腾讯广告、微信、QQ、腾讯云、腾讯视频、腾讯信息流产品。

本站部分文章来自互联网,文章版权归原作者所有。如有疑问请联系QQ:1187056308!

相关文章

造车新势力尴尬的「出海成绩单」:小鹏月销1辆,蔚来两个月57辆

造车新势力尴尬的「出海成绩单」:小鹏月销1辆,蔚来两个月57辆

  新势力出海,小鹏在2023年1月只卖了一辆车。在欧洲四国瑞典、丹麦、荷兰、德国采取了订阅模式的蔚来,1月和2月的注册量分别为17辆和40...

猿辅导“青少年科学探索基金”正式成立 助力拔尖人才培养

猿辅导“青少年科学探索基金”正式成立 助力拔尖人才培养

新一代工业革命正在席卷全球。伴随我国进入高质量发展轨道,科学、人才、教育三位一体融合发展已经刻不容缓。我国基础学科人才紧缺成了不争的事实。值...

共话AI机遇与挑战,摩尔线程CEO张建中出席之江圆桌会

共话AI机遇与挑战,摩尔线程CEO张建中出席之江圆桌会

5月9日,由之江实验室发起,浙江省之江发展基金会和杭州市人工智能产业联盟联合承办的“之江圆桌会”在杭州成功举办。本期主题围绕“人工智能的竞争-...

ET5T对标Model Y、再获11亿美元投资:蔚来“长期主义”的底气

ET5T对标Model Y、再获11亿美元投资:蔚来“长期主义”的底气

如果说全系降价3万是李斌的“阳谋”,那么蔚来ET5T的发布,则是李斌的又一次诚意之作。 ET5T是蔚来首款售价下探到30万元以下的新车,作为...

软银2021巨亏900亿;中消协报告,腾讯取消优惠无异于强制涨价;联想员工内外勾结侵占1000万!

巨亏900亿,软银报告史上最大规模亏损 5月12日下午,孙正义在日本东京公布了软银集团最新财报:截至3月31日,软银集团2021财年净亏损为1...

10支战队云栖巅峰对决,阿里云首届数据洞察创新挑战赛完美收官

10支战队云栖巅峰对决,阿里云首届数据洞察创新挑战赛完美收官

2023年11月2日,是为期三天的云栖大会的最后一天。但对于开发者谭耀华来说,则是他和他的战队一举夺得了智能运维赛一等奖和智能创作赛二等奖的...

发表评论    

◎欢迎参与讨论,请在这里发表您的看法、交流您的观点。