腾讯云OCR评测研究报告获AIIA批准并正式立项
2020-01-17 12:47:45AI云资讯768
1月13日,中国人工智能产业发展联盟2019年第四次全体大会在北京召开,会上,腾讯云AI视觉团队组织撰写的《OCR产业应用及评测需求研究报告》获得与会专家的认可,并顺利通过立项。该报告是腾讯公司联合中国信息通信研究院、中国人工智能产业发展联盟共同成立的“智能产品安全与评测联合实验室”的首个研究成果。

OCR(Optical Charater Recongnition)全称“光学字符识别”,即利用光学技术和计算机技术将印制或书写与纸张上的文字读取出来,并转换成计算机可读取、人可以理解的格式。作为实现文字高速录入的关键技术,OCR目前已广泛应用于政府、金融、交通、教育、泛互联网等多个领域。然而,不同应用场景中OCR数据类型差异化很大,每个应用场景都对OCR引擎有不同的要求。例如,金融和交通领域的OCR数据多是结构化的卡证类数据,如身份证、银行卡、驾驶证等,而卡证数据简单、场景安全性要求高,因此对OCR引擎的识别准确率要求会比较高;在教育、泛互联网领域中,多为算式、表格、广告图片、游戏图片等非结构化数据,对OCR引擎的识别准确率要求会相对较低。
目前,业界尚未有统一的、标准化的OCR引擎评测方法,导致OCR应用市场鱼龙混杂,阻碍了OCR技术在不同领域的良性发展。
基于腾讯优图提供的腾讯云OCR文字识别技术,以及在多个行业里的AI应用实践经验,腾讯云AI视觉团队启动了《OCR产业应用及评测需求研究报告》(以下简称“研究报告”)的编纂工作,分析OCR在应用中的评测场景、样本分类及评测的关键指标。

按照不同的应用场景,《研究报告》将OCR引擎划分为“卡证类文字识别”、“票据单据识别”、“汽车相关识别”、“行业文档识别”和“通用文字识别”,基本覆盖主流的OCR应用场景。针对不同的OCR引擎,《研究报告》也建立了不同的标准评测样本集。
对于评测的关键指标,《研究报告》将其划分为“效果指标”和“性能指标”两类。例如,针对身份证、行驶证等字段准确率要求高的场景,主要看字段级的效果指标,针对通用文字、行业文档等场景,主要看字符级的效果指标。

与会专家认为,基于OCR应用领域的广泛性,无法用单一的标准和评测样本集来衡量OCR在不同领域的表现,因此,分场景建立权威的评测标准,将有助于更快速地推进OCR技术的产业化落地。
相关文章
- 腾讯云助力炫佳科技全新升级一站式AI短剧平台 平均制作效率提升90%
- 生态共赢 赞同科技携手腾讯云斩获三项大奖
- 腾讯云 WeData 升级三大 Data+AI 能力,位居一体化数据智能平台市场第一!
- 腾讯云智能体开发平台升级:做深平台、做厚内容、做强应用,构筑Agent产业合作新生态
- 腾讯云发布 AI 数据湖解决方案,支持 CPU和GPU 混合调度
- 智效跃迁,架构无界,第三届腾讯云架构师峰会圆满落幕!
- 腾讯云ADP国内首发AI原生Widget:一句话秒级生成交互组件,重塑Agent使用体验
- 四川具身科技新品发布,腾讯云全栈AI能力助力提升机器人情感交互能力
- 腾讯云Valkey社区贡献位居全球第一,率先在国内支持8.0版本
- 中国唯一入选!IDC报告:腾讯云斩获亚太前台对话式AI“领导者”评级
- 探讨AI赋能企业转型出海新路径!“腾讯云 TVP 思享会 大湾区数字化转型高管沙龙·香港站”成功举办
- 中国太原煤炭交易中心与腾讯云深化合作 共建煤炭价格指数大模型
- 与AI共生,腾讯云携手行业专家共话数智驱动新质生长
- Gartner®首次发布中国DLP市场指南,腾讯云零信任iOA入选代表厂商
- 腾讯云姚一兆:用全栈AI助力具身智能赛道加速发展
- 腾讯云领跑亚太反欺诈领域,获评Forrester Wave™“领导者”
人工智能企业
更多>>人工智能硬件
更多>>人工智能产业
更多>>人工智能技术
更多>>- 云知声Unisound U1-OCR大模型发布!首个工业级文档智能基础大模型,开启OCR 3.0时代
- 基石智算上线 MiniMax M2.5,超强编程与智能体工具调用能力
- 昇腾原生支持,科学多模态大模型Intern-S1-Pro正式发布并开源
- 百度千帆深度研究Agent登顶权威评测榜单DeepResearch Bench
- 在MoltBot/ClawdBot,火山方舟模型服务助力开发者畅享模型自由
- 教程 | OpenCode调用基石智算大模型,AI 编程效率翻倍
- 全国首个!上海上线规划资源AI大模型,商汤大装置让城市治理“更聪明”
- 昇思人工智能框架峰会 | 昇思MindSpore MoE模型性能优化方案,提升训练性能15%+









