AI 技术让古籍数字化回归:AI识别20万页古籍 准确率达97.5%( 二 )


阿里巴巴达摩院院长张建锋表示,守护中华传世典籍,是科技工作者和文化工作者共同的使命 。阿里计划将这套技术工具连同古籍数字化平台一并捐赠,交由权威公共机构长期运营,同时,阿里仍将在古籍数字化工作上持续投入人力物力 。
目前,在该系统基础上,达摩院研发搭建了集古籍数字化交互式训练、古籍全文内容检索、古籍汉字字典三大功能于一体的汉典重光古籍数字化平台 。随着今后数字化规模的扩增,系统的识别准确率和识别效率还将不断提升 。
据徐盈辉透露,未来,该平台将尝试拓展数据数量、进行更加详细的数据挖掘、分析,提高识别准确率 。达摩院希望能够实现古籍全文检索的能力:只要在平台输入命名实体,比如一个人名、地名,就可以知道这个人名曾经出现过哪些典籍里面 。

推荐阅读