加入收藏 | 设为首页 | 会员中心 | 我要投稿 李大同 (https://www.lidatong.com.cn/)- 科技、建站、经验、云计算、5G、大数据,站长网!
当前位置: 首页 > 大数据 > 正文

perl – 如何判断特定字体是否包含PDF :: API2中的特定字符

发布时间:2020-12-16 06:12:55 所属栏目:大数据 来源:网络整理
导读:我在我的Perl应用程序中使用PDF :: API2来嵌入OCR 在相应图像后面输出,允许搜索生成的PDF作为OCR 可以使用pdftotext提取输出. 此时,只要应用程序看到非ASCII字符 在OCR输出中,它从PDF核心字体切换到TTF.但是,这个 真的很酷,因为核心字体包括大多数西欧 字符.
我在我的Perl应用程序中使用PDF :: API2来嵌入OCR
在相应图像后面输出,允许搜索生成的PDF作为OCR
可以使用pdftotext提取输出.

此时,只要应用程序看到非ASCII字符
在OCR输出中,它从PDF核心字体切换到TTF.但是,这个
真的很酷,因为核心字体包括大多数西欧
字符. TTF仅适用于希腊语,俄语,日语,
等等

如何判断特定字体是否包含特定字体
字符(包括CMAP表,以便提取
pdftotext工作)?

解决方法

您是否尝试过字形特定的方法?

http://search.cpan.org/dist/PDF-API2/lib/PDF/API2/Resource/BaseFont.pm#GLYPH_RELATED_METHODS

如果不这样做,也许渲染字形(到一个单独的文档)并测量它?

(编辑:李大同)

【声明】本站内容均来自网络,其相关言论仅代表作者个人观点,不代表本站立场。若无意侵犯到您的权利,请及时与联系站长删除相关内容!

    推荐文章
      热点阅读