Java使用IText生产PDF时,中文标点符号出现在行首的问题处理

Java使用IText生成PDF时,中文标点符号出现在行首的问题处理

使用itext 5进行html转成pdf时,标点符号出现在某一行的开头 但这种情况下显然不符合中文书写的规则,主要问题出在itext中的DefaultSplitCharacter类,该方法主要用来判断字符是否为可拆分字符。

itext 版本:5.5.13

解决办法:
1、可以通过修改源码的方式,可以参考
如何修改jar包源码以及解决iText生成pdf时中文标点存在行首问题

2、如果不想修改源码,也可以在自己项目中创建与itext中DefaultSplitCharacter相同的包路径,并在该包下重新DefaultSplitCharacter类,能这样处理的原因,与类的加载顺序有关。
在这里插入图片描述

package com.itextpdf.text.pdf;import com.itextpdf.text.SplitCharacter;public class DefaultSplitCharacter implements SplitCharacter {/*** An instance of the default SplitCharacter.*/public static final SplitCharacter DEFAULT = new DefaultSplitCharacter();// line of text cannot start or end with this characterstatic final char u2060 = '\u2060'; // - ZERO WIDTH NO BREAK SPACE// a line of text cannot start with any following characters in// NOT_BEGIN_CHARACTERS[]static final char u30fb = '\u30fb'; // ・ - KATAKANA MIDDLE DOTstatic final char u2022 = '\u2022'; // • - BLACK SMALL CIRCLE (BULLET)static final char uff65 = '\uff65'; // ・ - HALFWIDTH KATAKANA MIDDLE DOTstatic final char u300d = '\u300d'; // 」 - RIGHT CORNER BRACKETstatic final char uff09 = '\uff09'; // ) - FULLWIDTH RIGHT PARENTHESISstatic final char u0021 = '\u0021'; // ! - EXCLAMATION MARKstatic final char u0025 = '\u0025'; // % - PERCENT SIGNstatic final char u0029 = '\u0029'; // ) - RIGHT PARENTHESISstatic final char u002c = '\u002c'; // , - COMMAstatic final char u002e = '\u002e'; // . - FULL STOPstatic final char u003f = '\u003f'; // ? - QUESTION MARKstatic final char u005d = '\u005d'; // ] - RIGHT SQUARE BRACKETstatic final char u007d = '\u007d'; // } - RIGHT CURLYstatic final char uff61 = '\uff61'; // 。 - HALFWIDTH IDEOGRAPHIC FULL STOPstatic final char uff70 = '\uff70'; // ー - HALFWIDTH KATAKANA-HIRAGANA PROLONGED SOUND MARKstatic final char uff9e = '\uff9e'; // ゙ - HALFWIDTH KATAKANA VOICED SOUND MARKstatic final char uff9f = '\uff9f'; // ゚ - HALFWIDTH KATAKANA SEMI-VOICED SOUND MARKstatic final char u3001 = '\u3001'; // 、 - IDEOGRAPHIC COMMAstatic final char u3002 = '\u3002'; // 。 - IDEOGRAPHIC FULL STOPstatic final char uff0c = '\uff0c'; // , - FULLWIDTH COMMAstatic final char uff0e = '\uff0e'; // . - FULLWIDTH FULL STOPstatic final char uff1a = '\uff1a'; // : - FULLWIDTH COLONstatic final char uff1b = '\uff1b'; // ; - FULLWIDTH SEMICOLONstatic final char uff1f = '\uff1f'; // ? - FULLWIDTH QUESTION MARKstatic final char uff01 = '\uff01'; // ! - FULLWIDTH EXCLAMATION MARKstatic final char u309b = '\u309b'; // ゛ - KATAKANA-HIRAGANA VOICED SOUND MARKstatic final char u309c = '\u309c'; // ゜ - KATAKANA-HIRAGANA SEMI-VOICED SOUND MARKstatic final char u30fd = '\u30fd'; // ヽ - KATAKANA ITERATION MARKstatic final char u2019 = '\u2019'; // ’ - RIGHT SINGLE QUOTATION MARKstatic final char u201d = '\u201d'; // ” - RIGHT DOUBLE QUOTATION MARKstatic final char u3015 = '\u3015'; // 〕 - RIGHT TORTOISE SHELL BRACKETstatic final char uff3d = '\uff3d'; // ] - FULLWIDTH RIGHT SQUARE BRACKETstatic final char uff5d = '\uff5d'; // } - FULLWIDTH RIGHT CURLY BRACKETstatic final char u3009 = '\u3009'; // 〉 - RIGHT ANGLE BRACKETstatic final char u300b = '\u300b'; // 》 - RIGHT DOUBLE ANGLE BRACKETstatic final char u300f = '\u300f'; // 』 - RIGHT WHITE CORNER BRACKETstatic final char u3011 = '\u3011'; // 】 - RIGHT BLACK LENTICULAR BRACKETstatic final char u00b0 = '\u00b0'; // ° - DEGREE SIGNstatic final char u2032 = '\u2032'; // ′ - PRIMEstatic final char u2033 = '\u2033'; // ″ - DOUBLE PRIMEstatic final char[] NOT_BEGIN_CHARACTERS = new char[] { u30fb, u2022, uff65, u300d, uff09, u0021, u0025, u0029,u002c, u002e, u003f, u005d, u007d, uff61, uff70, uff9e, uff9f, u3001, u3002, uff0c, uff0e, uff1a, uff1b,uff1f, uff01, u309b, u309c, u30fd, u2019, u201d, u3015, uff3d, uff5d, u3009, u300b, u300f, u3011, u00b0,u2032, u2033, u2060 };// a line of text cannot end with any following characters in// NOT_ENDING_CHARACTERS[]static final char u0024 = '\u0024'; // $ - DOLLAR SIGNstatic final char u0028 = '\u0028'; // ( - LEFT PARENTHESISstatic final char u005b = '\u005b'; // [ - LEFT SQUARE BRACKETstatic final char u007b = '\u007b'; // { - LEFT CURLY BRACKETstatic final char u00a3 = '\u00a3'; // £ - POUND SIGNstatic final char u00a5 = '\u00a5'; // ¥ - YEN SIGNstatic final char u201c = '\u201c'; // “ - LEFT DOUBLE QUOTATION MARKstatic final char u2018 = '\u2018'; // ‘ - LEFT SINGLE QUOTATION MARKstatic final char u300a = '\u300a'; // 《 - LEFT DOUBLE ANGLE BRACKETstatic final char u3008 = '\u3008'; // 〈 - LEFT ANGLE BRACKETstatic final char u300c = '\u300c'; // 「 - LEFT CORNER BRACKETstatic final char u300e = '\u300e'; // 『 - LEFT WHITE CORNER BRACKETstatic final char u3010 = '\u3010'; // 【 - LEFT BLACK LENTICULAR BRACKETstatic final char u3014 = '\u3014'; // 〔 - LEFT TORTOISE SHELL BRACKETstatic final char uff62 = '\uff62'; // 「 - HALFWIDTH LEFT CORNER BRACKETstatic final char uff08 = '\uff08'; // ( - FULLWIDTH LEFT PARENTHESISstatic final char uff3b = '\uff3b'; // [ - FULLWIDTH LEFT SQUARE BRACKETstatic final char uff5b = '\uff5b'; // { - FULLWIDTH LEFT CURLY BRACKETstatic final char uffe5 = '\uffe5'; // ¥ - FULLWIDTH YEN SIGNstatic final char uff04 = '\uff04'; // $ - FULLWIDTH DOLLAR SIGNstatic final char[] NOT_ENDING_CHARACTERS = new char[] { u0024, u0028, u005b, u007b, u00a3, u00a5, u201c, u2018,u3008, u300a, u300c, u300e, u3010, u3014, uff62, uff08, uff3b, uff5b, uffe5, uff04, u2060 };@Overridepublic boolean isSplitCharacter(int start, int current, int end, char[] cc, PdfChunk[] ck) {// Note: If you don't add an try/catch and there is an issue with// isSplitCharacter(), iText silently fails and// you have no idea there was a problem.try {char c = getCharacter(current, cc, ck);int next = current + 1;if (next < cc.length) {char charNext = getCharacter(next, cc, ck);for (char not_begin_character : NOT_BEGIN_CHARACTERS) {if (charNext == not_begin_character) {return false;}}}for (char not_ending_character : NOT_ENDING_CHARACTERS) {if (c == not_ending_character) {return false;}}if (c <= ' ' || c == '-' || c == '\u2010') {return true;}if (c < 0x2002)return false;return ((c >= 0x2002 && c <= 0x200b)|| (c >= 0x2e80 && c < 0xd7a0)|| (c >= 0xf900 && c < 0xfb00)|| (c >= 0xfe30 && c < 0xfe50)|| (c >= 0xff61 && c < 0xffa0));} catch (Exception ex) {ex.printStackTrace();}return true;}/*** Returns a character int the array (Note: modified from the iText default* version with the addition null check of '|| ck[Math.min(position, ck.length -* 1)] == null'.** @param position position in the array* @param ck       chunk array* @param cc       the character array that has to be checked* @return the character*/protected char getCharacter(int position, char[] cc, PdfChunk[] ck) {if (ck == null || ck[Math.min(position, ck.length - 1)] == null) {return cc[position];}return (char) ck[Math.min(position, ck.length - 1)].getUnicodeEquivalent(cc[position]);}
}

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.hqwc.cn/news/339778.html

如若内容造成侵权/违法违规/事实不符,请联系编程知识网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

Windows下安装mariadb10.5数据库及配置详细教程

1、简介 MariaDB数据库管理系统是一款MySQL的替代数据库。MariaDB由MySQL的创始人麦克尔维德纽斯主导开发&#xff0c;是可扩展的&#xff0c;可靠的SQL服务器的合乎逻辑的选择&#xff0c;MariaDB 10.5 是 MariaDB 当前的稳定系列。 2、下载 下载地址&#xff1a;Download M…

Android SDK环境搭建[图解]; 解决问题Done. Nothing was installed.

安装SDK Android SDK环境搭建 依赖java环境,需要自备Java环境 (100%实操成功) 目录 1. 解压&#xff1a;解压到非中文无特殊字符的目录 2. 双击&#xff1a;SDK Manager.exe&#xff0c;不要选全部!不要选全部!不要选全部!(会下很久) 3. 然后勾选组件​ 4. 设置环境变量 …

MySQL加锁规则

项目编写涉及到数据持久化一般选择使用MySQL。由于时间原因&#xff0c;数据库使用我选择了无脑三板斧&#xff1a;1. 建立了索引加速查询、2. 关闭自动提交事务、3. 在需要确保原子性的数据库操作之间手动创建和提交事务。 这么一看&#xff0c;仿佛即使是实际开发也与你此前…

设置若依Token过期时间

方法一&#xff1a;设置永不过期&#xff0c;有安全隐患&#xff0c;不建议使用 redisCache.setCacheObject(userKey, loginUser); 方法二&#xff1a;修改application.yml

将 OpenCV 与 Eclipse 一起使用(插件 CDT)

先决条件 两种方式&#xff0c;一种是直接形成项目&#xff0c;另一种是 CMake 先决条件 在您的工作站中安装了 Eclipse&#xff08;只需要 C/C 的 CDT 插件&#xff09;。您可以按照以下步骤操作&#xff1a; 转到 Eclipse 站点下载面向 C/C 开发人员的 Eclipse IDE。根据您…

蓝桥杯省赛无忧 STL 课件11 pair

01 pair的定义和结构 在C中&#xff0c;pair是一个模板类&#xff0c;用于表示一对值的组合&#xff0c;它位于头文件中。 pair类的定义如下: template<class T1,class T2>struct pair{T1 first;//第一个值T2 second;//第二个值// 构造函数pair();pair(const T1& X…

模拟超市商品结算系统

要求:全程一个角色(管理员即用户) (1)需要管理员注册与登录 (2)管理员登录之后&#xff0c;可以进行上架新的商品(商品名称和单价) (3)管理员登录之后&#xff0c;也可以下架商品 (4)在节假日有优惠活动,可以对其中的一些商品修改相应的单价(价格提高和价格降低都可以) (5)用户…

如何充分发挥HubSpot CRM优势,优化销售流程?

在竞争激烈的商业环境中&#xff0c;销售流程的优化对企业至关重要。HubSpot CRM作为一款全面而强大的工具&#xff0c;为企业提供了实现销售优化的完美平台。让我们深入了解如何最大程度地利用HubSpot CRM&#xff0c;提高销售效率。 1.建立清晰的销售流程 HubSpot CRM的第一…

MySQL的三种存储引擎 InnoDB、MyISAM、Memory

InnoDB 1). 介绍 InnoDB是一种兼顾高可靠性和高性能的通用存储引擎&#xff0c;在 MySQL 5.5 之后&#xff0c;InnoDB是默认的MySQL 存储引擎。 2). 特点 DML操作遵循ACID模型&#xff0c;支持事务&#xff1b; 行级锁&#xff0c;提高并发访问性能&#xff1b; 支持外键F…

爱情视频相册怎么做?2.14情人节表白/活动视频模板PR剪辑素材

美好爱情故事&#xff0c;情人节表白视频相册怎么做&#xff1f;粉色浪漫的PR情人节表白/活动视频模板剪辑素材mogrt下载。 特征&#xff1a;可编辑文字和调整颜色&#xff0c;通过智能对象替换图像&#xff0c;RGB颜色模式&#xff0c;易于自定义&#xff0c;无需插件&#xf…

【深入浅出JVM原理及调优】「搭建理论知识框架」全方位带你认识和了解Java虚拟机的特性和本质

全方位带你认识和了解Java虚拟机的特性和本质 专栏介绍前提准备面向人群知识脉络背景介绍Java虚拟机定义抽象规范多种平台实现 JVM和JRE、JDK的关系JVM实例和JVM执行引擎实例JVM的基本结构类加载子系统Bootstrap ClassLoaderExtension ClassLoaderApp ClassLoaderCustom ClassL…

Linux第24步_安装windows下的VisualStudioCode软件

Windows下的VSCode安装后&#xff0c;还需要安装gcc编译器和g编译器。 gcc&#xff1a;编译C语言程序的编译器&#xff1b; g&#xff1a;编译C代码的编译器&#xff1b; 1、在Windows下安装VSCode&#xff1b; 双击“VSCodeUserSetup-x64-1.50.1.exe”,直到安装完成。 2、…