·设为首页收藏本站📧邮箱修改🎁免费下载专区🔐设置/修改密码👽群雄群聊
返回列表 发布新帖

利用正则表达式进行中文排版的实例教程

马上注册,免费下载更多dz插件网资源。

您需要 登录 才可以下载或查看,没有账号?立即注册

×
前言

中文排版是字处理的一个基本功能,目前有些文字排版软件,例如“排版助手”等等,可以完成一些通用的中文排版功能,但是对于一些复杂的个性化排版功能就无法实现,实际上,我们通过在一些常用的支持正则的代码编辑软件里,使用正则表达式,就可以完成很多复杂的排版功能,下面将举一些常用的例子。
代码编辑软件可使用Notepad++或Editplus,两者的正则表达式对于换行有一点点差别,一个用\r\n,另一个用\n。下面以Editplus为例,讲述一下操作方法,先用Editplus打开一个中文文件,然后点“替换”,点击“使用正则表达式”,然后在“查找项”和“替换项”里输入以下字符串,即可实现特定的排版功能。
此外,在“替换”界面中点“常用项”,可以把经常使用的规则保存为功能列表,这样,使用某个功能的时候,直接调用即可获取相关代码。
利用正则表达式进行中文排版的实例教程 利用,正则表达式,表达,表达式,进行
〇、常见匹配类

匹配中文字符的正则表达式:[\u4e00-\u9fa5]
匹配双字节字符(包括汉字在内):[^\x00-\xff]
匹配特殊字符 :((?=[\x21-\x7e]+)[^A-Za-z0-9])
匹配所有的半角空白字符:[ \f\r\t\n]
匹配隐藏字符:[\u0000-\u001F]

一、段落排版类

1、非段落换行排版(要求段落之间空一行)

查找项:([^\n])\n
替换项:\1

2、插入空行

查找项:\n
替换项:\n\n

3、删除空行

查找项:^\s*\n
替换项:空

4、行首批量添加(替换项为2个空格时可实现首行缩进)

查找项:^
替换项:我是行首aaa

5、行尾批量添加

查找项:\n
替换项:bbb我是行尾\n

6、半角引号替换为全角引号

查找项:\"([^\"\']*)\"
替换项:“\1”

7、半角单引号替换全角

查找项:\'([^\"\']*)\'
替换项:‘\1’

8、固定宽度加硬回车(下例为宽度50)

查找项:(.{1,50})
替换项:\1\n

二、删除特定字符串类

1、删除行前空格

查找项:^[ \s]*
替换项:空

2、删除行尾空格

查找项:[ \s]*$
替换项:空

3、删除包含指定关键字的行

查找项:^.*(指定关键字).*$
替换项:空

4、删除以指定关键字开头的行

查找项:^(指定关键字)[^\n]+\n
替换项:空

5、删除HTML注释

查找项:<!--(.*?)-->
替换项:空

6、删除HTML标签

查找项:<[^>]+>
替换项:空

7、删除HTML标签内的全部

查找项:<(.*)>.*<\/\1>|<(.*) \/>
替换项:空

三、中文汉字处理类

1、中文和英文之间加空格

查找项:([\u4e00-\u9fa5]+)([A-Za-z]+)
替换项:\1 \2

2、英文和中文之间加空格

查找项:([A-Za-z]+)([\u4e00-\u9fa5]+)
替换项:\1 \2

3、中文和数字之间加空格

查找项:([\u4e00-\u9fa5]+)([0-9]+)
替换项:\1 \2

4、数字和中文之间加空格

查找项:([0-9]+)([\u4e00-\u9fa5]+)
替换项:\1 \2

5、上述替换整合

查找项:([\u4e00-\u9fa5]+)([A-Za-z]+)|([A-Za-z]+)([\u4e00-\u9fa5]+)|([0-9]+)([\u4e00-\u9fa5]+)|([\u4e00-\u9fa5]+)([0-9]+)

6、删除硬回车

查找项:([0-9]+)([\u4e00-\u9fa5]+)
替换项:\1 \2

四、章节处理类

1、序号变为章节

查找项:\n([\u4e00-\u9fa5]{1,2})\n
替换项:\n第\1章\n

2、章节之间加换行

查找项:第(.*)章
替换项:\n第\1章

3、章节样式替换

查找项:<p>(第.{1,5}章.*)</p>
替换项:<h1>\1</h1>

五、巧妙利用正则表达式排版

中文和英文之间加空格
  1. ([\u4e00-\u9fa5]+)([A-Za-z]+)
复制代码
然后使用
  1. $1 $2
复制代码
中文和数字之间加空格
  1. ([0-9]+)([\u4e00-\u9fa5]+)
复制代码
然后使用
  1. $1 $2
复制代码
一下替换
  1. ([\u4e00-\u9fa5]+)([A-Za-z]+)|([A-Za-z]+)([\u4e00-\u9fa5]+)|([0-9]+)([\u4e00-\u9fa5]+)|([\u4e00-\u9fa5]+)([0-9]+)
复制代码
源文地址:https://www.jb51.net/article/237547.htm
我要说一句 收起回复

回复

 懒得打字嘛,点击右侧快捷回复【查看最新发布】   【应用商城享更多资源】
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

投诉/建议联系

discuzaddons@vip.qq.com

未经授权禁止转载,复制和建立镜像,
如有违反,按照公告处理!!!
  • 联系QQ客服
  • 添加微信客服

联系DZ插件网微信客服|最近更新|Archiver|手机版|小黑屋|DZ插件网! ( 鄂ICP备20010621号-1 )|网站地图

您的IP:18.189.170.17,182.84.110.70,GMT+8, 2024-4-30 11:25 , Processed in 0.291218 second(s), 68 queries , Gzip On, Redis On.

Based on Discuz! W1.0 Licensed

© 2001-2024 Discuz! Team.

关灯 在本版发帖
扫一扫添加微信客服
QQ客服返回顶部
快速回复 返回顶部 返回列表