700字范文,内容丰富有趣,生活中的好帮手!
700字范文 > java使用正则表达式过滤html标签

java使用正则表达式过滤html标签

时间:2019-03-14 18:33:04

相关推荐

java使用正则表达式过滤html标签

Java|java教程

java 过滤 html标签

Java-java教程

前段时间开发的时候要读取一篇文章的简介内容(也就是前200个字符),使用了隐藏字段,可能有人就要问了,那后台也是可以截取字符的啊,那是因为编辑器里面包含了html标签,所以后台就需要处理html标签的正则表达式,前些天上网搜了下,发现有人写好的一个类,给大家共享下

图片分类标记app源码,怎么登录Ubuntu系统,tomcat解压后启动不,爬虫音乐软件,php网页方框怎么设计,seo岗位名称lzw

import java.util.regex.Matcher; import java.util.regex.Pattern; /** *

* Title: HTML相关的正则表达式工具类 *

订单录入源码,ubuntu20.04全屏,个人征信爬虫,随机选择php,长沙seo营销lzw

*

* Description: 包括过滤HTML标记,转换HTML标记,替换特定HTML标记 *

qfzq源码,vscode项目怎么启动,ubuntu ss优化,tomcat配置jmx监控,爬虫隐藏元素,个人博客php模板,巴南区seo优化诚信经营,企业门户网站 源码下载,vs html5模板lzw

*

* Copyright: Copyright (c) *

* * @author hejian * @version 1.0 * @createtime -10-16 */ public class HtmlRegexpUtil { private final static String regxpForHtml = "]*)>"; // 过滤所有以结尾的标签 private final static String regxpForImgTag = "]*)\\s*>"; // 找出IMG标签 private final static String regxpForImaTagSrcAttrib = "src=\"([^\"]+)\""; // 找出IMG标签的SRC属性 /** * */ public HtmlRegexpUtil() { // TODO Auto-generated constructor stub } /** * * 基本功能:替换标记以正常显示 *

* * @param input * @return String */ public String replaceTag(String input) { if (!hasSpecialChars(input)) { return input; } StringBuffer filtered = new StringBuffer(input.length()); char c; for (int i = 0; i <= input.length() - 1; i++) { c = input.charAt(i); switch (c) { case <:filtered.append(":filtered.append(">");break; case \":filtered.append(""");break; case &:filtered.append("&");break; default:filtered.append(c); }} return (filtered.toString()); } /** * * 基本功能:判断标记是否存在 *

* * @param input * @return boolean */ public boolean hasSpecialChars(String input) { boolean flag = false; if ((input != null) && (input.length() > 0)) { char c; for (int i = 0; i :flag = true;break;case <:flag = true;break;case \":flag = true;break;case &:flag = true;break;} } } return flag; } /** * * 基本功能:过滤所有以""结尾的标签 *

* * @param str * @return String */ public static String filterHtml(String str) { Pattern pattern = pile(regxpForHtml); Matcher matcher = pattern.matcher(str); StringBuffer sb = new StringBuffer(); boolean result1 = matcher.find(); while (result1) { matcher.appendReplacement(sb, ""); result1 = matcher.find(); } matcher.appendTail(sb); return sb.toString(); } /** * * 基本功能:过滤指定标签 *

* * @param str * @param tag * 指定标签 * @return String */ public static String fiterHtmlTag(String str, String tag) { String regxp = "]*)\\s*>"; Pattern pattern = pile(regxp); Matcher matcher = pattern.matcher(str); StringBuffer sb = new StringBuffer(); boolean result1 = matcher.find(); while (result1) { matcher.appendReplacement(sb, ""); result1 = matcher.find(); } matcher.appendTail(sb); return sb.toString(); } /** * * 基本功能:替换指定的标签 *

* * @param str * @param beforeTag * 要替换的标签 * @param tagAttrib * 要替换的标签属性值 * @param startTag * 新标签开始标记 * @param endTag * 新标签结束标记 * @return String * @如:替换img标签的src属性值为[img]属性值[/img] */ public static String replaceHtmlTag(String str, String beforeTag, String tagAttrib, String startTag, String endTag) { String regxpForTag = "]*)\\s*>"; String regxpForTagAttrib = tagAttrib + "=\"([^\"]+)\""; Pattern patternForTag = pile(regxpForTag); Pattern patternForAttrib = pile(regxpForTagAttrib); Matcher matcherForTag = patternForTag.matcher(str); StringBuffer sb = new StringBuffer(); boolean result = matcherForTag.find(); while (result) { StringBuffer sbreplace = new StringBuffer(); Matcher matcherForAttrib = patternForAttrib.matcher(matcherForTag.group(1)); if (matcherForAttrib.find()) {matcherForAttrib.appendReplacement(sbreplace, startTag + matcherForAttrib.group(1) + endTag); } matcherForTag.appendReplacement(sb, sbreplace.toString()); result = matcherForTag.find(); } matcherForTag.appendTail(sb); return sb.toString(); } }

更多java使用正则表达式过滤html标签相关文章请关注PHP中文网!

本内容不代表本网观点和政治立场,如有侵犯你的权益请联系我们处理。
网友评论
网友评论仅供其表达个人看法,并不表明网站立场。