本文共 1527 字,大约阅读时间需要 5 分钟。
昆明达内培训的小编知道,Java中正则表达式去除html的标签,主要目的更精确的显示内容,比如前一段时间在做类似于博客中发布文章功能,当编辑器中输入内容后会将样式标签也传入后台并且保存数据库,但是在显示摘要的时候,比如显示正文的前50字作为摘要,那么这时需要去除所有html标签,然后在截取50字,所以就通过了Java正则表达式实现了如下方法,代码如下:
注:这是Java正则表达式去除html标签方法。
private static final String regEx_script =
"
private static final String regEx_style =
"
private static final String regEx_html =
"<[^>]+>"; //定义HTML标签的正则表达式
private static final String regEx_space =
"\\s*|\t|\r|\n";//定义空格回车换行符
private static final String regEx_w =
"]*?>[\\s\\S]*?<\\/w[^>]*?>";//定义所有w标签
/**
* @param htmlStr
* @return删除Html标签
* @author LongJin
*/
public static String delHTMLTag(String
htmlStr) {
Pattern p_w = Pattern.compile(regEx_w,
Pattern.CASE_INSENSITIVE);
Matcher m_w = p_w.matcher(htmlStr);
htmlStr = m_w.replaceAll("");
//过滤script标签
Pattern p_script =
Pattern.compile(regEx_script, Pattern.CASE_INSENSITIVE);
Matcher m_script = p_script.matcher(htmlStr);
htmlStr =
m_script.replaceAll(""); //过滤script标签
Pattern p_style =
Pattern.compile(regEx_style, Pattern.CASE_INSENSITIVE);
Matcher m_style =
p_style.matcher(htmlStr);
htmlStr =
m_style.replaceAll(""); //过滤style标签
Pattern p_html =
Pattern.compile(regEx_html, Pattern.CASE_INSENSITIVE);
Matcher m_html =
p_html.matcher(htmlStr);
htmlStr =
m_html.replaceAll(""); //过滤html标签
Pattern p_space =
Pattern.compile(regEx_space, Pattern.CASE_INSENSITIVE);
Matcher m_space =
p_space.matcher(htmlStr);
htmlStr =
m_space.replaceAll(""); //过滤空格回车标签
htmlStr = htmlStr.replaceAll("
", ""); //过滤
return htmlStr.trim(); //返回文本字符串
}
了解详情请登陆昆明达内IT培训官网(km.tedu.cn)!
转载地址:http://bkifa.baihongyu.com/