栏目分类:
子分类:
返回
名师互学网用户登录
快速导航关闭
当前搜索
当前分类
子分类
实用工具
热门搜索
名师互学网 > IT > 软件开发 > 后端开发 > Java

JAVA过滤标签实现将html内容转换为文本的方法示例

Java 更新时间: 发布时间: IT归档 最新发布 模块sitemap 名妆网 法律咨询 聚返吧 英语巴士网 伯小乐 网商动力

JAVA过滤标签实现将html内容转换为文本的方法示例

本文实例讲述了JAVA过滤标签实现将html内容转换为文本的方法。分享给大家供大家参考,具体如下:


public static String trimHtml2Txt(String html, String[] filterTags){
    html = html.replaceAll("\[\s\S]*?(?i)", "");//去掉head
    html = html.replaceAll("\", "");//去掉注释
    html = html.replaceAll("\", "");
    html = html.replaceAll("\]*>[\s\S]*?(?i)", "");//去掉样式
    html = html.replaceAll("\(?i)", "");//去掉js
    html = html.replaceAll("\]+>[\s\S]*?]+>(?i)", "");//去掉word标签
    html = html.replaceAll("\[\s\S]*?(?i)", "");
    html = html.replaceAll("\]*>|]*>||(?i)", "");
    html = html.replaceAll("\rn|n|r", " ");//去掉换行
    html = html.replaceAll("\]*>(?i)", "nr");
    List tags = new ArrayList();
    List s_tags = new ArrayList();
    List halfTag = Arrays.asList(new String[]{"img","table","thead","th","tr","td"});//
    if(filterTags != null && filterTags.length > 0){
      for (String tag : filterTags) {
 tags.add("<"+tag+(halfTag.contains(tag)?"":">"));//开始标签
 if(!"img".equals(tag)) tags.add("");//结束标签
 s_tags.add("#REPLACETAG"+tag+(halfTag.contains(tag)?"":"REPLACETAG#"));//尽量替换为复杂一点的标记,以免与显示文本混合,如:文本中包含#td、#table等
 if(!"img".equals(tag)) s_tags.add("#REPLACETAG/"+tag+"REPLACETAG#");
      }
    }
    html = StringUtils.replaceEach(html, tags.toArray(new String[tags.size()]), s_tags.toArray(new String[s_tags.size()]));
    html = html.replaceAll("\

(?i)", "nr"); html = html.replaceAll("\<[^>]+>", ""); html = StringUtils.replaceEach(html,s_tags.toArray(new String[s_tags.size()]),tags.toArray(new String[tags.size()])); html = html.replaceAll("\ ", " "); return html.trim(); }

PS:这里再为大家推荐一款功能类似的在线工具供大家参考使用:

在线html/js/css代码过滤工具
http://tools.jb51.net/code/htmlfilter

另外,关于正则操作,这里再为大家推荐两款相关在线工具:

Javascript正则表达式在线测试工具:
http://tools.jb51.net/regex/javascript

正则表达式在线生成工具:
http://tools.jb51.net/regex/create_reg

更多关于java算法相关内容感兴趣的读者可查看本站专题:《Java数据结构与算法教程》、《Java字符与字符串操作技巧总结》、《Java操作DOM节点技巧总结》、《Java文件与目录操作技巧汇总》和《Java缓存操作技巧汇总》

希望本文所述对大家java程序设计有所帮助。

转载请注明:文章转载自 www.mshxw.com
本文地址:https://www.mshxw.com/it/145354.html
我们一直用心在做
关于我们 文章归档 网站地图 联系我们

版权所有 (c)2021-2022 MSHXW.COM

ICP备案号:晋ICP备2021003244-6号