java格式化html代码

Document doc = Document.createShell("");
            Element body = doc.body();
            Element head = doc.head();
            List<Node> nodeList = Parser.parseFragment(htmlCode, body, "");
            Node[] nodes = nodeList.toArray(new Node[0]);
            for (int i = nodes.length - 1; i > 0; i--) {
                nodes[i].remove();
            }
            for (Node node : nodes) {
                if(node.outerHtml().contains("<meta") || node.outerHtml().contains("<title") ||node.outerHtml().contains("<link") ){
                    head.appendChild(node);
                }else {
                    body.appendChild(node);
                }
            }
            String headStr = head.html();
            htmlCode = doc.html().replace("<head></head>", headStr);

在网上找到的例子不让人满意,于是自己手牵手写了一个。
原理就是抄org.jsoup.parser的。
读取html将所有标签收纳到Node中,将特殊的给head,其余放入body,再遍历得到doc。

/**
	 * 格式化html代码
	 * @param model
	 * @param html
	 * @return
	 */
	@RequestMapping("/formatHtml.dhtml")
	@ResponseBody
	public M formatHtml(Model model,String html) {
		if(StringUtils.isNotBlank(html)) {
			try {
				Document doc = Jsoup.parseBodyFragment(html);
				html = doc.body().html();
			} catch (Exception e) {
				e.printStackTrace();
			}
		}
		return M.success(model).data(html);
	}

<!-- https://mvnrepository.com/artifact/org.jsoup/jsoup -->
<dependency>
    <groupId>org.jsoup</groupId>
    <artifactId>jsoup</artifactId>
    <version>1.11.3</version>
</dependency>

别人的代码,不符合我的需求。

复制代码,如果运行不成功,可以加WX bin490647751 部署,付费远程调试,并可加入我们微信群。

微信群可以学到如下AI技能:

客服服务:自动回复客户提出的问题
技术支持:自动回答用户提出的技术问题
数据分析:自动分析用户行为,提供数据支持
内容创作:自动生成文章、新闻等内容
智能搜索:提供智能搜索服务
语音识别:自动识别用户语音,提供语音识别服务
语义分析:自动分析用户语句,提供语义分析服务
智能对话:自动完成用户与机器的智能对话
智能推荐:自动根据用户行为提供智能推荐服务
智能客服:自动完成用户与机器的智能客服服务

Logo

CSDN联合极客时间,共同打造面向开发者的精品内容学习社区,助力成长!

更多推荐