金豆提现怎么提彩票365能提现吗

应用介绍

HtmlCleaner是一个免费开源的适用范围广的Java语言Html文档解析器，它能重新整理HTML文档的每个元素并生成结构良好(Well-Formed)的HTML文档。默认它遵循的规则是类似于大部份web浏览器为创文档对象模型所使用的规则，户可以提供自定义tag和规则组来进行过滤和匹配。

HtmlCleaner软件特色

它被设计的小，快速，灵活而且独立。HtmlCleaner也可用在Java代码中，当命令行工具或Ant任务。解析后编程轻量级文档对象，能够很容易的被转换到DOM或者JDom标准文档，或者通过各种方式(压缩，打印)连续输出XML。散酒一年赚多少钱

HtmlCleaner更新内容

1.HtmlCleaner的文档对象模型拥有了一些函数，处理节点和属性，所以在序列化之前搜索或者编辑是非常容易的。

2.提供基本HtmlCleanerDOM的XPath支持

3.使用XML配置文件让创建定制tag变得更加容易

4.修复多个bug以及API改进

HtmlCleaner使用示例

写一个测试用的html文件：html-clean-demo.html

<!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd " >

< html xmlns = "http://www.w3.org/1999/xhtml " xml:lang = "zh-CN" dir = "ltr" >

< head >

< meta http-equiv = "Content-Type" content = "text/html; charset=GBK" />

< meta http-equiv = "Content-Language" content = "zh-CN" />

< title > html clean demo </ title >

</ head >

< body >

< div class = "d_1" >

< ul >

< li > bar </ li >

< li > foo </ li >

< li > gzz </ li >

</ ul >

</ div >

< div >

< ul >

< li > < a name = "my_href" href = "1.html" > text-1 </ a > </ li >

< li > < a name = "my_href" href = "2.html" > text-2 </ a > </ li >

< li > < a name = "my_href" href = "3.html" > text-3 </ a > </ li >

< li > < a name = "my_href" href = "4.html" > text-4 </ a > </ li >

</ ul >

</ div >

</ body >

</ html >

Html代码

<!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd">

<head>

<title>html clean demo</title>

</head>

<body>

<ul>

</ul>

</div>

<div>

<ul>

</ul>

</div>

</body>

</html>

模拟需求：取出title，name="my_href"的链接，div的class="d_1"下的所有li内容。下面用htmlcleaner写代码，HtmlCleanerDemo.java

package com.chenlb;

import java.io.File;

import org.htmlcleaner.HtmlCleaner;

import org.htmlcleaner.TagNode;

/**

* htmlcleaner 使用示例.

* @author chenlb 2008-11-26 下午02:12:02

public class HtmlCleanerDemo {

public static void main(String[] args) throws Exception {

HtmlCleaner cleaner = new HtmlCleaner();

TagNode node = cleaner.clean(new File( "html/html-clean-demo.html" ), "GBK" );

//按tag取.

Object[] ns = node.getElementsByName("title" , true ); //标题

if (ns.length > 0 ) {

System.out.println("title=" +((TagNode)ns[ 0 ]).getText());

}

System.out.println("ul/li:" );

//按xpath取

ns = node.evaluateXPath("//div[@class='d_1']//li" );

for (Object on : ns) {

TagNode n = (TagNode) on;

System.out.println(" text=" +n.getText());

}

System.out.println("a:" );

//按属性值取

ns = node.getElementsByAttValue("name" , "my_href" , true , true );

for (Object on : ns) {

TagNode n = (TagNode) on;

System.out.println(" href=" +n.getAttributeByName( "href" )+ ", text=" +n.getText());

}

Java代码

package com.chenlb;

import java.io.File;

import org.htmlcleaner.HtmlCleaner;

import org.htmlcleaner.TagNode;

/**

* htmlcleaner 使用示例.

* @author chenlb 2008-11-26 下午02:12:02

public class HtmlCleanerDemo {

public static void main(String[] args) throws Exception {

HtmlCleaner cleaner = new HtmlCleaner();

TagNode node = cleaner.clean(new File("html/html-clean-demo.html"), "GBK");

//按tag取.

Object[] ns = node.getElementsByName("title", true); //标题

if(ns.length > 0) {

System.out.println("title="+((TagNode)ns[0]).getText());

}

System.out.println("ul/li:");

//按xpath取

ns = node.evaluateXPath("//div[@class='d_1']//li");

for(Object on : ns) {

TagNode n = (TagNode) on;

System.out.println(" text="+n.getText());

}

System.out.println("a:");

//按属性值取

ns = node.getElementsByAttValue("name", "my_href", true, true);

for(Object on : ns) {

TagNode n = (TagNode) on;

System.out.println(" href="+n.getAttributeByName("href")+", text="+n.getText());

}

cleaner.clean()中的参数，可以是文件，可以是url，可以是字符串内容。个人认为：比较常用的应该是evaluateXPath、getElementsByAttValue、getElementsByName方法了。另外说明下，htmlcleaner对不规范的html兼容性比较好。

用户评论

开家水星家纺赚钱吗

2025/10/09 01:20更新

谷歌浏览器Chrome更新器是一款更新安装版下载工具，可以检查的最新更新补丁包来进行离线下载，操作简单，快来下载使用吧！软件介绍谷歌浏览器更新器(ChromeU...

联通光纤网友 xyzwap 一米赚钱是真的吗: 一米赚钱是真的吗
支持 ( 67 ) 盖楼(回复)
联通光纤网友 xyzwap 试玩软件赚到钱的平台: 试玩软件赚到钱的平台
支持 ( 198 ) 盖楼(回复)
联通光纤网友 xyzwap 赚钱兼职安全豆豆正规: 赚钱兼职安全豆豆正规
支持 ( 42 ) 盖楼(回复)
联通光纤网友 xyzwap 棋牌游戏软件开发赚钱: 棋牌游戏软件开发赚钱
支持 ( 42 ) 盖楼(回复)
联通光纤网友 xyzwap dnf哪搬砖: dnf哪搬砖
支持 ( 153 ) 盖楼(回复)
联通光纤网友 xyzwap 烧电路板一吨赚多少: 烧电路板一吨赚多少
支持 ( 158 ) 盖楼(回复)
联通光纤网友 xyzwap 玩哪些游戏能赚钱的: 玩哪些游戏能赚钱的
支持 ( 39 ) 盖楼(回复)
联通光纤网友 xyzwap 投稿是怎么赚钱: 投稿是怎么赚钱
支持 ( 11 ) 盖楼(回复)
联通光纤网友 xyzwap 怎么看佣金多少: 怎么看佣金多少
支持 ( 157 ) 盖楼(回复)
联通光纤网友 xyzwap 赚钱大佬: 赚钱大佬
支持 ( 37 ) 盖楼(回复)
联通光纤网友 xyzwap 新利豪棋牌: 新利豪棋牌
支持 ( 193 ) 盖楼(回复)
联通光纤网友 xyzwap 讲道德的人赚不了钱: 讲道德的人赚不了钱
支持 ( 81 ) 盖楼(回复)
联通光纤网友 xyzwap 易赞平台真的能赚钱吗: 易赞平台真的能赚钱吗
支持 ( 32 ) 盖楼(回复)
联通光纤网友 xyzwap 最赚钱的小生意项目: 最赚钱的小生意项目
支持 ( 58 ) 盖楼(回复)
联通光纤网友 xyzwap 学生网上赚钱的好方法: 学生网上赚钱的好方法
支持 ( 162 ) 盖楼(回复)
联通光纤网友 xyzwap 做点什么小生意好赚钱: 做点什么小生意好赚钱
支持 ( 75 ) 盖楼(回复)
联通光纤网友 xyzwap 梦幻主播怎么赚钱的: 梦幻主播怎么赚钱的
支持 ( 129 ) 盖楼(回复)
联通光纤网友 xyzwap 在家创业那行来钱: 在家创业那行来钱
支持 ( 150 ) 盖楼(回复)
联通光纤网友 xyzwap 利润高的汽车钢圈电镀: 利润高的汽车钢圈电镀
支持 ( 100 ) 盖楼(回复)
联通光纤网友 xyzwap ar玩具枪摆摊能赚钱吗: ar玩具枪摆摊能赚钱吗
支持 ( 10 ) 盖楼(回复)

查看更多评论