JSoup选择问题

时间:2012-01-10 23:20:15

标签: java html jsoup

我在html中选择链接时遇到问题。这是我的html:

<div class=first>
    <a href=www.test1.com>test1</a>

    <div class=nope>
        <a href=www.test2.com>test2</a>
        <a href=www.test3.com>test3</a>
        <a href=www.test4.com>test4</a>
    </div>
</div>

我想要做的是拉取网址:
www.test2.com
www.test3.com
www.test4.com

我尝试了很多不同的.select和.not组合,但我无法弄明白。谁能指出我做错了什么?

String url = "<div class=first><a href=www.test1.com>test1</a>One<div class=nope><a href=www.test2.com>test2</a>Two</div></div><div class=second><a href=www.test3.com>test3</a></div>";
Document doc = Jsoup.parse(url);
Elements divs = doc.select("div a[href]").not(".first.nope a[href]"); 
System.out.println(divs);

3 个答案:

答案 0 :(得分:2)

Document doc = Jsoup.parse("your html code/url ");
Elements links = doc.select("div.nope a").first();
for (Element link : links) {
System.out.println(link.attr("href"));

答案 1 :(得分:1)

我会这样做有点不同:

  Elements elements = doc.select("div.nope").select("a[href]");

  for (Element element : elements) {
     System.out.println(element.attr("href"));
  }

答案 2 :(得分:0)

Elements data=doc.getElementsByClass("nope")

for(Element d:data)
{
    String yourData= d.tagName("href").toString();
}