You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用Jsoup提取链接标题中的“396900 runs”?

使用Jsoup提取“396900 runs”的分步指南

嘿,作为网页抓取和Jsoup的新手,这个任务其实很简单,我一步步带你完成:

下面是完整的代码示例:

import org.jsoup.Jsoup;
import org.jsoup.nodes.Document;
import org.jsoup.nodes.Element;

public class JsoupExample {
    public static void main(String[] args) {
        // 给定的HTML片段
        String html = "<i class=\"fa fa-star\"></i> <a href=\"#taskruns\" data-toggle=\"tab\">396900 runs submitted</a>";
        
        // 解析HTML
        Document doc = Jsoup.parse(html);
        
        // 定位到目标a标签
        Element linkElement = doc.selectFirst("a[href=#taskruns]");
        
        if (linkElement != null) {
            // 获取完整文本
            String fullText = linkElement.text();
            // 提取需要的部分:分割掉" submitted"
            String targetText = fullText.split(" submitted")[0];
            
            // 输出结果:396900 runs
            System.out.println(targetText);
        } else {
            System.out.println("未找到目标元素");
        }
    }
}

如果你想更灵活一点,比如以后文本格式有小变化,也可以用正则表达式来匹配,比如:

import java.util.regex.Matcher;
import java.util.regex.Pattern;

// ... 前面的代码不变
Pattern pattern = Pattern.compile("(\\d+ runs)");
Matcher matcher = pattern.matcher(fullText);
if (matcher.find()) {
    String targetText = matcher.group(1);
    System.out.println(targetText);
}

这种方式能匹配任意数字加“ runs”的组合,适应性更强。

内容的提问来源于stack exchange,提问作者Zeshan Fayyaz

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.22 08:50:16