提供丰富的素材资源、软件工具、源码模板、技术文章和编程教程，专注于网站搭建、AI应用、开源项目分享和工具推荐。帮助开发者轻松获取所需资源，快速提升技术水平。

搜索前端开发相关内容

热词：

如何用正则表达式从HTML代码中提取特定类型的链接？

2024-11-29 22:42

标签导航：

如何用正则表达式从html代码中提取特定类型的链接？

正则表达式提取特定内容

在使用正则表达式时，有时我们需要过滤出特定内容。本文将介绍如何使用正则表达式从 html 代码中提取含有特定字符的链接。

问题：

如何从以下 html 代码中提取所有以 "www." 开头并以 ".com" 或 ".cn" 结尾的链接？

<p>++++++++++++++++++++++++++++++++++++++++++++
++++++++++++++++++++++++++++++++++++++++++++</p>

答案：

import java.util.regex.matcher;
import java.util.regex.pattern;

public class linkextractor {

    public static void main(string[] args) {
        string html = "<a>www.baidu.com</a><a>www.qq.com</a><a>www.aaa.cn</a>www.eee.cn";
        string reg = "www.*?(com|cn)";

        matcher matcher = pattern.compile(reg, pattern.case_insensitive).matcher(html);
        while (matcher.find()) {
            system.out.println(matcher.group());
        }
    }
}

匹配结果：

www.baidu.com
www.qq.com
www.aaa.cn
www.eee.cn

解析：

.*?：匹配 0 个或更多字符，但尽可能少的字符。
(com|cn)：匹配 "com" 或 "cn" 字符串，使用圆括号分组是为了捕获匹配内容。
pattern.case_insensitive：设置正则表达式匹配时忽略大小写。

提供丰富的素材资源、软件工具、源码模板、技术文章和编程教程，专注于网站搭建、AI应用、开源项目分享和工具推荐。帮助开发者轻松获取所需资源，快速提升技术水平。

搜索前端开发相关内容

如何用正则表达式从HTML代码中提取特定类型的链接？

相关文章推荐

BOE（京东方）绵阳“零碳工厂”探访活动圆满落幕 树立显示...

pixiv官网入口 pixiv网页版官网登录入口

暴雪嘉年华回归预告 定档2026年9月

幕末开放世界动作RPG《浪人崛起》Steam版于今日发售

界外狂潮公测时间在哪 公测时间及平台说明

界外狂潮是手游还是端游 平台登录情况最新说明

《坂本日常 危险益智游戏》事前登录突破 10 万人 宣布将...

界外狂潮官网在哪 官网地址与预约入口一览

《怪物猎人荒野》首波活动任务开启 可获得「库纳法起司」食材

Linux strings命令能否提取特定类型的字符串

Nginx日志如何帮助优化缓存策略

Linux Golang日志如何优化

BOE（京东方）绵阳“零碳工厂”探访活动圆满落幕树立显示...

暴雪嘉年华回归预告定档2026年9月

界外狂潮公测时间在哪公测时间及平台说明

界外狂潮是手游还是端游平台登录情况最新说明

《坂本日常危险益智游戏》事前登录突破 10 万人宣布将...

界外狂潮官网在哪官网地址与预约入口一览

《怪物猎人荒野》首波活动任务开启可获得「库纳法起司」食材