Python正则表达式如何匹配URL链接？完整模式-创客网

匹配url的正则表达式可以写为：https?://(?:www.)?[a-za-z0-9-]+(.[a-za-z]{2,})+(/\s*)?，其结构分为三部分：1. 匹配协议头http或https；2. 匹配域名，包括可选的www前缀、域名主体和顶级域名；3. 可选的路径和参数部分。在使用时可通过python的re模块进行匹配，并可根据需求添加行首行尾锚点、扩展端口号与ip地址支持，或结合urllib.parse处理更复杂的场景。

Python正则表达式如何匹配URL链接？完整模式

匹配URL链接的正则表达式其实并不复杂，但要写出一个既全面又实用的模式，就需要考虑各种常见的URL格式。下面这个正则表达式基本上可以覆盖大多数常见情况：

Python正则表达式如何匹配URL链接？完整模式

https?://(?:www\.)?[a-zA-Z0-9-]+(\.[a-zA-Z]{2,})+(/[^\s]*)?

接下来我们分几个部分来解释这个正则表达式的结构，并给出一些使用建议。

Python正则表达式如何匹配URL链接？完整模式

匹配协议头：http 或 https

URL通常以 http:// 或 https:// 开头。这部分可以用以下正则表示：

立即学习“Python免费学习笔记（深入）”；

https?

这里的 s? 表示“s”是可选的，也就是既可以匹配 http 也可以匹配 https。

Python正则表达式如何匹配URL链接？完整模式

匹配域名（包括 www 和非 www）

域名部分通常由字母、数字、短横线组成，可能带有 www. 前缀。我们可以这样写：

(?:www\.)?[a-zA-Z0-9-]+(\.[a-zA-Z]{2,})+

(?:www\.)? 表示可选的 www.，且不捕获该组（非捕获组）
[a-zA-Z0-9-]+ 表示域名主体，如 google、example 等
(\.[a-zA-Z]{2,})+ 表示顶级域名，如 .com、.org、.co.uk 等，至少两个字符

匹配路径和参数（可选）

URL中可能会有路径或查询参数，比如 /about 或 ?id=123。这部分可以用：

(/[^\s]*)?

/ 表示路径开始
[^\s]* 表示除了空格以外的任意字符（即路径和参数）
整个用 ()? 包裹，表示整个路径部分是可选的

实际使用建议

在Python中使用时，可以结合 re 模块进行匹配：

import re
pattern = r'https?://(?:www\.)?[a-zA-Z0-9-]+(\.[a-zA-Z]{2,})+(/[^\s]*)?'
text = '访问我们的网站 https://example.com/about 获取更多信息'
urls = re.findall(pattern, text)
print(urls)

注意事项：

如果你只想匹配完整的URL，可以加上行首行尾锚点：^…$
如果需要处理带端口号、IP地址的URL，还需要扩展正则表达式
对于更复杂的URL提取需求，可以考虑使用 urllib.parse 配合正则一起处理

总结一下

上面这个正则已经能应对大部分常规URL的匹配了，不需要追求完美覆盖所有可能，除非你的应用场景特别复杂。在实际开发中，根据具体输入数据做适当调整是最实用的做法。

基本上就这些。

温馨提示： 本文最后更新于2025-06-26 22:28:24，某些文章具有时效性，若有错误或已失效，请在下方留言或联系在线客服。

文章版权声明 1 本网站名称： 创客网
2 本站永久网址：https://new.ie310.com
1 本文采用非商业性使用-相同方式共享 4.0 国际许可协议[CC BY-NC-SA]进行授权
2 本站所有内容仅供参考，分享出来是为了可以给大家提供新的思路。
3 互联网转载资源会有一些其他联系方式，请大家不要盲目相信，被骗本站概不负责！
4 本网站只做项目揭秘，无法一对一教学指导，每篇文章内都含项目全套的教程讲解，请仔细阅读。
5 本站分享的所有平台仅供展示，本站不对平台真实性负责，站长建议大家自己根据项目关键词自己选择平台。
6 因为文章发布时间和您阅读文章时间存在时间差，所以有些项目红利期可能已经过了，能不能赚钱需要自己判断。
7 本网站仅做资源分享，不做任何收益保障，创业公司上收费几百上千的项目我免费分享出来的，希望大家可以认真学习。
8 本站所有资料均来自互联网公开分享，并不代表本站立场，如不慎侵犯到您的版权利益，请联系79283999@qq.com删除。

本站资料仅供学习交流使用请勿商业运营，严禁从事违法，侵权等任何非法活动，否则后果自负！

THE END

免费课程网创课程
# python # python正则表达式

文字广告位招租中	文字广告位招租中	文字广告位招租中	文字广告位招租中	文字广告位招租中
文字广告位招租中	文字广告位招租中	文字广告位招租中	文字广告位招租中	文字广告位招租中
文字广告位招租中	文字广告位招租中	文字广告位招租中	文字广告位招租中	文字广告位招租中

119:03 跳app领9-3券洁婷茶多酚抑菌安睡裤5条 6.8亓

210:13 zfb还款大毛。速度

314:32 淘宝0.5充1继续

422:07 领券中心79-15券秋淘麻辣花生400g/罐拍6件，凑后，每件3.

5css工具CSSLint检查哪些常见错误

6抖音剧情号带货搬运技术，第一条视频30万播放爆单佣金700+

热门广告位

Python正则表达式如何匹配URL链接？完整模式

匹配协议头：http 或 https

匹配域名（包括 www 和非 www）

匹配路径和参数（可选）

实际使用建议

注意事项：

总结一下

请登录后发表评论

119:03 跳app领9-3券 洁婷茶多酚抑菌安睡裤5条 6.8亓

210:13 zfb还款大毛。速度

314:32 淘宝0.5充1继续

422:07 领券中心79-15券 秋淘麻辣花生400g/罐 拍6件，凑后，每件3.

5css工具CSSLint检查哪些常见错误

6抖音剧情号带货搬运技术，第一条视频30万播放爆单佣金700+

热门广告位

Python正则表达式如何匹配URL链接？完整模式

匹配协议头：http 或 https

匹配域名（包括 www 和非 www）

匹配路径和参数（可选）

实际使用建议

注意事项：

总结一下

请登录后发表评论

119:03 跳app领9-3券洁婷茶多酚抑菌安睡裤5条 6.8亓

422:07 领券中心79-15券秋淘麻辣花生400g/罐拍6件，凑后，每件3.