python5

1.使用正则完成下列内容的匹配

  • 匹配陕西省区号 029-12345

  • 匹配邮政编码 745100

  • 匹配邮箱 lijian@xianoupeng.com

  • 匹配身份证号 62282519960504337X

代码如下:

python 复制代码
import re
texts = {
    "区号": "029-12345",
    "邮编": "123456",
    "邮箱": "llllll@xxhhyyzzzz.com",
    "身份证": "222333222322211121"
}
patterns = {
    "区号": r"029-\d{5}",
    "邮编": r"\d{6}",
    "邮箱": r".+@.+\..+",
    "身份证": r"\d{17}X|\d{18}"
}
for name in texts:
    result = re.search(patterns[name], texts[name])
    print(f"{name}: {result.group() if result else '没匹配到'}")

运行结果如下:

2.爬取学校官网,获取所有图片途径并将路径存储在本地文件中,使用装饰器完成

代码如下:

python 复制代码
import requests
import re
from functools import wraps
def save_to_file(filename):
    def decorator(func):
        @wraps(func)
        def wrapper(*args, **kwargs):
            result = func(*args, **kwargs)
            with open(filename, 'w', encoding='utf-8') as f:
                for item in result:
                    f.write(item + '\n')
            print(f"已保存 {len(result)} 条到 {filename}")
            return result
        return wrapper
    return decorator
def safe_request(func):
    @wraps(func)
    def wrapper(*args, **kwargs):
        try:
            return func(*args, **kwargs)
        except Exception as e:
            print(f"请求失败: {e}")
            return ""
    return wrapper
class Spider:
    def __init__(self):
        self.url = "https://www.gsau.edu.cn/"
        self.headers = {'User-Agent': 'Mozilla/5.0'}
    @safe_request
    def fetch(self):
        res = requests.get(self.url, headers=self.headers)
        return res.text
    @save_to_file(filename='images.txt')
    def get_images(self):
        html = self.fetch()
        imgs = re.findall(r'<img[^>]+src="([^"]+)"', html)
        full_urls = []
        for img in imgs:
            if img.startswith('http'):
                full_urls.append(img)
            else:
                full_urls.append("https://www.gsau.edu.cn" + img)
        return full_urls
spider = Spider()
spider.get_images()

运行结果如下:

相关推荐
en.en..1 小时前
Linux 孤儿进程与僵尸进程
linux·运维·服务器
mldong4 小时前
你的 Vue3 项目也能有钉钉同款审批流设计器:npm 装包,10 分钟画出第一条审批流
前端·vue.js
2分钟速写快排5 小时前
什么是 RAG?如何用 RAG 实现一个用户记忆?
前端·后端·ai编程
passerby60615 小时前
如何自己造一个时间处理库
前端·javascript·github
lhldsg6 小时前
全民健身解决方案小程序开发:从0到1的技术实战
java·数据库·需求分析
jason成都6 小时前
Spring WebFlux 适配达梦新方案|dm‑r2dbc:Netty 异步传输的实验性 R2DBC 驱动
java·后端·spring
泡海椒6 小时前
内置SPI函数库详解:JQuick-Java Builtin工具类实战用法
java·开发语言·python
辰烨chenye6 小时前
LeetCode Hot 100 题解 · 二分篇
java·算法·leetcode
T1mzhou6 小时前
ARM64 Linux 6.10内核启动流程7-ioremap和readl writel
linux·服务器·c语言
走到天涯海角6 小时前
react里面的长列表渲染优化
前端·react.js·前端框架