python5

1.使用正则完成下列内容的匹配

  • 匹配陕西省区号 029-12345

  • 匹配邮政编码 745100

  • 匹配邮箱 lijian@xianoupeng.com

  • 匹配身份证号 62282519960504337X

代码如下:

python 复制代码
import re
texts = {
    "区号": "029-12345",
    "邮编": "123456",
    "邮箱": "llllll@xxhhyyzzzz.com",
    "身份证": "222333222322211121"
}
patterns = {
    "区号": r"029-\d{5}",
    "邮编": r"\d{6}",
    "邮箱": r".+@.+\..+",
    "身份证": r"\d{17}X|\d{18}"
}
for name in texts:
    result = re.search(patterns[name], texts[name])
    print(f"{name}: {result.group() if result else '没匹配到'}")

运行结果如下:

2.爬取学校官网,获取所有图片途径并将路径存储在本地文件中,使用装饰器完成

代码如下:

python 复制代码
import requests
import re
from functools import wraps
def save_to_file(filename):
    def decorator(func):
        @wraps(func)
        def wrapper(*args, **kwargs):
            result = func(*args, **kwargs)
            with open(filename, 'w', encoding='utf-8') as f:
                for item in result:
                    f.write(item + '\n')
            print(f"已保存 {len(result)} 条到 {filename}")
            return result
        return wrapper
    return decorator
def safe_request(func):
    @wraps(func)
    def wrapper(*args, **kwargs):
        try:
            return func(*args, **kwargs)
        except Exception as e:
            print(f"请求失败: {e}")
            return ""
    return wrapper
class Spider:
    def __init__(self):
        self.url = "https://www.gsau.edu.cn/"
        self.headers = {'User-Agent': 'Mozilla/5.0'}
    @safe_request
    def fetch(self):
        res = requests.get(self.url, headers=self.headers)
        return res.text
    @save_to_file(filename='images.txt')
    def get_images(self):
        html = self.fetch()
        imgs = re.findall(r'<img[^>]+src="([^"]+)"', html)
        full_urls = []
        for img in imgs:
            if img.startswith('http'):
                full_urls.append(img)
            else:
                full_urls.append("https://www.gsau.edu.cn" + img)
        return full_urls
spider = Spider()
spider.get_images()

运行结果如下:

相关推荐
噗噗1219 小时前
基于 Go 语言实现企业大群发任务的平滑限流与多线程漏斗调度器
java·开发语言
苏州IT威翰德19 小时前
跨城光缆上的“急诊室”:一次沪、锡、常三地联动的服务器生死时速
运维·服务器
甲方大人请饶命19 小时前
Java-异常、File
java·开发语言
多敲代码防脱发19 小时前
Spring进阶(Aware接口)
java·后端·spring
海上彼尚19 小时前
Nodejs也能写Agent - 2.基础篇 - Prompt
前端·javascript·人工智能·node.js·prompt
Chase_______20 小时前
【Java基础核心知识点全解·01】Java运行机制详解:从 HelloWorld 到 classpath 找类流程
java·开发语言·python
2601_9547064920 小时前
2026 上半年云手机实测:红手指 / 傲晨云 / ACE / 易舜云横向对比
运维·服务器·智能手机
z2023050820 小时前
RDMA 之RoCEv2 的报文格式(5)
linux·服务器·网络·人工智能
银河麒麟操作系统20 小时前
【银河麒麟高级服务器操作系统】top命令详解
运维·服务器
未若君雅裁20 小时前
SpringMVC 执行流程详解
java·spring boot·spring·状态模式