java实现解析html获取图片或视频url

一、前言

有时在实际项目中,比如发布某篇文章,需要取文章中的某张图片作为封面,那么此时需要文章内容,获取html内容中的图片地址作为封面,下面讲下如何获取html中的图片或视频地址。

二、实现

1.先定义一个工具类,解析html获取图片地址。

复制代码
import java.util.ArrayList;
import java.util.List;
import java.util.regex.Matcher;
import java.util.regex.Pattern;
import java.util.stream.Collectors;

public class HtmlParseUtil {
	private static final String regEx_img="<img [^>]*src=\"([^>]*?)\" alt=([^>]*?)>";
	private static final String regEx_video="<video [^>]*src=\"([^>]*?)\">[\\s\\S]*?</video>";

	/**
	 * 解析html获取图片或视频
	 * @param content
	 * @return
	 */
	public static String htmlParseImgOrVedio(String content) {
		Pattern p = Pattern.compile(regEx_img, Pattern.CASE_INSENSITIVE);
		Matcher m = p.matcher(content);
		if(m.find()) {
			return m.group(1).trim();
		}else {
			p = Pattern.compile(regEx_video, Pattern.CASE_INSENSITIVE);
			m=p.matcher(content);
			if(m.find()) {
				return m.group(1).trim();
			}
		}
		return "";
	}
}

上面通过正则匹配获取src中的地址。

2.通过main方法调用看是否可获取。

复制代码
public static void main(String[] args) {
		String s="<p style=\"text-align: center;\"><img src=\"https://myoss.oss-cn-hangzhou.aliyuncs.com/task/e4d1afba664b415cf5bf40eda33b7ba0/2021-04-21/161897103374171750.png\" alt=\"\"></p><p><br></p><p>内容发布后跳转页面有待优化,进来的时候是<strong>测试简介</strong></p><p><strong><img src=\"https://myoss.oss-cn-hangzhou.aliyuncs.com/task/e4d1afba664b415cf5bf40eda33b7ba0/2021-04-21/161897102930795080.png\" alt=\"\"></strong></p>";
		String s1="<p><video class=\"edui-upload-video  vjs-default-skin   video-js\" controls=\"\" preload=\"none\" width=\"420\" height=\"280\" src=\"https://myoss.oss-cn-shenzhen.aliyuncs.com/task/2019-11-28/2019112819471601813428538534561557.mp4\"><source src=\"https://myoss.oss-cn-shenzhen.aliyuncs.com/task/2019-11-28/2019112819471601813428538534561557.mp4\" type=\"video/mp4\"/></video></p>";
		Pattern p = Pattern.compile(regEx_img, Pattern.CASE_INSENSITIVE);
		Matcher m = p.matcher(s);
		if(m.find()) {
			System.err.println(m.group(1).trim());
		}
		Pattern p1 = Pattern.compile(regEx_video, Pattern.CASE_INSENSITIVE);
		Matcher m1 = p1.matcher(s1);
		if(m1.find()) {
			System.err.println(m1.group(1).trim());
		}
	}

运行结果如下:

结果是正常获取到了图片或视频的url。

相关推荐
JAVA面经实录91721 小时前
Java企业级工程化·终极完整版背诵手册(无遗漏、全覆盖、面试+落地通用)
java·开发语言·面试
许彰午1 天前
CacheSQL(二):主从复制——OpLog 环形缓冲区与故障自动恢复
java·数据库·缓存
Bat U1 天前
JavaEE|多线程初阶(七)
java·开发语言
掌心向暖RPA自动化1 天前
如何获取网页某个元素在屏幕可见部分的中心坐标影刀RPA懒加载坐标定位技巧
java·javascript·自动化·rpa·影刀rpa
日取其半万世不竭1 天前
Minecraft Java版社区服务器搭建教程(Linux,适合新手)
java·linux·服务器
TeamDev1 天前
JxBrowser 9.0.0 版本发布啦!
java·前端·混合应用·jxbrowser·浏览器控件·跨平台渲染·原声输入
AI人工智能+电脑小能手1 天前
【大白话说Java面试题】【Java基础篇】第24题:Java面向对象有哪些特征
java·开发语言·后端·面试
AI人工智能+电脑小能手1 天前
【大白话说Java面试题】【Java基础篇】第25题:JDK1.8的新特性有哪些
java·开发语言·后端·面试
likerhood1 天前
SLF4J: Failed to load class “StaticLoggerBinder“ 解决
java·log4j·maven
早日退休!!!1 天前
大模型推理瓶颈七层分析模型
java·服务器·数据库