一问读懂并了解HTTP代理的基本原理

代理分类

  • 正向代理:代理客户端

  • 反向代理:代理服务器,cdn雏形

  • 透明代理:代理客户端

三种代理模式概览
详细对比表

通过curl分析HTTP代理

cpp 复制代码
curl -x https://127.0.0.1:31181 https://httpbin.org/get?abc=123
  • 正常访问httpbin.org

  • 通过代理访问httpbin.org

通过抓包分析,两个包的请求行分别是/get?abc=123http://httpbin.org/get?abc=123。所以通过请求行,可以很清楚的知道客户端请求的目的url。

下面是代理服务伪代码:

cpp 复制代码
#通过代理,访问目的地址
if url.startwith('http'){
	#获取headers
	#获取cookies
	#获取url
	#检查授权
	if check_auth(){
		resp = request(url,heders,cookies)
		retrun resp
	}
	else{
		#授权失败
		return 403;//forbidden
	}
}

此时一个简单的HTTP代理即可完成。至于更多细节,例如请求头是否包含真实客户机IP等细节处理,根据实际业务需求处理即可。

通过浏览器代理分析

发现浏览器并未遵守上述规则,但是都有一个共同点:HOST,始终是目标HOST,所以代理服务进一步优化:

cpp 复制代码
#通过代理,访问目的地址
{
	#获取请求头的HOST 生成完整的URL
	#如果状态行的URL包含HOST(eg:curl 代理),则直接使用URL,如果不包含则从请求头获取HOST,拼接URL
	#获取cookies
	#检查授权
	if check_auth(){
		resp = request(url,heders,cookies)
		retrun resp
	}
	else{
		#授权失败
		return 403;//forbidden
	}
}
HTTP 代理之tunnel

HTTP tunnel,即CONNECT 方法,通过代理服务建立一条TCP通道,实现客户机和后端服务通讯。当Tunnel建立之后,代理服务只维护通道链接,并不需要解析包,此时传送数据可以是任何数据流,不在受HTTP协议限制。

cpp 复制代码
CONNECT httpbin.org:80 HTTP/1.1
Host: httpbin.org:80
Proxy-Authorization: basic *
相关推荐
飞凌嵌入式1 小时前
用「EN 18031认证」通关欧盟,这张 “网络安全护照” 已就位
网络·安全·能源
Trouvaille ~1 小时前
TCP Socket编程实战(三):线程池优化与TCP编程最佳实践
linux·运维·服务器·网络·c++·网络协议·tcp/ip
JoySSLLian2 小时前
手把手教你安装免费SSL证书(附宝塔/Nginx/Apache配置教程)
网络·人工智能·网络协议·tcp/ip·nginx·apache·ssl
Zach_yuan2 小时前
自定义协议:实现网络计算器
linux·服务器·开发语言·网络
猫头虎3 小时前
如何解决 OpenClaw “Pairing required” 报错:两种官方解决方案详解
网络·windows·网络协议·macos·智能路由器·pip·scipy
charlotte102410243 小时前
高并发:关于在等待学校教务系统选课时的碎碎念
java·运维·网络
Zaralike4 小时前
Linux 服务器网络不通排查 SOP(标准操作流程)
linux·服务器·网络
云姜.4 小时前
网络协议----OSI七层网络协议 和 TCP/IP四层(五层)网络协议
网络·网络协议
!chen4 小时前
LabVIEW TCP Server端工具TCP通信
网络·tcp/ip·labview
枷锁—sha5 小时前
【SRC】SQL注入快速判定与应对策略(一)
网络·数据库·sql·安全·网络安全·系统安全