python requests采集同花顺F10、龙虎榜数据

首先,同花顺F10信息的数据来源,我们直接获取https的数据,不用啥API,地址来源:

https://basic.10jqka.com.cn/股票代码/

其中股票代码替换成要查询的股票代码即可,例如:https://basic.10jqka.com.cn/600100/

python代码非常简单,也不需要对付反爬虫,

python 复制代码
import re
import requests
url = "https://basic.10jqka.com.cn/000017/"
# 设置请求头,模拟浏览器访问
headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/91.0.4472.124 Safari/537.36',
    'Referer': 'https://basic.10jqka.com.cn/'
}
# 发送请求获取页面内容
response = requests.get(url, headers=headers)
response.encoding = 'gbk'  # 确保编码正确
# 获取页面文本
html_content = response.text

# 提取所有 stockcode="000017" 的 stockcont 块
pattern_block = r'<div class="stockcont" stockcode="000017"[^>]*>.*?</div>\s*</div>\s*</div>'
matches = re.findall(pattern_block, html_content, re.DOTALL)
if matches:
    for i, content in enumerate(matches):
        print(f"=== 块 {i+1} ===")
        print(content)
else:
    print("未找到 stockcode=000017 的块")

###########################################################
"""
这就是简单的,龙虎榜数据模块
"""

然后再根据自己的需要,正则出数据。

相关推荐
全栈练习生7 小时前
AI Agent 沙箱
python·ai
SEO_juper8 小时前
用 Python 写一个 GEO 可见性检查脚本:你的网站现在能被 AI 引用吗
开发语言·人工智能·爬虫·python·seo·外贸独立站
用户8356290780519 小时前
使用 Python 对 Excel 工作表进行排序
后端·python
for_ever_love__10 小时前
MySQL 全文索引实战:FULLTEXT、ngram 中文分词与 MATCH AGAINST 到底该怎么用
java·python·mysql·全文检索·分词·索引·ngram
用户83562907805110 小时前
使用 Python 合并 PowerPoint 演示文稿
后端·python
weixin_4617694010 小时前
VS Code 中创建 Jupyter 文件(.ipynb)
ide·python·jupyter
2601_9669496510 小时前
多市场量化策略的数据接口应该如何设计:从数据层架构到策略接入
开发语言·python·数据分析·pandas·量化交易·股票数据·quantdash
全栈弄潮儿10 小时前
Python实战第1期:Python环境搭建与第一个程序
python
心易行者11 小时前
Agent应用+API端点商业化进阶实战:从单体智能体到可付费调用的API全流程
运维·服务器·人工智能·python·apache
weixin1997010801611 小时前
《1688图片空间API踩坑:img.upload 与 album.* 的防盗链与CDN缓存问题》(附Python源码)
开发语言·python·缓存