【temu】分析拼多多跨境电商Temu数据分析数据采集

Temu是拼多多旗下跨境电商平台,于2022年9月1日在美国、加拿大、新加坡、中国台湾、中国香港等市场上线。本文作者从销售额、销量、产品分布等方面,对Temu产品进行了分析,一起来看一下吧。

py 复制代码
item_get获得商品详情

item_review获得商品评论列表

item_search按关键字搜索商品

请求地址: http://wechat:17610352720.cn

数据采集

采集的字段包括:商品名、商品id、原价、现价、一级分类、二级分类、店铺id、销量等;

上图是监控的temu数据中月销售额Top10的产品

数据用途:

  • 量化分析
  • 投资分析
  • 跨境电商选品分析
  • 练手学习

上图为temu单品销量Top10,由于销量最大显示10万+,所以该统计意义不大。

py 复制代码
def send_request(url):
    proxy = ProxyClient.random_ip()
    session = requests.Session()
    proxies = {
        "http": f"http://{proxy}",
        "https": f"http://{proxy}"
    }
    cookies = {
        'region': '211',
        'language': 'en',
        'currency': 'USD',
        'timezone': 'Asia%2FShanghai',
        'shipping_city': '211%2C211000000022022',
    }
    headers = {
        'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:109.0) Gecko/20100101 Firefox/112.0',
        'Accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,image/avif,image/webp,*/*;q=0.8',
        'Accept-Language': 'zh-CN,zh;q=0.8,zh-TW;q=0.7,zh-HK;q=0.5,en-US;q=0.3,en;q=0.2',
    }
    response = session.get(
        url,
        headers=headers,
        proxies=proxies,
        cookies=cookies,
        # params=params,
        timeout=10,
        allow_redirects=False
    )
    # html = response.text
    raw_data1 = re.findall(r"window\.rawData\s*=\s*(\{.+?\});", response.text, re.DOTALL)
    raw_data = json.loads(raw_data1[0])
    print(raw_data)

联系

全量数据 定制开发

感谢观看~

相关推荐
东方佑10 分钟前
利用Python自动化处理PPT样式与结构:从提取到生成
python·自动化·powerpoint
橘猫云计算机设计34 分钟前
基于springboot的考研成绩查询系统(源码+lw+部署文档+讲解),源码可白嫖!
java·spring boot·后端·python·考研·django·毕业设计
超级小的大杯柠檬水1 小时前
修改Anaconda中Jupyter Notebook默认工作路径的详细图文教程(Win 11)
ide·python·jupyter
2401_840192271 小时前
如何学习一门计算机技术
开发语言·git·python·devops
巷北夜未央1 小时前
Python每日一题(14)
开发语言·python·算法
Loving_enjoy1 小时前
基于Hadoop的明星社交媒体影响力数据挖掘平台:设计与实现
大数据·hadoop·数据挖掘
大模型真好玩1 小时前
理论+代码一文带你深入浅出MCP:人工智能大模型与外部世界交互的革命性突破
人工智能·python·mcp
呵呵哒( ̄▽ ̄)"2 小时前
线性代数:同解(1)
python·线性代数·机器学习
SweetCode2 小时前
裴蜀定理:整数解的奥秘
数据结构·python·线性代数·算法·机器学习
z_mazin2 小时前
JavaScript逆向魔法:Chrome开发者工具探秘之旅
javascript·chrome·爬虫