【temu】分析拼多多跨境电商Temu数据分析数据采集

Temu是拼多多旗下跨境电商平台,于2022年9月1日在美国、加拿大、新加坡、中国台湾、中国香港等市场上线。本文作者从销售额、销量、产品分布等方面,对Temu产品进行了分析,一起来看一下吧。

py 复制代码
item_get获得商品详情

item_review获得商品评论列表

item_search按关键字搜索商品

请求地址: http://wechat:17610352720.cn

数据采集

采集的字段包括:商品名、商品id、原价、现价、一级分类、二级分类、店铺id、销量等;

上图是监控的temu数据中月销售额Top10的产品

数据用途:

  • 量化分析
  • 投资分析
  • 跨境电商选品分析
  • 练手学习

上图为temu单品销量Top10,由于销量最大显示10万+,所以该统计意义不大。

py 复制代码
def send_request(url):
    proxy = ProxyClient.random_ip()
    session = requests.Session()
    proxies = {
        "http": f"http://{proxy}",
        "https": f"http://{proxy}"
    }
    cookies = {
        'region': '211',
        'language': 'en',
        'currency': 'USD',
        'timezone': 'Asia%2FShanghai',
        'shipping_city': '211%2C211000000022022',
    }
    headers = {
        'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:109.0) Gecko/20100101 Firefox/112.0',
        'Accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,image/avif,image/webp,*/*;q=0.8',
        'Accept-Language': 'zh-CN,zh;q=0.8,zh-TW;q=0.7,zh-HK;q=0.5,en-US;q=0.3,en;q=0.2',
    }
    response = session.get(
        url,
        headers=headers,
        proxies=proxies,
        cookies=cookies,
        # params=params,
        timeout=10,
        allow_redirects=False
    )
    # html = response.text
    raw_data1 = re.findall(r"window\.rawData\s*=\s*(\{.+?\});", response.text, re.DOTALL)
    raw_data = json.loads(raw_data1[0])
    print(raw_data)

联系

全量数据 定制开发

感谢观看~

相关推荐
杨运交1 小时前
[030][Web模块]Spring Boot 验证与 OpenAPI 集成实战:从校验规则到文档生成
前端·spring boot·python
培培说证2 小时前
2026财务岗位如何快速提升自身能力
python
努力攻坚操作系统2 小时前
编程语言编译运行机制对比:C / Java / Python
java·c语言·python
深蓝电商API2 小时前
Playwright深入浅出:从入门到企业级项目实战
爬虫·playwright
godspeed_lucip2 小时前
LLM和Agent——专题6:Multi Agent 入门(5)
人工智能·python
小白学大数据3 小时前
爬虫性能天花板:asyncio赋能 Aiohttp,并发提速 10 倍
开发语言·爬虫·数据分析
Metaphor6923 小时前
使用 Python 给 PDF 设置背景色或背景图
数据库·python·pdf
郝亚军3 小时前
如何让pycharm-2026.1.2顶部菜单栏固定显示在最上端
python
怪兽学LLM3 小时前
LeetCode 438 找到字符串中所有字母异位词(Python 固定滑动窗口+字符计数解法)
python·算法·leetcode