腾讯云 emr 无法以cosn 写入云存储

pyspark 中使用 df.write.parquet("cosn://bucketname/file")

报错 unable to verify integrity of data upload. Client calculate content hash didn't match hash etag xxxxx calculate by cos

根因:腾讯云cos开了桶加密,所以两边hash计算结果不同。

解决方法:spark侧,添加参数:fs.cosn.server-side-encryption.algorithm 写入算法名字

或者关闭桶加密(应该不会选这个吧)

试过的其他办法:

spark参数设置关闭md5验证,但都行不通

相关推荐
用户3610588626121 天前
SparkStreaming 之配置参数详解
大数据·spark
用户3610588626121 天前
SparkStreaming 之 Direct 模式并行度设置与 offset 管理
大数据·spark
BYSJMG1 天前
计算机毕业设计选题推荐|【基于大数据的植被光谱特征与环境因子关联分析及可视化】Spark+K-Means
大数据·python·信息可视化·数据分析·spark·kmeans·课程设计
阿里云大数据AI技术2 天前
EMR Serverless Spark多模态 Daft 算子市场免费公测 | 10分钟极速实战(附视频教程)
人工智能·spark
IT研究室2 天前
最新大数据毕业设计选题推荐-基于大数据的京东商品销售分析与可视化的设计与实现-大数据-Spark-Hadoop-Bigdata
大数据·spark·课程设计
用户3610588626123 天前
SparkStreaming 之 Driver HA 原理及搭建实操
大数据·spark
腾讯云大数据3 天前
AI Native数据湖的Spark+Ray一体化实践
大数据·人工智能·spark·腾讯云·腾讯云大数据
weixin_307779133 天前
Databricks里用PySpark统计指定表和字段中各字段的空值、空字符串或零值比例
运维·数据仓库·python·spark·云计算
用户3610588626124 天前
SparkStreaming 之 updateStateByKey 算子详解及代码实现
大数据·spark