对于extend和append无法解决的字典解析情况

python 复制代码
# 问题根源:json.load() 出来的数据可能是列表、字典、字符串等不同类型
# 单纯用 extend 或 append 都无法正确处理所有情况

# 错误示例1:只用 extend
# conversations.extend(data)
# 问题:data 是字典时会报错 TypeError,data 是字符串时会被拆成字符

# 错误示例2:只用 append  
# conversations.append(data)
# 问题:data 是列表时会把整个列表作为一个元素嵌套进去,不是想要的扁平结构

# 错误示例3:遍历添加
# for item in data:
#     conversations.append(item)
# 问题:data 是字符串时遍历得到的是单个字符


# extend()	将可迭代对象(列表、字符串、元组等)的每个元素逐个加入原列表
# append()	将参数作为一个整体加入原列表
# isinstance(data, list)	判断 data 是不是列表类型
# isinstance(data, dict)	判断 data 是不是字典类型
# .get()	字典的方法,用于安全地获取键对应的值(不存在时返回默认值)

# 正确方式
# 情况1:data是列表 -> 遍历每个元素
if isinstance(data, list):
    conversations.extend(data)
# 情况2:data 是字典 -> 直接添加
elif isinstance(data, dict):
    conversations.append(data)

# 正确处理方式:先判断类型
with zipfile.ZipFile(ZIP_FILE, 'r') as zf:
    for filename in zf.namelist():
        if filename.endswith('.json'):
            data = json.load(zf.open(filename))
            
            if isinstance(data, list):
                conversations.extend(data)      # 列表直接展开
            elif isinstance(data, dict):
                conversations.append(data)      # 字典整体添加
            else:
                # 字符串或其他类型,按需求处理或跳过
                print(f"跳过 {filename},类型为 {type(data)}")
                continue

后面处理时也要判断:

python 复制代码
for conv in conversations:
    if isinstance(conv, dict):
        title = conv.get('title', 'untitled')
        # 正常处理
    else:
        print(f"跳过非字典数据: {conv}")
相关推荐
华研前沿标杆游学几秒前
企业参访入口 | 走进华为坂田基地,深圳华为坂田基地考察游学参访
python
朝朝辞暮i38 分钟前
VLA 系统学习第 12 课:为什么机器人不能只看一帧?——时间序列、Observation History 与 Action Chunk
人工智能·python·深度学习·神经网络·vla
朝朝辞暮i41 分钟前
VLA 系统学习第 8 课:Optimizer 到底在干什么?——从 Learning Rate 到 SGD、Momentum 和 Adam
人工智能·python·深度学习·神经网络·vla
镜子AI44 分钟前
教培机构多模态内容跨模态检索系统:基于CLIP的统一表征与图文混合召回算法
人工智能·python·算法·机器学习
落魄大学生之流水线上谋生计1 小时前
Selenium 入门到实战:用 Python 写出稳定的浏览器自动化
python·selenium·自动化
汤米粥1 小时前
后端开发主流技术方案
java·python·golang·php·nodejs·后端开发
我的xiaodoujiao1 小时前
Django 基础知识详细图文教程 13-Django 模型定义与使用 3
数据库·后端·python·测试工具·oracle·django
小静AI工程实验室1 小时前
robots.txt 不是门禁:RFC 9309 规则、缓存与 Python 爬虫的 10 个边界
爬虫·python·缓存
沉下心来学鲁班1 小时前
DeepAgents 记忆机制:让 AI Agent 拥有“跨对话“的记忆
服务器·人工智能·python