safetensor存取pytorch模型参数、玄数据简例

safetensors [1] 号称提供一种更安全的存数据方式,支持多种框架,见 [2]。不过在处理玄数据(metadata)时:

  • 只支持 Dict[str, str] 的形式,即值必须是字符串,而不能是 int、float 或嵌套 dict,而这些在 PyTorch 原先的 torch.save、torch.load 是支持的。考虑用 json.dumps 将 dict 转写成字符串,读时则用 json.loads 恢复回 dict。
  • 没有专门从 checkpoint 文件读出 metadata 的方法。考虑采用 [3] 中 Ok_Storage_1799 的回答所讲利用 safetensors.safe_open 的方法读 metadata。

下面是存、取 PyTorch 模型参数、metadata 的简例:

python 复制代码
import time, json, pprint
import torch
from safetensors import safe_open # to read metadata
from safetensors.torch import save_model, load_model

print("建模型")
model = torch.nn.Linear(2, 3)
# 初始参数值
for pn, p in model.named_parameters():
    print(pn, p)


print("存模型、metadata")
# 将模型参数置零 (模拟 training)
for p in model.parameters():
    p.data.zero_()
# 存模型
save_model(
    model,
    "ckpt.safetensors",
    # metadata 用 json 转写成 str
    {"metadata": json.dumps({
        "time": time.asctime(),
        "epoch": 57,
        "acc": 0.56,
        "args": {
            "debug": False,
            "dataset": "MNIST",
            "decay_steps": [10, 20]
        }
    })}
)


print("读模型")
load_model(model, "ckpt.safetensors")
# 验证更新(置零)后参数值
for pn, p in model.named_parameters():
    print(pn, p)


print("读 metadata")
with safe_open("ckpt.safetensors", framework="pt") as f:
    print(type(f), dir(f))
    print(list(f.keys())) # 模型参数的名字
    print(type(f.metadata())) # dict
    for k, v in f.metadata().items():
        print(k, v)
        # 用 json 恢复 metadata 成 dict
        if "metadata" == k:
            metadata = json.loads(v)

    pprint.pprint(metadata)

References

  1. huggingface/safetensors
  2. Python documentation
  3. How to get metadata from a safetensor file?
相关推荐
程序媛徐师姐16 小时前
Python基于爬虫的网络小说数据分析系统【附源码、文档说明】
爬虫·python·python爬虫·网络小说数据分析系统·pytho网络小说数据分析系统·python爬虫网络小说·python爬虫的网络小说数据
清水白石00817 小时前
深入解析 LRU 缓存:从 `@lru_cache` 到手动实现的完整指南
java·python·spring·缓存
林开落L17 小时前
从入门到了解:Protobuf、JSON、XML 核心解析(C++ 示例)
xml·c++·json·protobuffer·结构化数据序列化机制
JaydenAI17 小时前
[LangChain之链]LangChain的Chain——由Runnable构建的管道
python·langchain
kali-Myon17 小时前
2025春秋杯网络安全联赛冬季赛-day3
python·安全·web安全·ai·php·web·ctf
AbsoluteLogic17 小时前
Python——彻底明白Super() 该如何使用
python
小猪咪piggy17 小时前
【Python】(4) 列表和元组
开发语言·python
墨理学AI17 小时前
一文学会一点python数据分析-小白原地进阶(mysql 安装 - mysql - python 数据分析 - 学习阶段梳理)
python·mysql·数据分析
数研小生17 小时前
亚马逊商品列表API详解
前端·数据库·python·pandas
独好紫罗兰17 小时前
对python的再认识-基于数据结构进行-a005-元组-CRUD
开发语言·数据结构·python