pytorch定义datase多次重复采样

有的时候训练需要对样本重复抽样为一个batch,可以按如下格式定义:

bash 复制代码
class TrainLoader(Dataset):
    def __init__(self, fns, repeat=1):
        super(TrainLoader, self).__init__()
        self.length = len(fns) # 数据数量
        self.repeat = repeat # 数据重复次数
    def __getitem__(self, idx):
        idx = idx % self.length 
    def __len__(self):
        return self.length * self.repeat           
相关推荐
用户03321266636713 小时前
使用 Python 设置 Excel 行列自适应 【代码示例】
python·excel
Dawson Zhu13 小时前
基于 OKF 知识图谱的 Text2SQL 领域知识注入实践——半导体晶圆厂数据资产知识库 MVP 剖析
人工智能·语言模型·架构·aigc·agi
宣宣猪的小花园.13 小时前
【机器学习】损失函数与梯度下降:机器如何通过“犯错”不断变好
人工智能·算法·机器学习
jsl_jsl_jsl13 小时前
《Agent 是怎么“思考”的:ReAct 循环与流式 SSE 的完整实现》
人工智能
sarasuki13 小时前
失败重试:Agent 中指数退避的正确姿势
人工智能·设计模式·agent
Ticnix13 小时前
RAG 的坑不在检索,在"对齐":pgvector 实战手记
python·agent·全栈
kyrie_sakura13 小时前
python学习笔记14 -- FastAPI
笔记·python·学习·fastapi
sxwuyanzu14 小时前
DeepSeek冲IPO-谁在为它付钱-公众号发布稿
大数据·人工智能·科技
一切皆是因缘际会14 小时前
科技的赋能
人工智能
甲维斯14 小时前
RSI“真“”来了,OpenAI和Anthropic把人类逼到墙角!
人工智能