【第十二届“泰迪杯”数据挖掘挑战赛】【2024泰迪杯】B题基于多模态特征融合的图像文本检索—更新(正式比赛)

【第十二届"泰迪杯"数据挖掘挑战赛】【2024泰迪杯】B题基于多模态特征融合的图像文本检索---更新(正式比赛)

往期链接:

【第十二届"泰迪杯"数据挖掘挑战赛】【2024泰迪杯】B题基于多模态特征融合的图像文本检索---解题全流程(持续更新)
【第十二届"泰迪杯"数据挖掘挑战赛】【2024泰迪杯】B题基于多模态特征融合的图像文本检索---解题全流程(论文更新)

全家桶更新内容:

全部代码,制作数据、训练权重,结果,视频:

其中,LXS文件夹,代表所有的jupyter代码以及Chinese clip模型代码,基于服务器就可以直接运行,(找我分享服务器镜像,不用再配置环境了)

视频为边做边录制,全程记录训练预测、验证过程。

全家桶获取

复制代码
可以微信:zgr421136咨询 (微信优惠-5)
可以QQ交流群:458351399

可以直接爱发电平台:
https://afdian.net/item/8cc7f3dae8d111eeb7b05254001e7c00

良心制作,质量保证,售后解答。

单品一:

单品一包含全套代码(找我分享服务器镜像,无需配置环境,一键运行),教程视频,训练的权重与提交结果

获取链接:

复制代码
https://afdian.net/item/e579256ceead11ee9b7352540025c377

单品二:

单品二包含需要提交结果(28号的提交测试结果csv也会更新)与完结论文

获取链接:

复制代码
https://afdian.net/item/4a9d076aeeae11ee908b52540025c377

训练、预测展示:

训练,

(基于小的base16,预训练权重模型训练的,4w条为训练集,1w条为验证集)

只训练了44轮,一轮训练花费15分钟,显存只占6GB左右。

预测结果:

说明:这是训练了44轮,验证效果不算太理想的第一版模型的预测结果。

(对问题二,文本预测检索图片,问题三,图片预测检索文本的部分结果展示),此时验证集的召回验证recall@k5值为60。

图片检索文本结果部分展示:


后续计划:

今晚将进行选择最大最全面的中文预训练模型,对正式数据再进行训练(很费时间,很费资源。本地电脑是一定搞不了的,或服务器或者学校实验室服务器。)

  1. 选择最大预训练权重文件进行训练
  2. 训练50轮
  3. 论文编写改进方向优化指导.txt

第二版更新将直接上传售后群qq文件夹里,以及百度网盘链接的方式。

相关推荐
海森大数据7 分钟前
Crawl4AI:打破数据孤岛,开启大语言模型的实时智能新时代
人工智能·语言模型·自然语言处理
果冻人工智能13 分钟前
我在大厂做 机器学习工程经理:这六顶帽子,每天都在换
人工智能
人大博士的交易之路36 分钟前
龙虎榜——20250422
大数据·数学建模·数据挖掘·缠论·缠中说禅·涨停回马枪·龙虎榜
萧鼎43 分钟前
RAGFlow:构建高效检索增强生成流程的技术解析
人工智能·python
爱的叹息1 小时前
主流开源 LLM 应用开发平台详解
人工智能·开源
赋范大模型技术社区1 小时前
从0手撕代码搭建MCP Client与Server!详解DeepSeek、ollama、vLLM接入MCP实战!
人工智能·mcp
Baihai_IDP1 小时前
面对开源大模型浪潮,基础模型公司如何持续盈利?
人工智能·openai·deepseek
陈明勇1 小时前
MCP 实战:用 Go 语言开发一个查询 IP 信息的 MCP 服务器
人工智能·后端·mcp
浏览器爱好者1 小时前
如何下载适用于语音识别功能增强的Google Chrome浏览器
人工智能·chrome·语音识别
孔令飞2 小时前
彻底学会 gRPC:用 Go 实现一个迷你考试服务
人工智能·云原生·go