【笔记】从零开始大模型开发与微调:基于PyTorch与ChatGLM

从零开始大模型开发与微调:基于PyTorch与ChatGLM

2023.11.1版

介绍DL应用、大模型,ChatGLM

由清华大学自主研发,基于 General Language Model (GLM) 架构的一种最新型、最为强大的深度学习大模型。

1、经过约 1T 标识符的中英双语训练,辅以监督微调、对比学习、人类反馈强化学习等技术的加持

2、针对中文问答和对话进行了优化

3、开源的ChatGLM-6B 具有 62 亿参数。结合模型量化技术,用户可以在消费级的显卡上进行本地部署(INT4 量化级别下最低只需 6GB 显存)

相关推荐
高工智能汽车19 小时前
东土科技李平:神经系统是机器人灵魂的载体
人工智能
天远Date Lab19 小时前
零信任架构实战:基于天远行驶证核查构建自动化车队准入网关
运维·人工智能·架构·自动化
wujian831119 小时前
AI手机版怎么直接生成word?用“AI 导出鸭”把碎片时间变成专业文档
人工智能·ai·chatgpt·智能手机·word·ai导出鸭
小酒星小杜19 小时前
不会画画,也能把故事做成漫画吗?先做这场测试
人工智能·产品·全栈
GGMM78919 小时前
富士 EP‑3955D 变频器主板维修调试笔记
笔记·变频器·变频器维修
二进制_博客19 小时前
rag面试题之多轮对话时的上下文依赖检索设计
人工智能·机器学习
名不经传的养虾人20 小时前
从0到1:企业级AI项目迭代日记 Vol.90|Agent变快了,Judge定下来了
大数据·数据库·人工智能·ai编程·企业ai
今儿敲了吗20 小时前
CN——网络层(上)
网络·笔记
benchmark_cc20 小时前
批量获取量化数据时,如何设置合理的超时和重试机制?——QuantDash 高性能实战指南
开发语言·人工智能·python·pandas·量化·quantdash
Geek-Chow20 小时前
06 训练管线:数据如何变成权重
人工智能·算法