人工智能讲师AI讲师大模型讲师叶梓介绍及大语言模型技术原理与实践提纲

叶梓,上海交通大学计算机专业博士毕业,高级工程师。主研方向:数据挖掘、机器学习、人工智能。历任国内知名上市IT企业的AI技术总监、资深技术专家,市级行业大数据平台技术负责人。

长期负责城市信息化智能平台的建设工作,开展行业数据的智能化应用研发工作,牵头多个省级、市级行业智能化信息系统的建设,主持设计并搭建多个省级、市级行业大数据平台。参与国家级人工智能课题,牵头上海市级人工智能示范应用课题研究。

带领团队在相关行业领域研发多款人工智能创新产品,成功落地多项大数据、人工智能前沿项目,其中信息化智能平台项目曾荣获:"上海市信息技术优秀应用成果奖"。带领团队在参加国际NLP算法大赛,获得Top1%的成绩。参与国家级、省级大数据技术标准的制定,曾获省部级以上的科技创新一等奖。

大语言模型技术原理与实践

【课程简介】

本课程旨在通过实际案例展示ChatGPT、ChatGLM、Langchain等相关大语言模型的具体应用场景及实践技巧,从而帮助学习者深入了解和掌握大语言模型的概念和更广泛的应用,深入理解其工作方式,包括其基础知识、核心算法和实现方式,掌握其在各行业领域中的应用情况等。

该课程适合于对大语言模型技术感兴趣的学习者,从初学者到进阶者均可受益。经过本课程的学习,获得相关技术实战经验,通过一系列的实践案例提高利用大模型解决实际问题能力。

【课程时长】

3天(6小时/天)

【课程对象】

理工科本科及以上,且至少了解一门编程语言。

【课程大纲】(培训内容可根据客户需求调整)

|--------|------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------|
| Day1下午 | 强化学习基础 1. 马尔科夫奖励/决策过程 2. 状态行为值函数 3. Bellman方程 4. DP、MC、TD三者的关系 5. 策略梯度方法 6. 信赖域系方法背景 7. PPO方法 chatGPT 的原理介绍 1、指示学习与InstructGPT 2、相关数据集 3、有监督微调(SFT) 4、从人类反馈中RL的思路 5、奖励建模(RM) 6、运用PPO改进 |
| Day2上午 | ChatGLM 部署 1、ChatGLM3-6B介绍 2、ChatGLM3搭建流程 3、应用场景(工具调用、代码执行) 4、权重量化 ChatGLM3 原理 1、Code Interpreter 2、多模态CogVLM 3、WebGLM搜索增强 微调大模型 1、基于chatGLM的微调 2、LoRA 3、Prefix Tuning 4、P-Tuning 5、Prompt Tuning 6、freeze 7、构建训练数据集 |
| Day2下午 | 其他开源大模型 1、LLaMA系列 2、通义千问(qwen) 3、零一万物(Yi) llama-factory 微调大模型 1、工具的主要功能 2、支持的模型 3、数据集准备 4、微调策略(LoRA, QLoRA, PEFT) |
| Day3上午 | 学习LangChain所需的知识储备 1、词嵌入与语义空间 2、高维向量的快速模糊匹配 3、局部敏感哈希(LSH) 4、向量数据库 LangChain 的原理 1、大模型利用的难点与痛点 2、Langchain的基本思路 3、关键组件 |
| Day3下午 | LangChain 的实操 1、环境搭建 2、知识库向量化与存储 3、问句向量化与初步匹配 4、合成prompt(提示词) 5、提交给LLM生成答案 大语言模型的其他应用 1、kimi chat 2、coze 3、文心一格与通义万相 |

相关推荐
踩着两条虫几秒前
AI 驱动的 Vue3 应用开发平台 深入探究(二十五):API与参考之Renderer API 参考
前端·vue.js·人工智能
Predestination王瀞潞1 分钟前
1.1.1 AI->GB T 42755-2023数据集标注标准:GB T 42755-2023《人工智能 面向机器学习的数据标注规程》
人工智能·机器学习
乐迪信息3 分钟前
乐迪信息:AI防爆摄像机在智慧港口船舶监测中的技术优势
大数据·人工智能·安全·计算机视觉·目标跟踪
belldeep8 分钟前
python:spaCy 工业级 NLP 库
python·自然语言处理·nlp·spacy
合合技术团队9 分钟前
合合信息联合亚马逊云科技推出长文档智能处理方案,破解智能体规模化落地困局
大数据·人工智能·科技·文档解析
Mr.Cheng.12 分钟前
TOWARDS INTERPRETING VISUAL INFORMATIONPROCESSING IN VISION-LANGUAGE MODELS
人工智能·语言模型·自然语言处理
web3.088899916 分钟前
OpenClaw + 飞书打造 AI 电商选品系统,无缝对接三方数据服务商
人工智能·飞书
PHOSKEY17 分钟前
3D工业相机对AI/AR镜从扫描、标定、点胶到检测的全流程解析
人工智能·平面·3d·机器人·3d工业相机
彭祥.19 分钟前
基于计算机视觉的智能餐饮热量监测与结算系统设计与实现
人工智能·计算机视觉
放下华子我只抽RuiKe520 分钟前
文本处理与RNN:硬核实战笔记
人工智能·rnn·深度学习·神经网络·线性代数·机器学习·矩阵