《LangChain入门指南》学习笔记1:第1章 LangChain:开启大语言模型时代的钥匙

LangChain:开启大语言模型时代的钥匙

大语言模型(Large Language Model, LLM)概述

什么是LLM

  • 起源:基于Transformer架构,大规模神经网络程序
  • 核心:通用人工智能模型
  • 训练机制:"单字接龙"模式
  • 结果:获得语言智能

LLM的发展

  • 里程碑:ChatGPT (GPT-3.5) 发布
  • 当前顶峰:GPT-4
  • 全球主流模型
    • OpenAI: GPT-4
    • Anthropic: Claude 2
    • Meta: LLaMA 2 (开源)
    • Google: PaLM 2
  • 中国主流模型
    • 百度:文心一言
    • 阿里巴巴:通义千问
    • 华为:盘古大模型
    • 科大讯飞:星火

LLM的应用场景

  • 智能对话
  • 文本生成
  • 知识问答
  • 文本总结
  • 文本翻译
  • 情感分析
  • 数据分析
  • 编程辅助
  • 文档格式转换
  • 信息抽取

LLM的基础知识

GPT vs ChatGPT
  • GPT:模型 (Model)
  • ChatGPT:产品 (Product)
提示词(Prompt)
  • 定义:驱动模型的命令
  • 重要性:决定输出质量
  • 通用模板:角色-背景-任务-输出
  • 模板示例:
Token:大语言模型的基本单位
  • 定义:模型处理文本的基本单位
  • 功能:商用计费单位
  • 对比:不同于编程语言的字符
上下文长度(Context Length)
  • 定义:模型的"脑容量"
  • 示例:8K, 32K, 128K (GPT-4 Turbo)
  • 影响:成本与能力的权衡
幻觉
  • 现象:生成看似合理但偏离事实的预测
  • 根源:模式模仿而非真正理解
  • 案例:生成内容编造不存在的API、网址
微调(Fine-tune)
  • 比喻:基础训练 vs 赛前特训
  • 方式:通过API提供QA数据对
  • 目的:获得专属模型

LangChain与LLM

  • 诞生:2022年10月,Harrison Chase
  • 发展:从开源项目到估值2亿美元的初创公司
  • 定位:LLM应用的编程框架
  • 核心价值
    • 连接LLM、工具与数据
    • 弥补LLM短板

思维导图:

相关推荐
颜酱14 分钟前
LangChain LCEL Chain 零基础入门指南
langchain
nashane14 分钟前
HarmonyOS 6学习:JsCrash“闪退”法医指南——从FaultLog堆栈还原崩溃现场的终极手册
学习·华为·harmonyos
for_ever_love__16 分钟前
UI学习:UICollectionView瀑布流
学习·ui·ios·objective-c·cocoa
AOwhisky33 分钟前
MySQL 学习笔记(第六期):MySQL 备份与恢复
运维·数据库·笔记·学习·mysql·云计算
_李小白1 小时前
【android opencv学习笔记】Day 32:直线检测之霍夫变换
android·opencv·学习
华山沦贱1 小时前
open62541 V1.5.4版对C++ Builder支持的bug
笔记
稷下元歌2 小时前
七天学会plc 加机器视觉完整笔记:S7-1200 数据类型、存储区与寻址方式(I/Q/M/DB 详解)。
网络·数据库·笔记
颜酱2 小时前
LangChain调用向量模型,存入向量数据库
python·langchain
提子拌饭1332 小时前
Column 嵌套布局:多级 Column 实现复杂纵向结构——鸿蒙 HarmonyOS ArkTS 原生学习应用
学习·华为·harmonyos·鸿蒙·鸿蒙系统
逸模2 小时前
AI+BIM 重构连锁公装新范式 逸模打造数字化营建核心底座
大数据·人工智能·笔记·其他·信息可视化·重构