研一下学AI---(大语言模型篇)

本部分内容主要是一些大语言模型(LLM)的基础知识点,包括AI发展的历程,以及LLM的核心工作原理

AI----LLM(大语言模型)

AI产生智能的三个要点:模型,数据,算力(GPU),tranform为AI的大脑,利用复杂的神经网络进行训练

核心---Transform

单个神经元是怎么工作的,流程如下:

反向传播

训练模型------找出正确的权重参数------反向传播

大语言 模型------LLM

基础:语言转向量坐标

输出概率分布

大语言模型的应用(chatGPT)

GPT(Generative Pre-trained Transformer;基于Tranform的预训练生成式语言模型)是大语言模型;

chatGPT是基于CPT的一个对话产品,是大模型的应用

大模型服务

云服务

相关推荐
牧艺9 分钟前
DeepSeek Harness 上手:一切皆插件的 Agent 运行时,核心流程怎么走
llm·agent·deepseek
65岁退休Coder1 小时前
LangChain v1.3.4 笔记 - 08 MCP & 相关概念
后端·python·langchain
魔术师Grace1 小时前
模型“开源”了,就能直接拿来做 Agent 吗?
llm·aigc·agent
夫子3967 小时前
【第三部分:第一个 Agent 应用】10. 不使用框架,手写一个最小 Agent
llm·agent·ai编程
武子康7 小时前
模型分数涨了,它真的学会了吗?LittleLearner 拆开了三种可能
人工智能·llm·agent
前端 贾公子7 小时前
第08章:中间件(8)
langchain
要有锋芒_不要疯忙8 小时前
Transformer 是什么?--LLM知识(一)
llm
睡觉时不困4428 小时前
15.LangChain 1.0+ 第三篇:LangSmith——给 AI 应用装上监控台.发布清单
langchain
柒和远方8 小时前
V073:SDD 规范驱动开发:文档即代码,两次创造与 proposal/design/task 三份规范
llm·agent
武子康8 小时前
DeepSeek Harness:一次 Prompt 如何变成 Turn、Step 与工具事件
人工智能·llm·agent