大模型学习day6

一、单轮对话 vs 多轮对话

  1. 单轮对话 一问一答,不记历史。每次请求都是独立的,大模型不知道上一句聊了啥。适合:简单一次性提问、查单个知识点。

  2. 多轮对话 会记住上下文 ,需要把所有历史聊天记录一起传给大模型。模型能连贯接话、顺着之前的话题聊。适合:AI 聊天助手、智能客服、连续写代码改需求。

二、什么是上下文窗口(Context Window)

一句话:大模型一次能装下、能记住的最大文字总量。

  • 上下文窗口越大:能读长文档、记很多聊天记录
  • 上下文窗口越小:聊几句就忘、不能处理长文章常见规格:4K、8K、32K、128K(K 代表千 token)

三、输入 Token / 输出 Token

  • 输入 Token:你发给大模型的文字(提问 + 历史对话)
  • 输出 Token :大模型给你回复的文字在线 API 调用时,输入、输出两边都计费。

四、流式输出 vs 一次性输出

  1. 一次性输出 等模型全部思考完,整段文字一次性发回来,要等待,像普通网页加载完才显示内容。

  2. 流式输出(SSE 流式) 一个字一个字实时往外蹦,像你用豆包打字那种逐字出现效果。前端对接用 SSE 协议,体验更丝滑,不用长时间等待。

五、Prompt 提示词 基础概念

Prompt 就是你发给大模型的指令、提问、要求 。同样的模型,Prompt 写得越好,答案越准。好提示词三要素:

  1. 给身份(你是资深前端工程师)
  2. 给要求(简洁、带注释、用 Vue3)
  3. 给任务(帮我写一个登录页面代码)

六、今日必背总结

  1. 单轮无记忆,多轮带历史上下文。
  2. 上下文窗口:模型能容纳的最大 token 容量。
  3. 输入、输出 Token 都要计费。
  4. 流式输出逐字展示,一次性输出整段返回。
  5. Prompt 就是给大模型的指令,写得好答案质量翻倍。
相关推荐
m4Rk_2 小时前
【论文阅读】Agent 记忆机制(83):Inside Out——用可演化 PersonaTree 构建 Agent 的核心长期记忆
论文阅读·人工智能·学习·开源·github
段一凡-华北理工大学3 小时前
大模型应用开发 100 天:Python + LLM 从入门到精通 day26~Prompt 调试与优化——A/B 测试与效果评估
windows·python·大模型·prompt·智能体·提示词工程·高炉智能化
鬓戈3 小时前
Rust 语言与 AI 应用生态调研及学习路径
人工智能·学习·rust
传奇开心果编程3 小时前
【SwiftUI娓娓道来】第3课:让界面活起来——交互与动画指南
学习·macos·ui·ios·swiftui·swift
xian_wwq4 小时前
【学习笔记】等保合规安全基线核查实战
笔记·学习
白萝卜弟弟4 小时前
【大模型Qwen3.8 27B】llama.cpp 本地大模型部署与使用
ai·大模型·agent·llama·qwen3.8
传奇开心果编程4 小时前
【Jetpack Compose进阶学与练】第14课:系列收尾复习总结;Compose项目常见坑点汇总;学习路线与后续学习方向
android·学习·ui·kotlin·android jetpack
yangmu32035 小时前
发动机是怎么把油变成动力的:四冲程内燃机原理拆解
学习
m4Rk_5 小时前
【论文阅读】Agent 记忆机制(81):EMR——用情景记忆避免 Agent 在多步推理中反复绕圈
论文阅读·人工智能·学习·开源·github
海海不掉头发5 小时前
阶段五_实验34-38_学习总结
深度学习·神经网络·学习·机器学习