技术栈
token
liangshanbo1215
15 小时前
token
面试题:AI 产品里,前端怎么降低 Token 消耗?
前端降低 Token 成本,核心就是少给模型传无效上下文。面试时先说这一句就够了。可以从几个方向展开:
xiangshangdemayi
15 小时前
ai
·
gis
·
教程
·
token
·
strata
·
自由
Strata教程:让GISer真正实现了token自由
这几天,一个新的推理框架 Strata 火了,能让消费级显卡(英伟达 30、40 系列)实现本地运行 Qwen3.8 Flash。看了 GitHub 上的介绍和很多人的测试,用 8G 显存和 32G 内存就能跑出不错的成绩,大概 50 tok/s。于是趁着假期,我也赶紧试了一下,这里记录一下。
网络毒刘
2 天前
人工智能
·
性能优化
·
token
·
cursor
Token 用量观测实战:从会话结构拆前缀/工具/生成,建立个人降本仪表盘
省 Token 的文章很多,教你砍 Rules、用 @、换模式。但若没有观测,你不知道哪一刀真有效——很容易陷入「这周换了模型,下周又觉得贵」的轮回。本文不重复四步省 Token 操作清单,而做一件更基础的事:把会话成本结构拆开,建成个人能坚持的降本仪表盘。
网络毒刘
5 天前
agent
·
token
·
cursor
·
成本
·
mcp
Token 账单的「隐形税」:系统提示、工具定义与历史滚动为何比生成贵
打开用量面板,很多人盯着「这次回答好长」。更值得盯的是:还没开始生成补丁,一轮对话已经叠了四层前缀——产品系统提示、项目 Rules、工具/MCP 定义、会话历史。它们像增值税:不一定出现在你意识里的「正文」里,却在每轮计费里反复出现。
算家云
7 天前
人工智能
·
api
·
token
·
算力租赁
·
算力平台
doubao-seed-2-1 系列模型上架算桥 API | 多模态理解能力继续加强!
现在,doubao-seed-2-1 系列模型已经上架算桥 API,欢迎前来体验。做 API 的人,大概都见过这种场面。模型把一句需求答得挺漂亮,接下来让它读几份材料、拆成待办、调用工具、拿结果回来核一遍,它就开始掉链子。回复能看,活却没往前走。项目里最费时间的,往往就是这段。
玩AI的奶茶
8 天前
人工智能
·
ai
·
gpu算力
·
token
·
算力租赁
配一次环境像装修一次房:哪些云 GPU 平台能把它留下来?
图注:保存环境的价值,是把重复安装依赖的时间还给项目本身。*直接回答:能保存已配置环境的云 GPU 平台有,但你要找的能力通常不叫“环境永存”,而叫保存镜像、保存快照、克隆实例或持久化系统盘。AutoDL 的官方文档明确写有“保存镜像”,矩池云也有“保存环境”说明;算家云帮助中心列出项目镜像、项目网盘和项目实例等相关入口。真正的难点不是找到按钮,而是搞清楚它究竟保存了什么、没保存什么。
ifenxi爱分析
10 天前
token
爱分析发布2026年Token市场海外对标研究报告
大模型普及带动推理需求快速爆发,Token推理服务商业价值持续凸显,第三方服务商已然成为AI算力生态的重要组成部分。
知无不研
16 天前
ai
·
agent
·
token
·
api接口
调用模型的API接口与Token详谈
如果说你和ai软件对话是软件界面为前端,作为和你交互的接口,大模型在云端负责处理你的需求,那么调用模型API接口就是程序与云端模型的对话
XLYcmy
17 天前
自然语言处理
·
prompt
·
embedding
·
token
·
cot
·
tokenization
·
上下文工程
大语言模型(LLM)核心技术梳理:从词元化到 RAG 的工程实践
Token(词元)是文本的基本单位。Tokenizer 的作用是把清洗后的文本字符串切分成有意义的基本单元序列,并构建词表(vocabulary)。例如句子 "I want a beer! Beer is cute!" 会被切分成 ["I", "want", "a", "beer", "!", "Beer", "is", "cute", "!"] 等 token,再映射为整数索引,形成训练数据。
szephyr
17 天前
鉴权
·
xss
·
csrf
·
jwt
·
token
前端鉴权实战:Token 存哪、怎么刷新、怎么防 XSS 与 CSRF
“localStorage 里存 token 有 XSS 风险,那放 cookie 就安全了”——错,CSRF 在等着。
csdn_aspnet
18 天前
.netcore
·
ip
·
token
·
签名
·
webapi
·
cors
·
sign
.NetCore Webapi 接口验证请求来源
目录1. 验证域名来源:CORS(跨域资源共享)2. 验证调用方身份:API Key / Token 认证
丿Wayne
18 天前
ios
·
swift
·
token
·
actor
·
swift并发
iOS Token 刷新实战(Actor 避免并发重复刷新)
在 iOS 项目中,Token 刷新最容易被低估的不是网络请求,而是并发状态。一个看似正常的实现通常是:请求收到 401,调用刷新接口,保存新 Token,然后重放原请求。单个请求时没有问题,但真实页面往往会在同一时刻加载用户信息、消息数量、配置和内容列表。Access Token 一旦过期,这些请求可能同时返回 401,随后发生:
花北城
19 天前
c#
·
鉴权
·
token
·
授权
【C#底层库】access_token授权鉴权验证
C#底层库–万能进制转换器(自定义有序字符,支持任意进制) 本文链接:https://blog.csdn.net/youcheng_ge/article/details/130444724
七夜zippoe
19 天前
ai
·
agent
·
token
·
上下文压缩
·
分层记忆
Agent 上下文工程:Token 管理、上下文压缩与分层记忆设计
摘要:上下文工程是 AI Agent 工程化落地中最容易被忽视、却最致命的核心环节。本文系统性地讨论了 Agent 运行时的 Token 预算管理、上下文压缩策略(摘要压缩、LRU 裁剪、选择性保留)、分层上下文设计(系统层/任务层/对话层/工具层),以及上下文窗口溢出的分级响应机制。通过一个完整的上下文管理器实现,展示如何在生产环境中将有限的上下文窗口利用到极致。适用于使用 LangChain、LlamaIndex 或原生 OpenAI API 构建 Agent 系统的中高级工程师。
九章云极DataCanvas
20 天前
人工智能
·
开源
·
token
·
九章智算云
让大模型少做重复计算 九章云极开源分布式KV Cache系统DingoCache
近日,九章云极DataCanvas自主研发的九章智算云平台Alaya NeW Cloud宣布开源分布式KV Cache 系统DingoCache(项目名 dfkv)。该系统将大模型的KV Cache从单个推理实例扩展到共享存储池,使兼容的请求能够复用已有计算结果,从而减少长上下文与多轮交互场景中的重复Prefill。项目采用Apache 2.0许可开放,支持免费商用、修改与再分发。
SoStraw
21 天前
sdk
·
p2p
·
入门
·
token
·
webrpc
·
opensession
·
senddata
从零接入 webrpc:按这份最小清单跑通双端,再写业务
我是 webrpc 作者。SDK、Token 和开发文档在 https://webrpc.cn。选型看完了,下一步往往卡在同一处:我该按什么顺序写第一行代码?
kolyle
22 天前
开发语言
·
人工智能
·
系统架构
·
token
·
qps
·
极智词元
·
大模型私有化部署
万级 QPS 下的 Token 分发系统架构:从 0 到 1 跑通 AI 时代的“水电煤“
一、业务背景极智词元 Token 运营中心的目标,是在全国多地域建设一套可承载万级 QPS 的 Token 调度与分发系统,把"算力 + API 能力"封装成可按 Token 计量、可批量分发、可弹性扩容的标准化商品。
小七-七牛开发者
23 天前
ai
·
agent
·
token
·
skill
·
周一上线
谷歌利用果蝇实现“AI 突围”?Cognition 再融 20 亿美元;AI 三巨头集体呼吁放慢脚步
这期的「周一上线」,Agent 继续往更长的任务和更具体的工作里走。SWE-2 开始压缩 Agent 的无效探索,Muse 会自己在后台持续工作,DeepSeek V4.1-Flash 则继续从长上下文成本下手。
DsirNg
25 天前
xss
·
csrf
·
token
·
cookie
·
refresh token
·
前端安全
·
登录态
登录后的那一个小时:把前端会话续期做成可收敛的控制面
很多登录态问题,最初都表现得像一个很小的前端故障:页面突然跳回登录页、某个请求重复提交、一个标签页已经退出,另一个标签页却仍显示“已登录”。
飞塔老梅子
1 个月前
人工智能
·
ai
·
token
·
模型
·
codex
09. Codex 节省Token ❀ 老梅子学AI
【简介】前面几天稍微操作一下Codex,额度就用完了。现在好不容易充值了,又担心象前面一样一下子用完,为了不用每次使用都小心翼翼,我们还是来了解一下要怎么节省Token。