token

SoStraw1 天前
sdk·p2p·入门·token·webrpc·opensession·senddata
从零接入 webrpc:按这份最小清单跑通双端,再写业务我是 webrpc 作者。SDK、Token 和开发文档在 https://webrpc.cn。选型看完了,下一步往往卡在同一处:我该按什么顺序写第一行代码?
kolyle2 天前
开发语言·人工智能·系统架构·token·qps·极智词元·大模型私有化部署
万级 QPS 下的 Token 分发系统架构:从 0 到 1 跑通 AI 时代的“水电煤“一、业务背景极智词元 Token 运营中心的目标,是在全国多地域建设一套可承载万级 QPS 的 Token 调度与分发系统,把"算力 + API 能力"封装成可按 Token 计量、可批量分发、可弹性扩容的标准化商品。
小七-七牛开发者3 天前
ai·agent·token·skill·周一上线
谷歌利用果蝇实现“AI 突围”?Cognition 再融 20 亿美元;AI 三巨头集体呼吁放慢脚步这期的「周一上线」,Agent 继续往更长的任务和更具体的工作里走。SWE-2 开始压缩 Agent 的无效探索,Muse 会自己在后台持续工作,DeepSeek V4.1-Flash 则继续从长上下文成本下手。
DsirNg5 天前
xss·csrf·token·cookie·refresh token·前端安全·登录态
登录后的那一个小时:把前端会话续期做成可收敛的控制面很多登录态问题,最初都表现得像一个很小的前端故障:页面突然跳回登录页、某个请求重复提交、一个标签页已经退出,另一个标签页却仍显示“已登录”。
飞塔老梅子5 天前
人工智能·ai·token·模型·codex
09. Codex 节省Token ❀ 老梅子学AI【简介】前面几天稍微操作一下Codex,额度就用完了。现在好不容易充值了,又担心象前面一样一下子用完,为了不用每次使用都小心翼翼,我们还是来了解一下要怎么节省Token。
梦想不只是梦与想11 天前
python·大模型·token
大模型系列(二):技术基础与核心能力大模型处理的是文本,但它的计算单元不是“字”,也不是“词”,而是 Token(词元)。Token 是模型处理文本的最小单元。它可以是:
知了一笑11 天前
人工智能·aigc·token
Token消费不为结果买单造AI的讲故事,用AI的看账单。2026年有个明显的趋势,大模型能力持续进化,人工智能的话题降温,AI用户吐槽Token太贵。
Sophnet云平台13 天前
大数据·人工智能·llm·制造·token·云平台
从 IT 自嗨到业务可用,制造企业 AI 平台的落地实践几十万投入把 AI 平台部署上线,IT团队测试全部跑通,结果销售、商务这些一线业务员工根本不会用,AI 项目变成IT部门自嗨。
DsirNg15 天前
oauth·xss·csrf·token·cookie·认证授权·web 安全
凭证不是登录态:从攻击面重做浏览器认证设计前端认证设计不应停留在“Cookie 和 Token 哪个更安全”。Cookie 是浏览器保存和自动发送数据的机制,Session ID、JWT、Access Token、Refresh Token 才可能是凭证;登录态则是服务端与客户端共同维护的认证上下文。
YoanAILab16 天前
语言模型·transformer·embedding·token·rag
大语言模型基础:Token、Embedding、Transformer、KV Cache 与 RAG理解大语言模型,可以先记住两条主线:大语言模型并不是直接以“汉字”或者“英文单词”为单位处理文本,而是先通过 Tokenizer(分词器) 将文本切分成一个个 Token。
小七-七牛开发者21 天前
ai·大模型·claude·token·工作流·skill·claudecode·ai coding
拆解 dsh 系列:从源码和版本变化看 DeepSeek Harness 的设计取舍DeepSeek Harness 发布才两周,但翻看它的 Git 历史,会发现它在第一个公开 rc 出现之前,其实就在内部打磨了两个月。
XLYcmy21 天前
pdf·llm·json·agent·token·csv·dify
PDF论文处理器 - 完整使用指南PDF论文处理器是一个专门为网安科研论文设计的PDF文本分割工具,旨在将英文论文PDF文件转化为Dify知识库可直接使用的高质量数据块。
guwentian21 天前
大模型·token·gguf
不用显卡也能跑大模型?GGUF 量化与 llama.cpp 本地推理实战📖 摘要:云端 API 有隐私、成本、限流三道坎,本地推理正成为 2026 年开源最热方向之一。本文用量化直觉讲清"4-bit 为什么质量不崩",并用纯 Python 跑通三件套:最小对话、GPU 卸载 + 流式输出、OpenAI 兼容 Server。附 VRAM 选型表与 4 条生产避坑,帮你半小时内把第一个本地模型用起来。
小七-七牛开发者22 天前
ai·大模型·agent·token·工作流·claudecode·ai coding
Agent 小知识 | Skill 的设计与生命周期:从工具接口到能力模块上一期我们聊了 Agent 的环境,承载文件、网页、进程和数据库等真实对象,工具则构成 Agent 的观察空间与行动空间。
yuyuyui23 天前
jwt·.net core·token·主动登出·会话撤销
DOTNET 鉴权系列- JWT 会话撤销与主动登出写这篇的主要原因是记录一下jwt无状态特点下的主动撤销和登出的解决方案,因为之前负责做过类似的用户相关的系统,对于这一块的方案和实现比较粗糙的,登录成功后,计算完整 JWT 字符串的 Hash,将tokenHash + userId存入Redis,每次鉴权时计算请求 Token 的 Hash,去存储中比对是否存在,这套方案虽然实现了登出撤销,但把所有有效 Token 全部落地存储,JWT 只剩下签名验签的能力,几乎退化成传统 Session 模式,丢失了 JWT 无状态的设计初衷。
a1879272183123 天前
深度学习·ai·transformer·token·注意力机制·deepseek·多层堆叠
从一条直线到大模型输出一个token(九):输出矩阵与多层堆叠建议先看:从一条直线到大模型输出一个token(八):残差连接与前馈网络上一篇走完了单个 Block 的六步。这一篇把 Block 复制 32 份串起来——不同层的 Block 各学什么,2024-2025 各家大模型到底堆了多少层,然后用 6 个 token 实地观察"浅→中→深"到底改了什么——这是理解"下一个 token 如何诞生"的关键一环。
小七-七牛开发者23 天前
ai·大模型·agent·token·工作流·claudecode·ai coding
拆解 DeepSeek Harness:Profile 与 Bundle 如何装配运行时前一篇讨论 Cordis 插件架构「解读 Cordis:dsh 一切皆插件背后的运行时设计」时,我们看到 dsh 把工具、模型适配器、会话、Agent Loop 等运行时能力拆成了插件。这样一来,运行时中的各个组件可以独立地完成注册、替换和退出。
小七-七牛开发者24 天前
ai·大模型·agent·token·工作流·claudecode·ai coding
61 亿次请求背后:LLM Serving 的 Cache 与调度难题随着 LLM 进入真实业务环境,LLM Serving 面临的问题正从单纯的单次推理加速,扩展到集群层面的资源调度与运行效率。一次请求的计算成本不仅取决于模型参数量,还受到输入输出 Token 长度、用户交互方式、上下文复用以及请求路由策略影响。
xiaokcehui25 天前
token
deepseek harness安装和使用入门1、安装 Node.js官网下载node-v24.19.0-x64.msi,并安装2、打开windows 的cmd命令窗口,输入