API Error: Claude‘s response exceeded the 128000 output token maximu

windows环境使用claude code遇到报错:API Error: Claude's response exceeded the 128000 output token maximu

方案 1:强制在当前会话中设置变量再启动(最直接)

在你当前的 CMD 窗口里,直接用 set 命令临时覆盖变量,再启动 Claude Code,确保它读取的是你设置的值:

bash 复制代码
:: 先在当前会话里设置变量
set CLAUDE_CODE_MAX_OUTPUT_TOKENS=2560000

:: 再启动 Claude Code
claude

以后每次启动前执行这两行即可。

然而执行方案一后还是报同样的错。

既然客户端硬锁死 128000 token 输出上限 ,改不动,那就不让它输出那么长

只需要在提问结尾加一句话:

plaintext

复制代码
请控制输出长度,每次返回不超过 100000 token,不要一次性输出全部内容。

或者直接用分段生成指令(绝对不会报错)

第 1 次:生成大纲

plaintext

复制代码
分步执行,帮我生成一份高阶人工智能通识研究报告的大纲,方案设计型。

实际我输入这句话后,后面自动执行其他的部分了

第 2 次:生成第 1 章

plaintext

复制代码
根据大纲,写第一章 引言,不要输出其他内容。

第 3 次:生成第 2 章

plaintext

复制代码
写第二章 研究现状,不要输出其他内容。

第 4 次:生成第 3 章(核心方案)

plaintext

复制代码
写第三章 研究内容与方案设计,不要输出其他内容。

第 5 次:生成第 4 章

plaintext

复制代码
写第四章 挑战与展望,不要输出其他内容。

第 6 次:生成结论

plaintext

复制代码
写结论与参考文献。
相关推荐
chuan.bai1 小时前
Java RAG 实战(第 11 篇):RAG 知识工作台网页
java·开发语言·人工智能
fthux4 小时前
招聘季实测:我用 TraeWork 搭了一套 AI 简历初筛系统
人工智能·ai编程·trae
SLD_Allen4 小时前
NVIDIA KAI Scheduler深度解析——Kubernetes原生AI调度器的架构、原理与实践
人工智能·架构·kubernetes
小玮看世界4 小时前
从“画图”到“Mermaid”:AI语义理解与架构绘制的演进之路
人工智能·深度学习·计算机视觉
小岐AI观5 小时前
智赋岐黄适合养生馆吗?
大数据·人工智能·物联网
YOLO数据集集合5 小时前
煤炭物料检测数据集:基于YOLO26的矿山传送带智能“哨兵”
人工智能·yolo·数据挖掘·煤炭·煤炭检测·矿山传送带·传送带异物
深小乐5 小时前
DeepSeek Harness 强是真的强,普通用户可以再等等
人工智能