在AI编程略有起色的今天 越来越多人涌入其中
不过 氛围感编程是拿token和request堆出来的
想要VibeCoding的码农们 想写瑟琴小说的网络推子们 想要做AI生图 AI生视频的自媒体<--后两个本文不涉及 都在网上疯狂地翻着"无限制AI api""Free Claude api" 在各种第三方网站薅token
在这里 我们不讲一些大道理 简单来分析一下
第三方代理网站
对于现在的网站乱象 可以简单概括为以下几个类别
"公益免费"API网站
1)真·免费
这类网站极少 但确实存在
通常是个人开发者或小团队 手里有从openrouter等平台买的token 调来几个接口 没有广告 没有强制付费 没有套路 你注册就能用 用完拉倒 常见的有很多NewAPI内核的网站
特点 额度也许有无限 但是 速度极慢 特别是在视频平台曝光的 千万不要充所谓的PLUS PRO 随时会关 一些负责的站长才会经常维护 更不用说那些用cloudflare上土豆服务器的站主了 维护的时间比开的时间长 并且重启服务器又要重置api令牌 开模型通道 速度极慢
这类站点的命运通常是------被薅秃 然后关停 因为当一个免费资源被公开 它的消耗速度会远超供给者的预期
对于一些不更新网站内核的 开始吟唱(以下为NewAPI)
已公开的 CVE 漏洞
CVE 影响版本 说明 CVE-2026-32879 v0.10.0+ Passkey 验证绕过,无需 WebAuthn 断言即可通过安全验证 CVE-2026-42339 ≤ v0.11.9-alpha.1 SSRF --- 使用 0.0.0.0绕过私网 IP 过滤CVE-2025-62155 < v0.9.6 SSRF 绕过 --- 302 重定向绕过安全限制 CVE-2026-33655 < v0.12.0-alpha.1 SSRF --- 默认配置不检查域名解析后的 IP
如果你遇到了 请珍惜 但也别依赖
2)钓鱼网站
我遇到的就有3个了 甚至一个明目张胆的在前端跑挖矿脚本
和上文一样 不要买所谓的PRO PLUS资格 还有很重要的一点 这种网站你能用 但你完全不知道后台跑的是不是你选的模型 可能你选的Claude 结果给你在后台跑豆包(夸张说法)稍微轻一点的 通过逆向 把 Antigravity 客户端里免费/付费的模型能力"代理"出来 伪装成标准的 API 接口 或者给一个有额度的账号分发出去 就算给你用的模型一样 也会是细狗版本的
什么叫细狗版本 上下文给你砍半 输出长度给你截断 思考链直接给你关了 你问它一个复杂点的代码逻辑 它回你一段不知道从哪拼来的placeholder 你再问它为什么 它说"我是AI语言模型 我还在学习中" 你花十分钟写好的prompt 喂进去 出来一坨 你都不知道是该怪模型还是怪自己
3)正常的网站
openrouter nanobanana这一类的 运行多年 能力强 但是 还是不适合预算低的我们
拿前者来说 有时候提供的满血版claude甚至价格是原版的1.2倍
好处是稳定 透明 不跑路 坏处是钱包疼 你问得越多 烧得越快 一个中等规模的VibeCoding项目 几十上百美元的API费用跟喝水一样就没了 对于个人开发者来说 这笔账你得算清楚 不是不能花 是花了之后你的项目能不能赚回来
现在冒出来的新变种 账号池反向代理
最近又多了一种玩法
搭建者不买Token 而是批量注册官方订阅账号 Claude Pro ChatGPT Plus 然后把账号的会话能力通过反向代理转成API格式对外提供
听起来很聪明是吧
问题在于 官方订阅账号有频率限制 有并发限制 有上下文窗口限制 一个Pro账号的额度分给几十上百个人用 每个人分到的是稀释再稀释的细狗版
而且官方风控不是吃素的 频繁切换IP 异常调用模式 短时间内大量请求 封号只是时间问题 封了怎么办 再注册一批 注册不了了怎么办 跑路
所以你用着用着突然断开 不是你的网络问题 是号池被端了 你前一天还在上面跑着自动化脚本 第二天打开 502 站长群里说了一句"被官方批量ban了 恢复时间未知" 然后就再也没有然后了
还有一个事 可能说了也白说
不要在免费API里传敏感信息
很多免费API站点 后台连基本的日志脱敏都没有 这个多严重呢 对于码农们 调用甚至会丢企业内部数据你却一点不知道
你传的代码 你写的小说草稿 你问的业务逻辑 全部明文存储在某个你完全不知道的数据库里 这些数据被拿去做什么 没人知道 可能是用来训练模型 可能是打包卖给数据商 也可能只是站长自己留着看
但你要清楚一件事 免费的东西 代价通常不在付款页面上
为什么非要跟Claude和GPT过不去
聊到这里 你可能会问 第三方网站这么多坑 为什么大家还是挤破头往里冲
答案很简单 Claude和GPT这两个系列的编程能力 目前确实没有对手能平替
Claude opus 4-8 fable 5的代码生成质量 上下文理解 上下文长度 推理深度 在复杂项目里表现出的稳定性 目前开源的模型追不上 其他商业模型也追不上
GPT系列也是一样 从代码补全到架构设计 从debug到重构 它的泛化能力和响应精度 在一线开发场景里依然是标杆
这个经常用就知道了 claude code无比好用 Ultra Code!!
你让一个开源模型写个Python脚本 问题不大 你让它搭一个完整的前后端项目 处理复杂的业务逻辑 处理各种边界条件和异常情况 差距就出来了
所以所有人都在抢Claude和GPT的API 不是因为跟风 是因为真的只有这两个能打
怎么说呢 唯一能掰掰手腕的也只有Kimi 和GLM了 但是Kimi资源紧张 GLM倒还能用用 到智谱官网也不错
而这两个的官方价格 对个人开发者来说 确实不便宜
于是形成了一个死循环 想要好用的模型 但付不起官方的钱 去找第三方 第三方的坑踩了一遍 又回来继续找下一个第三方
没有赢家 只有被消耗的热情和时间 反正我是找了2天 略略略
还可以从哪些角度继续聊
上面这些是网站本身的分类 但围绕这个生态 能聊的方向还有不少 简单列几个
Token的经济账
VibeCoding到底在烧谁的钱
一个中等规模的项目 从原型到上线 到底要消耗多少Token 换算成人民币是多少 用Claude和用GPT差价有多大 反复调试 上下文溢出导致的重复计费 上下文窗口"失忆"让你反复喂同一段代码 这些"浪费"的Token占比有多高
还有那些"公益免费"网站的成本到底谁在扛 是风控漏洞 是盗刷信用卡的受害者 还是下一轮融资的投资人 这些账算清楚了 你就知道免费的东西为什么撑不久
能力陷阱
你以为在编程 其实在被驯化 当AI能帮你生成90%的代码 你还愿意去读文档 理解底层原理吗**长此以往 你的技术能力是在进步还是在退化?**值得码农们深思 至少现在 可不是会调用Agent就行的
很多人误把"会写Prompt"当成了"会编程" 但当AI生成的代码出bug时 看不懂 改不动 只能反复重试 这是一种新的"技术文盲"
AI能快速搭起脚手架 但后续维护 扩展 重构的成本谁来承担 VibeCoding适合原型 但真的适合生产环境吗 能用AI编程的人和能审查 优化 重构AI代码的人 说到底 就是善用和滥用的区别
地下产业链全景
从"薅"到"卖"的完整闭环
上游 额度从哪里来 教育邮箱 企业试用 盗刷信用卡 黑产批量注册 内部人员泄露
中游 中转站怎么运营 聚合网关 负载均衡 模型偷换 用户分级
下游 谁在买 个人开发者 小工作室 灰产从业者 甚至一些正规小公司
配套产业 接码平台 虚拟卡服务 自动化注册脚本 反风控绕路技术 这些"卖水人"也在赚钱
风险传导链 当上游渠道被封 整个产业链怎么连锁崩盘
开源自部署
开源模型的成熟 Llama Qwen DeepSeek的性能在快速追赶 个人开发者可以在自己的机器或廉价GPU上部署 这个对于轻度开发者可以一试 比如竞赛党 在地铁上也可以跑起来
自部署的成本账 买一块显卡 租一台云服务器的钱 对比长期调用付费API 哪个更划算 什么规模下切换更合适
本地部署的隐性收益 数据不外流 无调用限制 无敏感内容审查 可定制微调
当开源模型足够强 "免费API"的吸引力会不会自然消退 VibeCoding的底层逻辑会不会从"薅Token"变成"玩转本地模型"
不过坦白说 目前开源模型在编程能力上和Claude GPT的差距还是明显的 这也是为什么大家宁可在第三方网站里踩坑 也不愿意退而求其次
AI编程的"文凭贬值"
AI降低了编程的入行门槛 初级岗位的需求在萎缩 "会写代码"这个技能正在从稀缺品变成标配
如果代码生成不值钱了 什么值钱 理解业务 设计系统 做技术决策 跨部门沟通 代码审查能力
程序员从"写代码的人"变成"指挥AI写代码的人" 再到"判断AI写的代码好不好的人" 这条进化路径清晰但残酷
API免费时代的终结
结合上海中转站被刑拘和各大平台的风控升级 这是一个正在发生的事
风控升级实录 Claude OpenAI近期在API调用监控上做了哪些调整 频率限制 异常检测 账号验证增强
"免费午餐"的倒计时 当平台的风控成本超过容忍阈值 免费试用政策必然收紧 过去那种"一个邮箱薅5美元额度"的日子正在远去
当免费渠道枯竭 而付费API又太贵 个人开发者和独立创作者该怎么办
AI基础设施最终会像水电煤一样 你可以省着用 但不能指望免费 这一天正在加速到来
如果你的项目真的离不开Claude
聊一个实际的
如果你跑的是一个正经项目 代码量不小 逻辑不简单对输出质量有要求 那绕来绕去最后你还是得回到Claude或者GPT上
这时候你要做的不是继续找免费渠道 而是算清楚一笔账 官方API的投入 能不能通过项目产出覆盖掉
如果能 直接买 别犹豫 省下来的时间和避免的麻烦比那点API费用值钱得多
如果不能 那你要考虑的不是"怎么省API钱" 而是"这个项目本身是不是该换个玩法"
那普通人到底该怎么办
分三层说
第一层 写着玩的 随便薅 哪个能用用哪个 断了就换一家 不心疼
第二层 跑个人项目的 找一个相对靠谱的代理网站 可能需要在网上多翻一会 别嫌麻烦 价格贵一点就贵一点 至少不会半夜跑路
第三层 正经做事的 老老实实走官方渠道 算一下你的项目预期收益 如果连API费用都覆盖不了 那这个项目本身可能就不成立
VibeCoding降低了写代码的门槛 但没有降低Token的成本 你可以绕过风控 但你绕不过经济学喵
建议使用
Opencode zen的deepseek-v4-flash-free或者Nemotron 3 Ultra Free主要是上下文长 免费 虽说上下文只有200k but! 在opencode.json配置文件中把上下文改成1M 就和deepseek-v4-flash一样了 性能没有缩水 有资金怕麻烦的哥们就用Opencode Go平常够用 大项目不建议 支持模型
- Grok 4.5
- GLM-5.2
- GLM-5.1
- Kimi K3
- Kimi K2.7 Code
- Kimi K2.6
- MiniMax M3
- MiniMax M2.7
- Qwen3.7 Max
- Qwen3.7 Plus
- Qwen3.6 Plus
- DeepSeek V4 Pro
- DeepSeek V4 Flash
- MiMo-V2.5
- MiMo-V2.5-Pro
或者直接在Zen里面打开计费 畅用Claude等大模型
GLM Coding plan glm-4.7-flash永久免费(可能会有2000万额度限制 但大概是完全免费)
讯飞Codingplan(用用kimi和glm足够了)
结语
本文会按时更新
大家在网上找免费API的时候 多留个心眼 别在同一个网站上一次性投太多精力 鸡蛋不要放在一个篮子里
或者在自己确认过的网站上 用ccswitch薅额度
加油