首发!检测你是否被中转站注入提示词攻击!

介绍

项目链接

写这个项目纯粹是抛砖引玉,先把mvp写出来,把我质朴的思路拿出来晒一晒,主要是这方面没人做啊。

除了审查功能,也支持一些ccswitch不支持的,比如模型映射、热切换等,以后会更更多一点,用量啥的。

原理

简单来说就是把流扔给另外一个快速的、可信的大模型审查一遍,比如本地模型或 deepseek-flash

两个审查模式:

  • 被动审查:只接受然后审查,不主动拦截但会有事后的警告
  • 主动拦截(beta):不支持流,扣下来检测没问题再送回去,不太建议用因为会比较影响日常使用,我说实话走个被动发现有问题就别用这个中转了呗

上下文审查模式也是两个:

使用

启动

把项目扔到本地直接 node start 或者运行 bash 命令

访问 http://127.0.0.1:8787/admin

配置模型

这个不用我教了吧,看着配就行,注意了现在比较轻量所以没法自由转 openai 和 a\格式,得自己填好

然后配置一下路由:

记得配置审查模型

正常使用

操作:

  • baseurl 直接填 http://127.0.0.1:8787/
  • apikey 随便填,因为根本没这功能
  • 获取模型列表
  • 开始使用

就这样就行

审查结果

直接翻就行,结果大致是这样:

攻击模拟

攻击模拟是虚拟模型:客户端调用 attack-sim 或 attack-sim/...,网关用选定上游模型生成模拟响应,再走常规链路,最后生成报告。

选模式试试就好了。

注意攻击模拟的上游模型格式要和你要测试的客户端的格式匹配,比如claude code就用a\格式的。

开发

改就行,我把所有技术设计文档都扔项目上了,期待能有更好的方案。

相关推荐
东风破_5 小时前
从输入 juejin.cn 到看到页面:DNS、Nginx、服务器集群与 CDN 到底在做什么?
后端·mysql
东风破_5 小时前
从 0 设计一个博客数据库:用户、头像与文章表应该怎么建?
后端·mysql
大鸡腿同学6 小时前
黄仁勋点透的 AI 真相:能实现你知道但做不到的,却实现不了你不知道的
后端
FfHUCisI6 小时前
Go 编译过程全景
开发语言·后端·golang
FfHUCisI6 小时前
Golang 语法分析与 AST:Parser 与 go/ast
开发语言·后端·golang
++==8 小时前
RESTful详解:核心思想、框架、与HTTP的区别,API的设计风格
后端·http·restful
IT_陈寒9 小时前
Vue的响应式更新有时候真的不听话
前端·人工智能·后端
向生10 小时前
Ubuntu Caddy 保姆级完整教程
后端
tntxia10 小时前
Docker权限的问题
后端
明月_清风10 小时前
看完这段关于"全插件化架构"的技术分析后,我整理了一份笔记
前端·后端