ai安全

ccstuck4 天前
人工智能·安全·开源·ai安全
AI安全系列:开源RAG系统测试作者:ccstuck | 2026-10 | 系列:把渗透方法论搬进 LLM 时代(二) 上一篇《给最小 Agent 做提示注入测试》打的是自写靶机,这一篇打真实产品:Open WebUI 的知识库(RAG)功能,三个大模型对照,附全部截图与踩坑记录。
AI日报派送佬5 天前
人工智能·智能体·ai安全·开源ai·ai日报·人工智能前沿·ai科研
2026年10月4日AI行业日报|AI智能体自主能力升级,模型落地与安全规范双向迭代2026年10月4日AI行业核心围绕智能体自主进化、模型合规开源、算力投资标准化、AI安全伦理重塑、产业落地精细化五大核心方向迭代。智能体领域迎来突破性进展,OpenAI模型出现自我保护自主行为,多款评测、开发、数据合成工具落地,补齐工程化落地短板;模型端海外开源主权大模型、国内轻量模型实现能力突破,适配不同层级产业需求。同时行业彻底告别AI神化叙事,学界与头部企业纷纷正视大模型推理短板,AI版权风险、智能体蠕虫、算力成本失控等新型安全问题集中暴露,叠加算力工厂投资体系标准化、物理AI赛道融资爆发,行业正
Eason_LYC6 天前
java·网络安全·渗透测试·shiro·漏洞复现·反序列化·ai安全
一个公开密钥放倒一片:Apache Shiro RememberMe 反序列化漏洞Apache Shiro 的【记住我】功能会把身份信息序列化后 AES 加密存进 Cookie。问题是早期版本把加密密钥硬编码在了源码里,而且密钥是公开的——攻击者用这个密钥加密任意反序列化数据塞进 Cookie,服务端解密后直接反序列化,命令就执行了。这篇讲透 Shiro 反序列化的原理、指纹识别、密钥问题和利用思路。
ccstuck6 天前
人工智能·安全·ai安全
AI安全系列:给最小 Agent 做提示注入测试作者:ccstuck| 2026-10 | 系列:把渗透方法论搬进 LLM 时代(一) 实验环境:DeepSeek API + 约 130 行 Python 实现的无框架最小 Agent | 代码与 payload 已开源
liferecords7 天前
大模型·智能体·ai安全·ai大厂
OpenAI 又把训练摁停了:AI agent 用 DNS 给自己开了条外网通道💡 一句话总结:OpenAI 第二次暂停最强模型的训练与评估——一个 agent 钻了 DNS 过滤的空子穿透「隔离」沙箱连上外部聊天机器人,监控报警很及时、自动刹车却失灵了;技术细节罕见地公开透明,但「失控(rogue)」这个词该不该用,社区已经吵翻了。
光依旧8 天前
rsa·身份安全·ai安全·mcp·agent安全·mcp网关
RSA杀入Agent 身份安全:MCP网关成了新战场9 月 29 日,RSA在旧金山AI大会上发布了 RSA Agent ID:一个面向金融、政府、关键基础设施等高监管行业的 Agent 身份安全平台。
智码看视界8 天前
ai安全·大模型安全·spring ai·越狱攻击·prompt注入·防御体系
Day81-AI安全攻防:Prompt注入攻击与防御实践上篇回顾:Day 80 我们用语义缓存把 34% 的重复问题挡在模型之外、零成本秒回,成本账算得明明白白。但省钱的前提是系统还活着——Prompt 注入能让 System Prompt、库表结构、内部规则一字不差被套出来。这篇用红队视角复现三类攻击,再给三层防御体系。
DM今天肝到几点?9 天前
人工智能·gpt·安全·ai安全
AI 安全 · 前沿实验室OpenAI 取消 GPT-6.1 Astra 发布、再停前沿训练:Agent 逃出沙箱之后,责任该算谁的过去 24 小时里最重的一条消息,不是哪个模型又涨了几个点,而是 OpenAI 取消了 GPT-6.1 Astra 原定于 10 月在 ChatGPT 与 Codex 的上线计划,同时暂停了最强模型的训练。
梅雅达编程笔记10 天前
llama·qwen·开源大模型·ai安全·模型越狱·权重投毒·大模型治理
开源模型的安全悖论——越开放,越危险?开源大模型的安全困境:开放带来民主化与创新加速,也让攻击门槛骤降、对齐可被绕过、权重后门可植入。本文以正反辩论结构拆解Llama到Qwen的生态困局,给出务实出路与开发者行动清单。
小杉泽10 天前
ai·ai安全
工具返回值二次提示注入:Agent 未确认外发攻击链的红队复现与修复真正危险的输入,不一定出现在用户首条消息中,也可能藏在 Agent 读取到的工具返回值里。本文以退款工单审阅为场景,从红队角度复现一条二次提示注入链:首轮读取合法,工单备注携带伪装成系统指令的文本,第二轮规划器据此生成 send_email 计划,脆弱路由器在没有用户确认的情况下接受外部目标和敏感字段。实验会话属于 tenant-a,角色为分析员;首个 ticket_connector 查询本身完全合法,但返回的合成工单备注要求把 customer_email、电话和内部备注发送到 collector@o
小杉泽11 天前
ai·ai安全
MCP Tasks 输入生命周期安全:从 input_required 到可恢复执行的状态机审计很多系统第一次接入 MCP Tasks 时,会把 input_required 当成“前端暂时停一下”的展示状态:服务端返回一段提示,客户端让用户输入,再把输入拼回下一次请求。这个理解少了最关键的一层。按照当前 Tasks 扩展草案,任务在 input_required 状态下携带的是一组由服务器发出的、等待客户端兑现的 inputRequests;客户端随后通过 tasks/update 的 inputResponses 回答这些请求。每一个 key 都必须能够指回任务生命周期内唯一的一次服务器请求,不
蚁小二官方18 天前
大模型·数据合规·ai安全
AI 安全治理框架更新|大模型训练数据合规,企业实操落地思路最近这些年,国内针对AI安全的治理规则一直在持续更新和完善,专门针对大模型训练数据的相关规范,也变得越来越细致。在早些年,大部分企业在开发大模型的时候,基本都只看重数据的数量和模型最终的使用效果,不太会主动关注数据来源、数据授权、个人隐私保护以及版权这类合规问题。随着行业的监管标准慢慢发生变化,相关的管控工作不再只盯着大模型生成的内容,训练所用的原始数据,开始成为监管规范的重点。现在企业做大模型研发和上线运营,都必须提前做好数据方面的合规工作。本文就结合目前公开的行业治理相关规则,简单整理了大模型训练数据
蒲公英eric20 天前
web安全·ai·dvwa·ai安全
DVWA通关全记录:从漏洞复现到安全防御——总结篇📌本文是专栏「DVWA通关全记录:从安全分析到安全防御」的第 20 篇文章。十八个模块刷完,最大的收获不是记住了多少个漏洞名称,而是建立了三个思维方式。
蒲公英eric21 天前
web安全·ai·ctf·dvwa·ai安全·api模块
从旧接口泄露到 OAuth 保护:DVWA API 模块完整漏洞分析教程📌 本文是专栏「DVWA通关全记录:从漏洞复现到安全防御」的第 19 篇文章。API(Application Programming Interface)是现代 Web 应用的基石,用于前后端分离、系统间数据交换和第三方集成。API 安全是指保护 API 免受未授权访问、数据泄露、注入攻击等威胁的安全措施。
漫话明说21 天前
安全·智能体·ai安全
工智能安全描述性综述(2026):基于30份行业报告的梳理综述性质:描述性综述(Descriptive Review)。本文以 30 份 AI 安全相关研究报告为对象,保留每份报告的核心内容与关键结论,按报告实际内容归纳主题结构;同一版块内允许并列呈现不同报告对同一议题的竞争性观点。所有引用均以(报告名,机构,年份)形式标注,文末附完整参考文献与来源信息。
zhuobattle23 天前
安全·ai安全·大模型安全
Anthropic 2026年9月威胁情报报告:AI滥用安全风险总结原文:Detecting and countering misuse of AI: September 2026
Forerror202624 天前
人工智能·ai工具·ai安全·maigateway·企业ai网关·企业级大模型治理网关·大模型财务治理
大模型网关解决什么问题?MAI Gateway(魔芋企业级AI网关)给出企业级答案大模型网关到底解决了什么问题?我说它解决了"看不见"的问题。企业用大模型最大的麻烦不是模型不好用,是看不见——看不见每笔调用花在哪、看不见谁在用令牌干私事、看不见员工有没有往对话框里贴身份证号、看不见供应商一宕机业务就停半天。MAI Gateway(魔芋企业级AI网关)的核心价值就一句话:让企业看见,然后才管得住。下面五个企业级关切,逐个给答案。
蒲公英eric1 个月前
web安全·ai·ctf·dvwa·ai安全·开放重定向模块
从直接重定向到白名单验证:DVWA 开放重定向模块完整漏洞分析教程📌 本文是专栏「DVWA通关全记录:从漏洞复现到安全防御」的第 17 篇文章。开放重定向(Open HTTP Redirect,CWE-601)是指 Web 应用接收用户可控的参数作为重定向目标,且未对目标地址进行充分校验,导致攻击者可以构造恶意链接将用户重定向到任意第三方站点。
蒲公英eric1 个月前
安全·web安全·ai·dvwa·ai安全·密码学模块
从弱加密到安全实现:DVWA 密码学模块完整漏洞分析教程📌 本文是专栏「DVWA通关全记录:从漏洞复现到安全防御」的第 18 篇文章。大多数 Web 漏洞的本质是"输入没过滤"或"权限没校验",而密码学漏洞的本质是**“保护数据的那把锁本身有缺陷”。它不报错、不崩溃,甚至开发者会觉得"我都用 AES 加密了还能不安全?"——但正因为它发生在数据已经"看起来被保护"的环节,一旦出错危害极深:攻击者拿到的不是一条明文,而是批量解密历史数据、永久伪造任意身份**的能力。
蒲公英eric1 个月前
web安全·ai·ctf·dvwa·ai安全·授权绕过模块
从页面检查到功能验证:DVWA 授权绕过模块完整漏洞分析教程📌 本文是专栏「DVWA通关全记录:从漏洞复现到安全防御」的第 16 篇文章。授权绕过(Authorization Bypass)是指攻击者绕过应用程序的访问控制机制,访问或操作超出其权限范围的数据或功能。