论文阅读:2024-NAACL Semstamp、2024-ACL (Findings) k-SemStamp

总目录 大模型安全相关研究:https://blog.csdn.net/WhiffeYF/article/details/142132328

Semstamp: A semantic watermark with paraphrastic robustness for text generation
https://aclanthology.org/2024.naacl-long.226/

k-SemStamp: A Clustering-Based Semantic Watermark for Detection of Machine-Generated Text
https://aclanthology.org/2024.findings-acl.98/

github:https://github.com/abehou/SemStamp

https://www.doubao.com/chat/2065458618013954

GitHub代码和对应论文均围绕基于水印的AI生成文本检测展开。

  • 论文核心内容:论文《SemStamp: A Semantic Watermark with Paraphrastic Robustness for Text Generation》提出SemStamp算法,旨在解决现有水印生成算法易受释义攻击的问题。该算法在句子语义表示上进行水印嵌入,利用局部敏感哈希(LSH)划分句子语义空间。在文本生成阶段,通过对比学习微调句子编码器,将候选句子映射到语义嵌入空间,经LSH哈希后,采用拒绝采样使生成句子落在水印有效区域;检测时,对生成文本中有效区域句子数量进行单比例z检验,判断文本是否为机器生成。同时,论文提出双词释义攻击方法,用于测试水印算法的鲁棒性。实验表明,SemStamp在多种释义器和领域上比之前的方法更鲁棒,且能更好地保持生成文本质量。
  • GitHub代码功能:该代码库为论文的实现提供支持,涵盖SemStamp和k-SemStamp两个算法。其中,SemStamp利用LSH划分高维嵌入空间,使生成文本的LSH哈希值符合伪随机控制序列,检测时分析输入句子的LSH哈希值并进行z检验判断文本是否带水印;k-SemStamp是SemStamp的变体,使用k-means聚类划分嵌入空间,生成和检测过程与SemStamp类似 。代码库提供了详细的安装指南和使用示例,包括数据加载、模型微调、文本生成、释义和检测等步骤,方便使用者复现论文实验结果和进行自定义文本生成与检测。
相关推荐
张较瘦_6 小时前
[论文阅读] 人工智能+项目管理 | 当 PMBOK 遇见 AI:传统项目管理框架的破局之路
论文阅读·人工智能
张较瘦_6 小时前
[论文阅读] 人工智能 | 大语言模型计划生成的新范式:基于过程挖掘的技能学习
论文阅读·人工智能·语言模型
0x21111 小时前
[论文阅读]TrustRAG: Enhancing Robustness and Trustworthiness in RAG
论文阅读
要努力啊啊啊15 小时前
强化学习基础概念图文版笔记
论文阅读·人工智能·笔记·深度学习·语言模型·自然语言处理
二进制的Liao16 小时前
【数据分析】什么是鲁棒性?
运维·论文阅读·算法·数学建模·性能优化·线性回归·负载均衡
Jamence1 天前
多模态大语言模型arxiv论文略读(108)
论文阅读·人工智能·语言模型·自然语言处理·论文笔记
张较瘦_1 天前
[论文阅读] 人工智能 | 用大语言模型解决软件元数据“身份谜题”:科研软件的“认脸”新方案
论文阅读·人工智能·语言模型
Jamence1 天前
多模态大语言模型arxiv论文略读(106)
论文阅读·人工智能·语言模型·自然语言处理·论文笔记
崔高杰1 天前
To be or Not to be, That‘s a Token——论文阅读笔记——Beyond the 80/20 Rule和R2R
论文阅读·笔记
张较瘦_1 天前
[论文阅读] 人工智能+软件工程 | 用大模型优化软件性能
论文阅读·人工智能·软件工程