OpenAI开源gpt-oss-safeguard-120b和gpt-oss-safeguard-20b


gpt-oss-safeguard-120bgpt-oss-safeguard-20b是基于gpt-oss构建的安全推理模型。通过这些模型,您可以根据提供的安全策略对文本内容进行分类,并执行一系列基础安全任务。这些模型专为安全用例设计。对于其他应用场景,我们推荐使用gpt-oss系列模型

该型号gpt-oss-safeguard-120b可部署在单块H100 GPU上运行(1170亿参数总量,51亿活跃参数)。若需更低延迟版本,请选用gpt-oss-safeguard-20b(210亿参数总量,36亿活跃参数)。

所有模型均基于我们开发的harmony响应格式进行训练,必须严格遵循harmony格式使用,否则将无法正常工作。

产品亮点

  • 安全推理专项训练:针对安全推理场景进行专项训练与优化,适用于大语言模型输入输出过滤、在线内容标注以及信任与安全场景的离线标注等用例。
  • 自定义策略机制:可解析用户编写的安全策略,无需复杂工程适配即可跨产品和用例通用。
  • 决策过程透明化:提供完整的模型推理过程(注:原始思维链功能面向开发者和安全专业人员设计,不建议向普通用户或在非安全场景使用),不仅输出判定结果,更展现决策依据,便于调试分析并增强对策略决策的信任度。
  • 可调节推理强度:根据具体用例和延迟需求,灵活选择低/中/高三档推理强度。
  • Apache 2.0开源许可:允许自由构建且无著作权限制或专利风险,特别适合实验研究、定制开发和商业部署。

推理示例

gpt-oss-safeguard-120b与gpt-oss-safeguard-20b的使用方式与对应手册中描述的gpt-oss系列模型类似。我们同时提供了详细的提示词指南,说明如何编写安全策略并与模型配合使用。

模型下载

通过Hugging Face平台下载模型权重,操作流程与gpt-oss-120b下载指引类似。

加入ROOST模型社区

gpt-oss-safeguard是稳健开放在线安全工具(ROOST)模型社区的合作伙伴。该社区聚集了致力于运用开源AI模型保护网络空间的安全实践者。作为社区合作伙伴,OpenAI将持续整合用户反馈,与社区共同迭代未来版本以推进开放安全生态。访问RMC GitHub仓库了解合作详情及参与方式。

相关资源

相关推荐
bylander2 分钟前
【AI学习】几分钟了解一下Clawdbot
人工智能·智能体·智能体应用
香芋Yu12 分钟前
【机器学习教程】第04章 指数族分布
人工智能·笔记·机器学习
小咖自动剪辑20 分钟前
Base64与图片互转工具增强版:一键编码/解码,支持多格式
人工智能·pdf·word·媒体
独自归家的兔22 分钟前
从 “局部凑活“ 到 “全局最优“:AI 规划能力的技术突破与产业落地实践
大数据·人工智能
一个处女座的程序猿23 分钟前
AI:解读Sam Altman与多位 AI 构建者对话—构建可落地的 AI—剖析 OpenAI Town Hall 与给创业者、产品/工程/安全团队的实用指南
人工智能
依依yyy23 分钟前
沪深300指数收益率波动性分析与预测——基于ARMA-GARCH模型
人工智能·算法·机器学习
海域云-罗鹏33 分钟前
国内公司与英国总部数据中心/ERP系统互连,SD-WAN专线实操指南
大数据·数据库·人工智能
冬奇Lab36 分钟前
深入理解 Claude Code:架构、上下文与工具系统
人工智能·ai编程
Up九五小庞43 分钟前
本地部署 + Docker 容器化实战:中医舌诊 AI 项目 TongueDiagnosis 部署全记录-九五小庞
人工智能
John_ToDebug1 小时前
2025年度个人总结:在技术深海中锚定价值,于时代浪潮中重塑自我
人工智能·程序人生