> 自媒体 > (AI)人工智能 > OpenAI 再出开源力作 Safeguard:可完整展示AI“思维链”
OpenAI 再出开源力作 Safeguard:可完整展示AI“思维链”
来源:IT之家
2025-10-31 16:49:44
225
管理

IT之家 10 月 30 日消息,科技媒体 NeoWin 昨日(10 月 29 日)发布博文,报道称 OpenAI 公司推出 gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b 两款开源权重模型,专门用于根据用户提供的策略对内容进行推理、分类和标记。

这是继今年早些时候发布 gpt-oss 系列推理模型后,OpenAI 在开源领域的又一重要举措。新模型是此前 gpt-oss 模型的微调版本,同样遵循宽松的 Apache 2.0 许可证,允许任何开发者免费使用、修改和商业部署。

与传统的“一刀切”式安全系统不同,gpt-oss-safeguard 将定义安全边界的权力交还给了开发者。其核心机制在于,模型无需在训练阶段硬编码规则,能够在推理阶段直接解释并应用开发者提供的安全策略。

gpt-oss-safeguard 的核心工作机制是,在模型推理(即实际运行)阶段接收两项输入:一项是开发者自定义的安全策略,另一项是需要分类的内容(如用户消息或 AI 生成内容)。

当然,gpt-oss-safeguard 模型也并非完美,OpenAI 提示开发者需要注意两个主要的权衡:

第一,如果开发者有足够的时间和数据(如数万个已标注样本)来训练一个传统的分类器,那么在处理复杂或高风险任务时,传统分类器的精度可能仍然会超越 gpt-oss-safeguard。换言之,追求极致的精确度时,定制训练的系统或许是更优选。第二,gpt-oss-safeguard 的运行速度较慢且资源密集,让其在大型平台上对所有内容进行实时扫描变得更具挑战性。

这两款模型目前已在 Hugging Face 平台上开放下载。

IT之家附上参考地址

0
点赞
赏礼
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与本站无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。 凡本网注明 “来源:XXX(非本站)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。 如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。 QQ:617470285 邮箱:617470285@qq.com
相关文章
跑车女皇法拉利F80 即将发布,售价接近3000万
在高性能跑车领域,法拉利、保时捷和玛莎拉蒂是当之无愧的超级选手,随随..
设计公司Italdesign“复活”本田经典跑车NSX,致敬两代经典设计..
IT之家 1 月 10 日消息,当地时间 1 月 9 日,据外媒 Autocar 报道,意大..
全球唯一!玛莎拉蒂发布MCPura Cielo“冰与火”限定版超跑..
快科技1月31日消息,当地时间本月20日,玛莎拉蒂在瑞士圣莫里茨ICE冰上盛..
“最壮观GTI”:大众展示高尔夫GTI Roadster敞篷跑车
IT之家 2 月 20 日消息,汽车媒体 autoevolution 昨日(2 月 19 日)发布..
赛车与跑车谁更快?F1赛车为你揭秘答案
赛车和超跑直线加速对比。究竟是赛车快还是跑车快?本期视频将给出答案。..
《飞驰人生》片尾为何谢王思聪?不止借车库,千万跑车全是真家伙..
提起《飞驰人生》,不少人都记得片尾字幕里王思聪的名字,却鲜少有人知道..
中国古代的顶级“超跑”,如今全球仅剩六千匹!汗血宝马是啥样?..
在历史的长河中,骏马总是与英雄、战争和传奇紧密相连,而对于我们中国人..
法拉利296 Challenge Stradale路试曝光:赛道版公路跑车即将到来..
【网通社快报】法拉利被拍到正在测试一款重度伪装的原型车,外观酷似赛道..
10款你应该现在就入手的跑车,趁它们还没成为经典款!..
经典车的潮流正逐渐席卷2000年代的车型,这意味着它们的受欢迎程度和价格..
关于作者
冷冷的太阳..(普通会员)
文章
1929
关注
0
粉丝
0
点击领取今天的签到奖励!
签到排行

成员 网址收录40418 企业收录2986 印章生成263660 电子证书1157 电子名片68 自媒体104949

0
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索