跳到正文
原文
Ollama Blog·· 2025-10-29精选AI 评分62

OpenAI 发布 gpt-oss-safeguard 开源安全推理模型

OpenAI gpt-oss-safeguard

AI 导读

OpenAI 与 ROOST 合作通过 Ollama 推出 gpt-oss-safeguard 推理模型,提供 20B 和 120B 两个版本,基于 Apache 2.0 许可。模型支持自定义策略解释、可配置推理强度(低/中/高),并开放完整推理过程便于调试。OpenAI 在内部评测集、2022 年 moderation 数据集和 ToxicChat 上进行了评估。

推荐理由

开源安全分类模型支持自定义策略与可调推理强度,为安全团队提供可审计、可部署的替代选项。

来源:Ollama Blog · ollama.com