GPT-OSS-Safeguard-20B(210 亿参数,其中 36 亿为活跃参数) 可以适配具有 16GB 显存的 GPU。如果您需要更大的模型,可以查看 GPT-OSS-Safeguard-120B(1170 亿参数,其中 51 亿为活跃参数)。
亮点:
安全推理训练: 专门针对安全推理进行训练和调整,以满足诸如 LLM 输入输出过滤、在线内容标记以及信任与安全用例的离线标记等使用场景。
自带策略: 能够解读您书写的策略,从而在不同产品和使用场景中实现通用化,且几乎无需工程干预。
推理决策,而不仅仅是分数: 您可以完全访问模型的推理过程,这有助于更轻松地调试并增强对策略决策的信任。请注意,原始 CoT(链式推理)是为开发人员和安全从业者设计的,不建议将其暴露给普通用户或用于安全上下文之外的用例。
可配置的推理强度: 根据您的具体使用场景和延迟需求,轻松调整推理强度(低、中、高)。
宽松的 Apache 2.0 许可证: 自由构建,无需担心版权共享限制或专利风险——非常适合实验、定制以及商业部署。
