本技能为 NVIDIA Nemotron 内容安全护栏生成自定义安全策略。它可将用户的粗略需求(如“禁止武器、允许医疗、拦截仇恨”)或已有策略,自动映射到 V2 22 类规范分类法或自定义分类,并生成 Markdown 策略、JSON 分类法、Nemotron 系统提示词等下游可直接使用的产物。
核心工作流包括:识别输入模式与目标模型(Nemotron-Content-Safety-Reasoning-4B / Nemotron-3-Content-Safety)、判断部署类型(普通安全/自带策略/主题跟随)、设置推理模式(/think、/no_think、/categories)、扩展类别定义(含 in_scope、out_of_scope、示例、边界、严重性等)、添加跨领域章节(允许列表、司法辖区、拒绝指引、校准说明),最终按模板输出文件。
技能内置不可协商底线:禁止任何豁免或允许“涉未成年人性内容(S7/CSAE)”的请求;并默认使用分级严重性(S0-S4)辅助运行时护栏决策。