LLMOps Security & Compliance
安全护栏工程:捍卫生产上线的“最后一公里”
在将 Agent 对接高危本地工具调用与外部数据库前,必须构建严密的实时动态输入输出看门狗。本关深入实战针对大模型指令劫持(Prompt Injection)防御、个人隐私数据(PII)脱敏治理以及基于双向 Llama Guard 的网络大闸。
预计掌握时间
60 分钟
阶段等级
Track 4 · 专家
配置网关护栏 (Guardrails Switches)
开启或关闭对应的安全拦截网关模块:
注入拦截 (System Guard)
拦截带有系统重置指令、高风险工具调用的注入样本。
隐私脱敏 (Regex & NER PII)
识别身份证、手机号、密保钥匙,在上云前哈希占位遮蔽。
分类拦截 (Llama Guard Watchdog)
利用微调看门狗模型评估输入/输出内容是否 safe/unsafe。
选择安全注入/提问范例
测试护栏面对恶意威胁与合规查询时的实时拦截效果:
测试查询载荷 (Test query input)
网关拦截流水线状态 (Real-time Audit Trace)
请点击发送按钮,查看请求在每一道安全防护阀中流转与检测的明细...