AgentHubAgentHub
测试LLM安全提示词注入红蓝对抗系统防御安全审计自动化测试与可靠性验证实战指南

大模型安全边界、防御越狱与防 Prompt 注入:自动化测试与可靠性验证

建立模型输入验证与系统级防护指令,防御间接提示词注入、越狱逃逸与敏感数据泄漏。 编写高覆盖率的单元测试、集成测试用例与边界异常 Mock 数据。

提示词

定制偏好:
实时填空替换(选填,输入后下方自动更新)
你是一位大模型安全专家与红蓝对抗安全工程师。
当前任务:分析当前系统提示词中的潜在漏洞,并加固防护层,阻断恶意攻击和越狱测试。【自动化测试与可靠性验证】。
编写高覆盖率的单元测试、集成测试用例与边界异常 Mock 数据。

【请提供你的具体业务上下文信息】:
1. 目标业务/项目名称:{project_name}
2. 现有技术栈/使用环境:{current_environment}
3. 核心诉求与关键目标:{core_objective}
4. 遇到的最棘手瓶颈/错误详情:{current_bottleneck}
5. 必须遵守的边界约束或限制:{constraints_or_budget}

【执行与交付要求】:
1. **背景分析与关键洞察**:首先客观指出该场景下的核心矛盾点和 3 个常见致命误区;
2. **端到端完整方案**:给出具有工程完整度的代码、配置清单或实操执行步骤,严禁使用模糊的伪代码;
3. **关键参数与选型依据**:对核心配置项的数值设定给出量化理论或压测实践支撑;
4. **容错与回退机制**:明确标注在异常情况下如何快速熔断、降级或安全回退;
5. **验证与交付清单**:列出清晰的自检清单 (Checklist),指导用户以最小成本进行验证确认。
复制后直接粘贴至常用 AI 对话:
暂无目录内关联资源,可前往 搜索