人工智能

AI Prompt Injection 防护与上下文隔离(2025)

# AI Prompt Injection 防护与上下文隔离(2025)提示注入通过诱导模型违反边界执行敏感操作,需要在架构与提示与执行层面防护。## 一、上下文与权限- 上下文隔离:用于不同任务的数据与权限分隔。- 最小权限:工具与接口仅开放必要能力。## 二、提示与约束- 引用约束:明确只能基于提供上下文回答与引用。- 模板与过滤:对输入进行过滤与正则清洗,降低风险。#

LLM 函数调用与工具编排实践(2025)

# LLM 函数调用与工具编排实践(2025)函数调用与工具编排让模型与系统协作,提升可控性与可复现性。## 一、接口与模式- JSON Schema:定义函数参数与返回,校验输入输出。- 安全边界:限制可调用能力与资源,遵循最小权限。## 二、计划与执行- 计划执行:将多步任务拆分为计划与步骤,控制顺序与依赖。- 观察与回路:记录每次调用的观察与结果,便于回溯与调试。##

LLM 输出去敏与审计流水(PII Redaction、审计与验证)

---title: LLM 输出去敏与审计流水(PII Redaction、审计与验证)date: 2025-11-26keywords: - PII Redaction - 审计流水 - Masking - 合规 - 日志description: 为LLM输出进行PII去敏与审计记录,通过规则与模型识别敏感信息并替换,保留审计流水与证据链,提供实现与验证方法。cat...

AI 安全与评估体系(2025)

# AI 安全与评估体系(2025)AI 系统的安全与质量需要制度化治理。本文从指标、攻防与审计三个方面展开。## 一、评估指标- 准确性与一致性:针对任务定义标注集与评分标准。- 幻觉控制:回答需可追溯来源;无法回答时明确退路。- 鲁棒性:对对抗样本与异常输入进行压力评估。## 二、数据泄露与防护- 最小权限:隔离敏感数据,严格访问控制与审计。- 输出检测:对潜在泄露与敏感

Open Policy Agent-Kyverno策略治理与准入控制实践

---title: Open Policy Agent/Kyverno策略治理与准入控制实践keywords:- OPA- Kyverno- 准入控制- Policy- Rego- 验证- 变更阻断- 策略集成- 审计- 合规description: 使用 OPA/Kyverno 在 Kubernetes 中实施策略治理与准入控制,编写与验证策略、阻断不合规变更,并提供审...