标签:LLM安全
包含标签「LLM安全」的全部资源
共 17 个结果
秘密脱敏工具
CloakMCP是一款本地优先的秘密脱敏工具,可在代码或文本暴露给大型语言模型(LLM)前自动替换敏感信息,支持与Claude Code的无缝集成。
提示注入防御工具包
一个轻量级、无依赖的提示注入检测工具包,包含Python检测库和防御策略,用于保护LLM代理免受语言级别攻击。
安全LLM集成中间件
Trust-Gated MCP是一种中间件架构,通过实时传感器数据质量评估,确保在安全关键环境中安全部署大型语言模型(LLM)。
MCP工具元数据安全研究
研究恶意MCP工具元数据如何被利用作为攻击面,通过实验验证LLM可能执行与用户意图无关的行为。
模型上下文协议防护框架
MCP-Guard是一个模块化的安全框架,旨在保护大型语言模型(LLM)在工具集成中免受新兴威胁,如提示注入、数据泄露和影子劫持。
LLM应用安全扫描工具
用于检测LLM应用漏洞的安全扫描工具,支持在Claude Code、Codex和Cursor等平台上运行,涵盖提示注入、数据泄露、工具滥用等多种漏洞类型。
合规审查服务器
Redaction & Compliance MCP Server是一个生产级的合规审查服务器,提供LLM调用的预检/后检防火墙,具备全面的检测、分类、策略执行、可逆的审查、选择性解令牌、输出安全和不可变的审计日志功能。
LLM漏洞扫描器
一个开源MCP服务器,允许代理或人类触发对任何LLM端点的garak扫描,并接收简洁的漏洞报告(幻觉、提示注入、数据泄漏、毒性等)。
提示验证网关
NOVA MCP安全网关是一个提示验证服务,用于检查每个传入的提示是否符合安全规则,并阻止匹配高严重性安全或越狱模式的提示。
LLM安全测试框架
MCParasite是一个开源的安全研究工具,用于测试LLM驱动的代理对上下文蠕虫攻击的易感性,这些攻击通过共享通信渠道自主传播。
网页内容提取防护工具
一个用于提取网页内容并防护LLM注入攻击的MCP服务器和CLI工具,提供HTML净化、元数据提取和多重注入检测功能。
凭证隔离服务器
Vault MCP是一款用于LLM代理中凭证隔离的服务器,确保密码和API密钥不会出现在上下文窗口中。
生成模型限制分析服务
ToGMAL MCP Server是一个实时、隐私保护的LLM交互分析服务,用于检测异常行为并提供安全干预建议。
LLM内容防护代理
MCPGuard是一款针对大型语言模型(LLM)的MCP标准输入输出代理工具,主要用于扫描工具结果中的提示注入攻击并压缩有效负载,以优化LLM上下文窗口的使用。
LLM漏洞扫描服务器
一个轻量级的MCP服务器,用于运行Garak LLM漏洞扫描工具,支持多种模型类型和攻击探测。
双LLM信任层
一个通过双LLM架构实现输入清洗和PII保护的Dedalus代理安全增强层,适用于需要处理敏感数据的自动化工作流。
LLM漏洞扫描服务器
一个轻量级的MCP服务器,用于运行Garak LLM漏洞扫描工具,支持多种模型类型和攻击探测。
