产品简介
HouYi 是基于 GPT 的自动化提示注入框架,能自动攻击集成大语言模型的应用程序,帮助用户发现 AI 应用安全漏洞。适合安全研究人员和开发者用于安全评估。
核心功能
- 自动化提示注入攻击
- 支持模拟 LLM 应用演示
- 可攻击真实世界 LLM 应用
- 提供自定义 harness 和攻击意图
- 跨平台支持(Windows、macOS、Linux)
快速开始
- 安装 Python 3.8+ 并运行 pip install -r requirements.txt
- 复制 example.config.json 为 config.json 并填入 OpenAI API key
- 运行 python main.py 启动演示攻击
界面预览
与其他方案对比
| 对比项 | 本工具 | 同类商业软件 | 在线服务 |
|---|---|---|---|
| 费用 | 开源免费 | 通常收费或含广告 | 可能有订阅或上传限制 |
| 隐私 | 本地运行,数据自持 | 依赖厂商政策 | 需上传数据到服务器 |
| 可定制性 | 源码开放,社区活跃 | 受限于官方功能 | 功能固定 |
适合谁用
- 安全研究人员,用于测试 LLM 应用的安全性
- AI 应用开发者,用于评估和修复应用漏洞
- 网络安全爱好者,学习提示注入攻击技术
下载与版本
当前最新版本为 master,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/LLMSecurity/HouYi