产品简介
jade-db JADE是复旦JADE团队推出的大模型安全测评与治理平台。它通过语言学变异自动生成高危测试问题,覆盖违法犯罪、侵犯权益和歧视偏见等多类安全问题,提供评测数据集和工具,帮助研究人员和开发者评估大模型安全性,解决大模型可能产生有害内容的痛点。
核心功能
- 多版本安全评测数据集(如v1.0, v2.0)
- 基于语言学变异自动生成高危测试问题
- 覆盖4大类30多小类安全问题
- 支持中文和英文双语评测
- 提供在线demo和示例演示
快速开始
- 第一步:访问jade-db GitHub仓库或项目网站
- 第二步:下载评测数据集文件(如jade_benchmark_easy_zh.csv)
- 第三步:使用数据集对大模型进行安全测试
界面预览
与其他方案对比
| 对比项 | jade-db | 同类方案 |
|---|---|---|
| 评测数据生成方式 | 基于语言学变异自动生成高危问题,覆盖多类安全 | 可能依赖手动测试或简单脚本,覆盖范围有限 |
| 数据多样性 | 提供多难度级别、中英文数据集,共数千条问题 | 可能只有单一语言或难度的数据集 |
适合谁用
- 需要评估大模型安全性的AI研究人员
- 开发安全敏感应用的软件开发者
- 关注AI伦理和合规性的监管人员
下载与版本
当前最新版本为 v2.0,发布于 2023-11-20。支持 多平台。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/whitzard-ai/jade-db