产品简介
joy-caption-batch 这是一个基于Joytag Caption模型的批量图像描述生成工具。它支持Windows、macOS和Linux,可一次性处理多张图像并生成文字描述。工具提供低VRAM模式,让显存较低的用户也能使用。适合需要批量处理图像描述的数据科学家、内容创作者和AI研究者。

核心功能
- 批量处理图像文件
- 自定义输入目录
- 递归文件搜索选项
- 输出文件扩展可选
- 低VRAM模式支持
快速开始
- 克隆仓库:git clone https://github.com/MNeMoNiCuZ/joy-caption-batch/
- 安装CUDA 12.8和PyTorch with CUDA支持
- 运行pip install -r requirements.txt安装依赖
- 将图像放入input目录,运行py batch.py
界面预览


与其他方案对比
| 对比项 | joy-caption-batch | 同类方案 |
|---|---|---|
| 批处理能力 | 支持批量处理,可调整批处理值加速处理 | 同类工具可能仅支持单张处理 |
| VRAM要求 | 提供低VRAM模式,仅需10GB显存 | 标准工具通常需要22GB或更多显存 |
适合谁用
- 数据标注人员:批量为图像数据集生成描述
- 内容创作者:自动为网站图片添加文字说明
- AI研究人员:处理大规模图像预处理
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/MNeMoNiCuZ/joy-caption-batch