产品简介
ComfyUI-MiniCPM 面向 ComfyUI 用户,提供基于 MiniCPM 视觉语言模型的图像字幕生成和视觉分析功能,支持多种模型版本和格式,适合需要自动化图像处理的 AI 开发者和爱好者。
核心功能
- 支持最新 MiniCPM-V-4.5 模型和多种 GGUF 格式
- 提供多种图像描述类型,如描述、分析、解释
- 灵活的内存管理选项,优化 VRAM 使用
- 自动下载模型文件,简化设置
- 可定制参数,如 max tokens 和温度
快速开始
- 克隆仓库到 ComfyUI 的 custom_nodes 文件夹
- 安装依赖文件,运行 pip install 和 llama_cpp_install.py
- 在 ComfyUI 中添加 MiniCPM 节点
- 连接图像或视频输入,选择模型和参数
- 执行工作流生成图像字幕或分析
界面预览
与其他方案对比
| 对比项 | ComfyUI-MiniCPM | 同类方案 |
|---|---|---|
| 模型支持 | 支持 MiniCPM-V-4.5 和多种 GGUF 量化格式 | 可能只支持单一模型或有限格式 |
| 内存管理 | 提供多种内存管理选项,如保持内存和清除 | 可能缺乏灵活的内存控制 |
| 安装简便性 | 自动下载模型,一键设置 | 可能需要手动下载和配置 |
适合谁用
- 需要自动化图像描述的内容创作者
- 进行视觉分析的研究人员
- 使用 ComfyUI 的 AI 图像处理开发者
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/1038lab/ComfyUI-MiniCPM