产品简介
comfyui_dagthomas 这是一个ComfyUI的扩展节点套件,集成了OpenAI、Gemini、Claude等多个AI大模型及本地模型,用于生成高级图像/视频提示词并分析图像内容。适合需要精细控制AI创作流程、提升工作效率的ComfyUI用户。

核心功能
- 多AI模型集成,统一调用不同服务商API
- 高级图像分析,支持风格克隆与场景描述
- 专业电影级提示词增强与生成
- 支持本地模型运行,保护数据隐私
- 智能场景过渡生成,用于视频创作
快速开始
- 在ComfyUI中,通过ComfyUI Manager搜索并安装“comfyui_dagthomas”。
- 根据需要,在系统环境变量中设置对应AI服务(如OpenAI、Gemini)的API密钥。
- 在ComfyUI的节点菜单中,找到“APNext”类别下的节点(如Universal Generator),连接到工作流即可使用。
界面预览

与其他方案对比
| 对比项 | comfyui_dagthomas | 同类方案 |
|---|---|---|
| 模型集成范围 | 集成OpenAI、Gemini、Claude、Grok、Groq等主流云端API,并支持QwenVL、Ollama等本地模型。 | 同类节点通常仅支持单一或少数几个模型服务。 |
| 本地运行能力 | 提供QwenVL等本地模型节点,支持离线进行图像分析与风格克隆。 | 多数依赖云端API,需要网络并消耗Token。 |
| 提示词专业性 | 内置“电影级”增强模式,可精细控制灯光、镜头、构图等专业影视参数。 | 可能提供基础的提示词优化。 |
| 视频分析支持 | 提供视频分析节点,支持逐帧分析视频内容。 | 通常专注于静态图像。 |
适合谁用
- 使用Stable Diffusion并需要精细化提示词控制的AI绘画创作者。
- 希望通过AI自动优化或生成描述性文本,以提升创意产出的设计师或内容创作者。
- 需要使用特定AI模型(如Gemini、Claude)进行图像分析,且希望在ComfyUI中统一操作的工作流用户。
- 注重数据隐私,倾向于在本地运行视觉分析模型的技术爱好者。
下载与版本
当前最新版本为 master,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/dagthomas/comfyui_dagthomas