产品推荐 2026-07-27

GeminiImageApp:AI 图像处理工具(源码)

基于 Google Gemini AI 的多功能图像处理工具,支持问答、生成、编辑等。

开源软件跨平台工具

产品简介

GeminiImageApp Image App 集成 Google Gemini、OpenCV 和 YOLO 技术,提供图像问答、生成、编辑、目标检测、分割和视频生成功能,帮助用户智能处理图像,适合普通用户和专业人士进行 AI 图像处理。

核心功能

  • 智能图像问答:支持中文提问,基于 Gemini AI 深度理解图像内容。
  • AI 图像生成:双引擎(Imagen 3 和 Gemini 2.0 Flash)生成高质量图像,支持中文提示词优化。
  • 智能图像编辑:通过自然语言描述编辑图像,支持修复、增强、风格转换等模式。
  • 多算法目标检测:集成 Gemini、OpenCV、YOLO 三种引擎,提供对比分析。
  • 精确图像分割:像素级精度,支持多算法比较和实例分割。

快速开始

  1. 克隆项目到本地:git clone https://github.com/0xsline/GeminiImageApp.git
  2. 安装依赖并配置 API 密钥:进入 backend 和 frontend 目录安装 Python 和 Node.js 依赖,编辑 .env 文件设置 Google API 密钥。
  3. 启动服务:运行后端 Python 脚本和前端 npm 命令,访问 http://localhost:3000。

界面预览

与其他方案对比

对比项本工具同类商业软件在线服务
费用开源免费通常收费或含广告可能有订阅或上传限制
隐私本地运行,数据自持依赖厂商政策需上传数据到服务器
可定制性源码开放,社区活跃受限于官方功能功能固定

适合谁用

  • 追求开源、免费、无广告体验的用户
  • 重视数据隐私,希望本地化处理的用户
  • 需要跨平台一致体验的进阶用户

下载与版本

当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。

⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。

注意事项

  • 本工具仅供学习和研究使用,请遵守相关法律法规。
  • 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
  • 项目源码地址:https://github.com/0xsline/GeminiImageApp