一站式多提供商AI图像生成工具,支持OpenAI、Google、阿里云等12+平台,提供文本生成、参考图保持身份、批量并行生成等完整工作流。
说明:
## 核心功能
`baoyu-image-gen` 是一款专业的AI图像生成技能,通过统一CLI封装了12+主流图像生成API,包括OpenAI GPT Image 2、Azure OpenAI、Google Imagen、OpenRouter、阿里云DashScope、智谱Z.AI GLM-Image、MiniMax、即梦Jimeng、豆包Seedream、Replicate及Agnes等。
**显著优点**:
– **多提供商统一接口**:无需学习各平台差异,一条命令切换提供商
– **身份保持生成**:支持参考图像输入,通过短指令精确保持人物/物体身份,避免长描述导致的”造新人”问题
– **批量并行处理**:自动检测多任务场景,支持JSON批处理文件与并发worker,内置10级默认并发
– **灵活配置体系**:EXTEND.md偏好文件 + 环境变量 + CLI参数三级覆盖,支持项目级/用户级/全局配置
– **Codex原生集成**:独有`codex-cli`提供商,直接使用Codex订阅无需OpenAI API key
**潜在局限性**:
– 参考图像支持因提供商而异(Jimeng、Seedream 3.0等不支持)
– 首次使用需完成配置初始化(阻塞式Step 0)
– 部分高级功能(如ratio-metadata方言)仅限特定场景
– 依赖Bun/Node运行时环境
**适合人群**:内容创作者、AI艺术工作者、需要批量生成插图的技术写作者、追求身份一致性的角色设计场景。
**常规风险**:API密钥管理不当、批量任务成本失控、参考图像身份漂移、提供商服务稳定性差异。







