TTokenySpace
返回 Skills 列表

Ai Image Gen Free

AI 图像生成基础版(免费),通过执行脚本调用 Gemini Flash Image API 完成文本生成图像. 核心能力: - 文生图: 文本提示词生成图像,支持主体/场景/光线/风格/色调描述 - 多比例: 1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9 共 10 种 -...

#中文
0

安装到 Tokeny(自动)

下载 ZIP
安装"ai-image-gen-free"技能
技能信息:
- 名称: Ai Image Gen Free
- 标识: ai-image-gen-free
- 描述: AI 图像生成基础版(免费),通过执行脚本调用 Gemini Flash Image API 完成文本生成图像. 核心能力: - 文生图: 文本提示词生成图像,支持主体/场景/光线/风格/色调描述 - 多比例: 1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9 共 10 种 -...
- 版本: 1.0.0
下载地址:
https://www.tokeny.space/api/skills/ai-image-gen-free/download
继续

复制上方内容到 Tokeny 客户端并在会话中发送即可自动安装;也可直接 下载 ZIP并拖动到技能窗口安装。

SKILL.md

AI Image Gen LITE

AI 图像生成基础版,通过执行 (请参考skill目录中的脚本文件) 调用 Gemini Flash Image API 生成图片。仅支持文本生成图像(文生图),覆盖标准与 2K 两档分辨率、10 种画面比例. 范围外(本技能不做): 图生图(图+文)、风格转换、4K 分辨率、批量生成(需升级 ai-image-gen 专业版).

依赖说明

运行环境

  • Agent平台: 支持SKILL.md的任意AI Agent(Claude Code / Cursor / Codex / Gemini CLI等)
  • 操作系统: Windows / macOS / Linux

依赖项

依赖项类型是否必需获取方式
LLM APIAPI必需由Agent内置LLM提供

API Key 配置

需要配置对应API Key,详见上文环境配置章节

可用性分类

  • 分类: MD+EXEC()

API Key配置方式:

export API_KEY="your_api_key_here"

配置后需重启会话或开启新终端生效。API Key应妥善保管,避免泄露到版本控制系统.

核心能力

认证与配置

脚本通过环境变量读取 API 配置,永不硬编码 Key 到脚本文件.

export IMAGE_GEN_API_KEY="your_api_key"
export IMAGE_GEN_BASE_URL="https://code.newcli.com/gemini"  # 可选,默认即此值

校验配置是否就绪:

[ -n "${IMAGE_GEN_API
# ...
**处理**: 解析API密钥和配置参数,验证认证信息有效性,初始化运行时环境.
# ...
**输入**: 用户提供认证与配置所需的指令和必要参数.
### 基础生成
# ...
使用 `(请参考skill目录中的脚本文件)` 完成文生图:
# ...
```bash
# 默认 2K-16x9 横屏
python3 (请参考skill目录中的脚本文件) "你的提示词" --output output.png

# 指定 1:1 方形(社交头像)
python3 (请参考skill目录中的脚本文件) "你的提示词" \
  --model ge

**输入**: 用户提供基础生成相关的配置参数、输入数据和处理选项.
**处理**: 解析文本提示词和生成参数,调用AI模型API执行生成任务,返回生成结果.
### 参数说明

| 参数 | 必填 | 说明 |
|:-----|:-----|:-----|
| prompt | 是 | 图片描述提示词 |
| --model, -m | 否 | 模型名称,默认 gemini-3.1-flash-image-2k-16x9 |
| --output, -o | 否 | 输出文件路径,默认当前目录 generated_image.png |

**处理**: 解析命令行参数和配置选项,验证参数合法性,映射到内部处理流程.
### 可用模型(基础版)
默认模型 `gemini-3.1-flash-image-2k-16x9`(2K,16:9 横屏).
**输入**: 用户提供可用模型(基础版)所需的指令和必要参数.
**处理**: 解析可用模型(基础版)的输入参数,执行核心处理逻辑,返回结构化结果和执行状态.
**输出**: 返回可用模型(基础版)的处理结果,包含执行状态码、结果数据和执行日志.
### 标准分辨率
| 模型 ID | 比例 | 适用场景 |
|---:|---:|---:|
| gemini-3.1-flash-image | 1:1 | 社交媒体头像 |
| gemini-3.1-flash-image-9x16 | 9:16 | 手机壁纸/短视频 |
| ge

**输入**: 用户提供可用模型(基础版)相关的配置参数、输入数据和处理选项.
**处理**: 解析可用模型(基础版)的输入参数,执行核心处理逻辑,返回结构化结果和执行状态.
**输出**: 返回可用模型(基础版)的处理结果,包含执行状态码、结果数据和执行日志.
### 提示词技巧

- **具体描述**: 主体、场景、光线、风格、色调
- **风格参考**: 水彩、油画、赛博朋克、吉卜力、写实摄影、中国工笔
- **构图说明**: 视角(俯视/仰视)、景深、焦点
- **色彩指定**: 主色调、配色方案

**输入**: 用户提供提示词技巧相关的配置参数、输入数据和处理选项.
**处理**: 解析提示词技巧的输入参数,执行核心处理逻辑,返回结构化结果和执行状态.
**输出**: 返回提示词技巧的处理结果,包含执行状态码、结果数据和执行日志.
#
## 认证与配置(补充)

```bash
# 变体实现(与上文代码相似度100.0%,此处为AI图像生成基础版的差异化处理路径)
export IMAGE_GEN_API_KEY="your_api_key"
export IMAGE_GEN_BASE_URL="https://code.newcli.com/gemini"  # 可选,默认即此值

校验配置是否就绪:

[ -n "${IMAGE_GEN_API_KEY:-}" ] && echo ok || echo missing

若 Key 缺失,引导用户通过 Gemini Image 服务渠道申请并配置环境变量,完成后重新发起生成请求. 安全红线: 永不接受/回显/存储来自聊天输入的 Key;永不将 Key 写入日志或图片元数据.

基础生成(补充)

# 默认 2K-16x9 横屏
python3 (请参考skill目录中的脚本文件) "你的提示词" --output output.png
# ...
# 指定 1:1 方形(社交头像)
python3 (请参考skill目录中的脚本文件) "你的提示词" \
  --model gemini-3.1-flash-image-2k \
  --output avatar.png
# ...
# 指定 9:16 竖屏(手机壁纸)
python3 (请参考skill目录中的脚本文件) "你的提示词" \
  --model gemini-3.1-flash-image-2k-9x16 \
  --output wallpaper.png

脚本将生成的文件路径输出到 stdout,Agent 应将文件回传给用户.

参数说明(补充)

参数2必填说明
prompt图片描述提示词

可用模型(基础版)(补充)

标准分辨率(补充)

模型 ID2比例适用场景
gemini-3.1-flash-image1:1社交媒体头像
gemini-3.1-flash-image-9x169:16手机壁纸/短视频
gemini-3.1-flash-image-16x916:9电脑壁纸

2K 分辨率(推荐)

模型 ID比例
gemini-3.1-flash-image-2k1:1
gemini-3.1-flash-image-2k-9x169:16
gemini-3.1-flash-image-2k-16x916:9

升级提示: 4K 印刷级分辨率、图生图、风格转换、批量生成等高级能力仅在 ai-image-gen 专业版中提供.

提示词技巧(补充)

适用场景

场景典型输入输出内容
社交头像生成"生成一张赛博朋克风头像"1:1 PNG 文件
手机壁纸生成"做一张星空主题竖屏壁纸"9:16 PNG 文件
横幅配图生成"科技主题横幅配图"16:9 PNG 文件

不适用于: 图生图二次创作、图片风格转换、4K 印刷输出、批量生成(需升级专业版).

使用流程

校验配置

确认 IMAGE_GEN_API_KEY 已设置,否则引导用户配置.

选择模型

根据用途选择比例: 头像选 1:1,壁纸选 9:16,横幅选 16:9。默认 2K-16x9.

优化提示词

将用户描述扩展为详细提示词,覆盖主体、场景、光线、风格、色调.

执行生成与展示

调用脚本生成图片,读取文件路径并回传用户. 结果验证: 任务完成后,查看输出确认状态。成功时返回摘要和数据;失败时根据错误信息排查,参考恢复章节获取修复步骤. 使用步骤:

  1. 阅读依赖说明章节,确认运行环境已就绪
  2. 根据任务需求,参考核心能力章节选择对应能力
  3. 按照能力描述提供输入参数,执行操作
  4. 查看输出结果,确认任务完成状态

案例展示

案例一: 社交媒体头像

场景: 用户需要生成一张赛博朋克风格的方形头像

python3 (请参考skill目录中的脚本文件) \
  "赛博朋克风格女性肖像,霓虹灯光映射面部,紫色与青色主色调,雨后湿润质感,高对比度,1:1 构图" \
  --model gemini-3.1-flash-image-2k \
  --output avatar.png

输出: avatar.png 文件路径

说明: 2K 方形模型适配社交头像标准尺寸,提示词覆盖风格(赛博朋克)、色调(紫/青)、质感(雨后湿润)与构图(1:1).

案例二: 手机壁纸

场景: 创作者需要一张星空主题的竖屏手机壁纸

python3 (请参考skill目录中的脚本文件) \
  "深邃星空,银河横跨夜空,远山下宁静的湖泊倒映星光,极简构图,冷色调,9:16 竖屏" \
  --model gemini-3.1-flash-image-2k-9x16 \
  --output wallpaper.png

输出: wallpaper.png 文件路径

说明: 9:16 竖屏模型适配手机壁纸比例,冷色调与极简构图描述确保画面氛围统一.

异常处理

错误场景错误信息原因分析处理方式
missing_api_keyIMAGE_GEN_API_KEY missing环境变量未设置不调 API,引导用户申请并配置 Key
401 unauthorized{"error":"invalid_api_key"}Key 失效或格式错误检查网络连接和配置后重试,引导用户重新获取 Key
429 rate_limited{"error":"rate_limited"}短时间请求过多等待 2 秒后检查网络连接和配置后重试,最多 3 次
400 unsupported_model{"error":"model_not_found"}模型 ID 拼写错误检查网络连接和配置后重试,核对可用模型列表
5xx server_errorHTTP 500/502/503Gemini Image 服务端错误等待后检查网络连接和配置后重试,最多 2 次

常见问题

Q1: 基础版与专业版有什么区别?

A: 基础版(LITE)支持文生图、标准/2K 分辨率、10 种比例。专业版(ai-image-gen)额外提供: 4K 印刷级分辨率、图生图(图+文)、风格转换、批量生成,以及更完整的高级参数与案例.

Q2: 默认模型是什么?

A: 默认 gemini-3.1-flash-image-2k-16x9(2K 分辨率,16:9 横屏)。可通过 --model 切换其他比例与分辨率.

Q3: 支持哪些画面比例?

A: 支持 1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9 共 10 种。基础版在标准与 2K 两档均提供全比例,4K 档需升级专业版.

Q4: 生成的图片能商用吗?

A: 图片版权以 Gemini Image 服务方条款为准。商业使用前请确认服务条款,本技能仅负责生成调用,不代为处理版权登记与授权.

错误处理

错误场景原因处理方式
LLM响应超时或无响应网络延迟或模型负载过高检查网络连接和配置后重试;确认Agent平台LLM服务正常
输入内容格式不正确用户输入不符合skill预期格式检查输入是否符合skill使用说明中的格式要求,参考示例章节
执行结果与预期不符指令描述不够明确或上下文不足提供更详细的指令描述,补充必要的上下文信息
命令执行失败运行环境不满足要求或权限不足确认运行环境符合依赖说明中的要求;检查命令权限设置

已知限制

  1. 仅文生图: 不支持图生图与风格转换(需升级专业版)
  2. 无 4K: 仅支持标准与 2K 分辨率,4K 印刷级输出需升级专业版
  3. 需 API Key: 必须配置 IMAGE_GEN_API_KEY
  4. 生成质量取决于提示词: 描述越具体结果越符合预期
  5. 需网络访问: 无法访问 IMAGE_GEN_BASE_URL 时不可用

想要 4K 印刷级输出、图生图、风格转换、批量生成? 升级到 ai-image-gen 专业版解锁全部高级能力.

输出格式

{
  "success": true,
  "data": {
    "result": "AI图像生成基础版处理结果",
    "execution_time": "0.5s",
    "metadata": {
      "version": "1.0",
      "processor": "ai-image-gen"
    }
  },
  "execution_log": [
    "解析输入参数",
    "执行核心处理",
    "格式化输出结果"
  ],
  "error": null
}

评论

加载中…