
Gemini Image
- 6 installs
- 44 repo stars
- Updated December 11, 2025
- ceeon/gemini-image-skill
Generates images from text or reference images by building a prompt and calling an image-generation API, returning the resulting image URL.
About
Triggers on drawing intent and produces images via text-to-image, image-to-image, or multi-image reference by calling an image API with a key from config. A developer uses it when a user asks to draw, paint, or generate an image.
- Supports text-to-image, image-to-image, and multi-image reference modes
- Reads API key from config and returns the image URL from the response
Gemini Image by the numbers
- 6 all-time installs (skills.sh)
- Ranked #1,096 of 1,335 Generative Media skills by installs in the Skillselion catalog
- Data as of Jul 28, 2026 (Skillselion catalog sync)
npx skills add https://github.com/ceeon/gemini-image-skill --skill gemini-imageAdd your badge
Show developers this skill is listed on Skillselion. Paste this into your README.
| Installs | 6 |
|---|---|
| repo stars | ★ 44 |
| Last updated | December 11, 2025 |
| Repository | ceeon/gemini-image-skill ↗ |
What it does
Generates images from text or reference images by building a prompt and calling an image-generation API, returning the resulting image URL.
Files
Gemini 图像生成
当用户表达画图意图时(如"画一个..."、"生成图片..."、"帮我创作..."),使用此 Skill。
调用步骤
1. 读取配置
- 读取
config/secrets.md获取 API Key
2. 构造 prompt
| 模式 | prompt 格式 | 示例 |
|---|---|---|
| 文生图 | 描述文字 | 一只可爱的橘猫 |
| 图生图 | 图片URL 描述文字 | https://xxx.jpg 画类似风格 |
| 多图参考 | URL1 URL2 描述文字 | https://a.jpg https://b.jpg 融合两张图 |
图生图需先上传图片,参考 tips/image-upload.md。
3. 调用 API
curl -s -X POST "https://api.apicore.ai/v1/images/generations" \
-H "Authorization: Bearer API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "模型名称",
"prompt": "提示词",
"size": "尺寸比例",
"n": 1
}'4. 返回结果
从响应中提取 data[0].url 返回给用户。
参考文档
tips/image-upload.md- 图片上传方法tips/chinese-text.md- 中文文字处理技巧
API 密钥配置
使用步骤:
1. 复制此文件为 secrets.md
2. 将下方 <YOUR_API_KEY> 替换为你的真实 API Key
3. API Key 获取地址:https://ismaque.org/register?aff=npk7
API_KEY=<YOUR_API_KEY>
Gemini Image Skill
Claude Code Skill,通过自然语言生成图片。支持文生图和图生图。
获取 API Key
1. 访问 ismaque.org/register 2. 注册账号并获取 API Key 3. 将 Key 填入 secrets.md 文件中
安装
# 1. 复制到 Claude Code skills 目录
cp -r gemini-image-skill ~/.claude/skills/gemini-image
# 2. 复制模板文件并填入 API Key
cd ~/.claude/skills/gemini-image
cp secrets.example.md secrets.md
# 3. 编辑 secrets.md,填入你的 API Key
nano secrets.md重启 Claude Code 即可使用。
使用示例
直接对 Claude 说:
| 说法 | 效果 |
|---|---|
| "画一只可爱的小猫" | 文生图,标准模型 |
| "用 4K 模型生成日落图片" | 文生图,4K 超清 |
| "画一张 16:9 的山水画" | 文生图,横版宽屏 |
| "根据这张图 URL 画类似的" | 图生图 |
文件说明
gemini-image/
├── SKILL.md # Skill 入口和调用指令
├── config.md # API 配置(模型、尺寸选项)
├── secrets.md # API Key(需填入你的密钥)
└── README.md # 说明文档支持的模型
| 模型 | 说明 |
|---|---|
gemini-3-pro-image-preview | 标准版(默认) |
gemini-3-pro-image-preview-2k | 2K 高清 |
gemini-3-pro-image-preview-4k | 4K 超清 |
支持的尺寸
1:1(默认)、16:9、9:16、4:3、3:4、3:2、2:3、4:5、5:4、21:9
中文文字处理技巧
AI 图像生成对中文文字的处理有局限性,以下技巧可提高准确率。
提示词技巧
| 技巧 | 示例 | 说明 |
|---|---|---|
| 明确指出具体文字 | 把「肥」字改成「爬」字 | 比"修正错别字"效果好 |
| 使用引号标注 | 将「又要肥楼了」改为「又要爬楼了」 | 清晰标注原文和目标 |
| 强调只改一处 | 只改这一个字,图片其他部分完全不动 | 避免整体被重绘 |
| 一次只改一处 | 不要同时要求修改多处文字 | 降低复杂度 |
推荐提示词模板
图片URL 这张图左上角黄色对话框里写的是「原文」,请把「X」字改成「Y」字,变成「目标文字」。只改这一个字,图片其他部分完全不动。注意事项
1. 多次尝试:同样的提示词可能需要 2-3 次才成功,AI 生成有随机性 2. 检查结果:每次生成后务必检查文字是否正确 3. 原图质量:原图文字越清晰,AI 越容易识别和保持 4. 简化指令:复杂的多处修改拆分成多次单独修改
图片上传(图生图必需)
本地图片需先上传到图床获取 URL,才能用于图生图。
推荐图床
Litterbox(临时,1小时有效)
curl -s -F "reqtype=fileupload" -F "time=1h" -F "fileToUpload=@本地图片路径" https://litterbox.catbox.moe/resources/internals/api.phpCatbox(永久)
curl -s -F "reqtype=fileupload" -F "fileToUpload=@本地图片路径" https://catbox.moe/user/api.php使用方式
1. 上传图片,获取返回的 URL 2. 将 URL 放在 prompt 开头,后面跟描述文字
示例:
https://litter.catbox.moe/xxxxx.png 将这张图片进行4K增强,保持原有内容不变