---
name: image-generation
description: 将用户简短的主题、场景或页面需求扩展为完整可执行的生图提示词,并调用 generate_image 生成、校验和交付真实位图。用于勾选 AI 配图、要求主图/背景图/封面/插画/照片、视觉类 H5 页面,或系统自动判断需要新视觉资产的场景。
---
# 智能生图
用户只需说明“做什么”和大致感觉。不要要求用户理解 `purpose`、负面提示词、构图术语、尺寸、模型或 `jobId`;由本技能补齐这些内容并实际完成生成。
## 执行原则
1. 保留用户明确给出的主题、主体、时代、地点、文字、风格和禁用项,不擅自改题。
2. 信息足够时直接生成。只有缺失会导致互斥结果的关键选择时才追问,例如“真人照片还是卡通角色”。
3. 页面主图默认使用一次 `generate_image(purpose=hero)`。不要为了卡片和信息流再次生成同主题图片。
4. 正面描述放入 `prompt`,禁止项放入独立的 `negative_prompt`,不要把大量 `NO...` 混进正面描述。
5. 必须生成 PNG、JPEG 或 WebP 位图;禁止用 SVG、CSS 绘图、旧图、占位图、网页搜索图片或纯色块冒充新图。
6. 本轮必须出现新的工具请求与返回。历史 `jobId`、历史路径和旧图片不能作为本轮结果。
## 从短需求扩展提示词
按以下槽位补全。用户没有指定时,选择与主题最自然、最克制的方案,不要堆砌互相冲突的风格词。
1. **媒介与真实度**:写实摄影、电影剧照、商业产品摄影、精致插画等。
2. **核心主体**:谁或什么是视觉中心;明确数量、服饰、材质、动作与表情。
3. **时间与地点**:国家、城市、年代、季节、天气、昼夜。
4. **环境元素**:必须同时出现的建筑、地貌、街市、室内陈设或自然景观。
5. **构图**:hero 默认宽幅远景或建立镜头,主体层级清晰,为标题保留可读空间。
6. **光线与色彩**:光源、冷暖关系、主色和氛围。
7. **叙事状态**:人物自然活动,避免排队合影、僵硬摆拍和无意义拼贴。
8. **交付质量**:single continuous scene、cinematic lighting、realistic detail、no text。
推荐正面提示词结构:
```text
[媒介与风格],[时间地点]。[核心主体与动作]。[必须出现的环境元素]。
[构图与镜头]。[光线、色彩和情绪]。single continuous scene,画面内无文字。
```
## 自动补充负面提示词
所有任务默认加入:
```text
text, caption, watermark, logo, collage, montage, split screen,
duplicate subject, deformed anatomy, low resolution, blurry, oversaturated
```
再按主题追加:
- **历史文化**:modern building, skyscraper, asphalt road, car, utility pole, wire, modern streetlight, modern sign, modern tourist, modern clothing, suit, jacket, sneakers, face mask。
- **自然旅行**:city skyline, crowd, vehicle, power line;但用户明确要求城市或人群时不要加入冲突项。
- **产品摄影**:wrong logo, extra product, distorted packaging, unreadable label, cluttered background。
- **人物肖像**:extra fingers, malformed hands, duplicate face, plastic skin;不要擅自改变用户指定的人种、年龄和服饰。
- **美食**:inedible object, deformed tableware, messy spill, artificial plastic texture。
每次生成前检查正负提示词是否冲突。例如正面要求“热闹人群”时,负面不得出现 `crowd`;正面要求城市夜景时,负面不得出现 `city skyline`。
## 常见主题模板
### 历史文化与古城
- 明确朝代、代表性建筑、传统材料、服饰、人群活动和夜空/天气。
- 用“historical costume drama movie still”增强时代一致性。
- 对现代建筑、交通、服装、标识和基础设施使用严格负面约束。
- 不要只生成牌坊、空街或人物合影;用户要求节庆时必须同时写明街市、灯饰、摊位与自然流动的人群。
### 旅行与自然风光
- 明确目的地标志性地貌、季节、天气、住宿或旅行活动。
- 默认采用真实旅行电影画面,避免廉价旅游海报和画面内文字。
- 若用户只说“安静、有电影感”,自动采用少量人物或无人远景、自然环境光、克制色彩和宽幅构图。
### 商品、品牌与美食
- 商品必须是唯一视觉主体,材质、包装、使用场景和目标人群一致。
- 不编造品牌 Logo、认证、价格、功效或包装文字。
- 为标题和 CTA 留出干净区域,但不要生成带文字按钮的图片。
### 人物与生活方式
- 补齐年龄段、服装、动作、环境和镜头距离。
- 默认使用自然抓拍感,避免证件照、排队合影和僵硬直视镜头。
- 用户未要求名人时,不生成可识别公众人物。
## 工具调用
1. 根据用途选择:
- 页面首屏、背景、专题主视觉:`hero`
- 正文确实需要独立插图:`inline_image`
- 只有后台关闭 hero 且仅需封面时:`card_cover` 或 `feed_cover`
2. 调用:
```json
{
"purpose": "hero",
"prompt": "完整正面提示词",
"negative_prompt": "独立负面提示词"
}
```
3. 不要先写 HTML 再补图。页面任务必须先生成并确认图片成功,再写页面。
4. 工具已把图片保存到用户工作区。HTML 的 `
`、CSS 背景图和 `mindspace-cover.cover` 必须直接使用返回的 `asset.htmlSrc`。`workspaceRelativePath` 只用于 `read_file`、`list_dir` 等工作区文件操作,禁止直接写进 HTML;也禁止再用 shell、curl 或下载操作复制图片。
示例:工具返回 `workspaceRelativePath: "public/images/hero.webp"` 与 `htmlSrc: "images/hero.webp"` 时,HTML 必须写 `
`,不得写 `
`。
## 成功与重试
成功结果必须同时满足:
- `ok=true`
- 新的非空 `jobId`
- 状态为 `ready` 或等价成功状态
- `source.mimeType` 为 `image/png`、`image/jpeg` 或 `image/webp`
- 返回非空 `asset.htmlSrc`,供页面直接引用
出现以下情况时不得宣称完成:工具未调用、返回失败、没有位图、使用旧路径、图片未落盘,或页面没有真正引用本轮图片。
首次结果明显遗漏用户的核心元素时,收紧提示词后最多重试两次:提高遗漏主体的描述优先级,删除冲突修饰词,并把错误元素加入 `negative_prompt`。不要无上限循环。
## 页面集成
页面任务还必须加载 `static-page-publish`:
1. 用本轮图片作为 `
` 或 CSS `background-image` 的真实资源;CSS 只负责布局,不能绘制替代主图。
2. Hero 默认占满首屏,使用 `object-fit: cover` 或 `background-size: cover`。
3. `mindspace-cover.cover` 与页面 Hero 引用同一张图,缩略图和信息流封面复用它。
4. 图片路径优先使用工作区相对路径,避免把仅本机可用的临时绝对路径写进页面。
5. 交付前确认页面与图片均可访问,标题未被裁切,移动端仍能看到关键主体。
## 向用户报告
用户不需要阅读完整提示词。完成后简洁报告:
- 页面或图片链接
- `jobId`
- 图片尺寸与格式
- 状态
- 实际使用的工作区路径
若失败,报告真实错误和下一步;不得以“已经安排”“正在下载”或旧图片链接代替结果。