Stable Diffusion提示词2026:正向+反向Prompt模板
很多朋友问我Stable Diffusion提示词到底怎么写,网上的教程要么太简单要么太复杂。这篇文章我尽量写得实操一些,从基础语法到高级技巧全覆盖,看完就能直接用。我从2023年开始使用Stable Diffusion,从SD 1.5到SDXL再到现在的SD3.5,生成过超过5万张图片,踩了无数坑。今天把积累的所有Prompt经验一次性分享给大家。
Stable Diffusion提示词简介
SD正向和反向提示词完整指南,附可直接使用的模板。Stable Diffusion是目前最强大的开源AI绘画工具,它的提示词系统与ChatGPT等文本AI完全不同——你需要用特定的语法和关键词来精确描述你想要的画面。

Stable Diffusion提示词的核心优势在于:
- 完全免费:开源模型,本地部署零成本
- 高度可控:通过提示词精确控制画面每个元素
- 生态丰富:Civitai上有百万级模型和LoRA可用
- 持续更新:社区迭代速度快,SD3.5质量已接近Midjourney
- 隐私安全:本地运行,数据不出电脑
安装与部署
方式一:WebUI(推荐新手)
最主流的Stable Diffusion界面是AUTOMATIC1111的WebUI:

- 安装Python 3.10和Git
- 克隆仓库:
git clone https://github.com/AUTOMATIC1111/stable-diffusion-webui.git - 运行
webui-user.bat(Windows)或webui.sh(Mac/Linux) - 等待自动安装依赖,首次启动约10分钟
- 浏览器打开
http://127.0.0.1:7860即可使用 - 下载模型文件放入
models/Stable-diffusion/目录
硬件要求:最低6GB显存的NVIDIA显卡(推荐8GB以上),16GB内存,50GB硬盘空间。
方式二:ComfyUI(进阶用户)
ComfyUI是节点式的SD界面,更灵活但学习曲线更陡:
- 支持复杂的工作流编排
- 内存占用更低
- 可以精确控制每个处理步骤
- 适合批量生产和自动化流程
方式三:在线平台(零配置)
如果不想本地部署,可以使用在线平台:
- Civitai:模型社区,部分模型支持在线生图
- Leonardo.ai:免费的在线SD平台,每日150张
- SeaArt:中文友好的在线SD平台
- Google Colab:免费GPU,适合临时使用
方式四:API调用(开发者)
通过Stability AI的官方API集成到项目中:
import requests
response = requests.post(
"https://api.stability.ai/v2beta/stable-image/generate/core",
headers={"Authorization": "Bearer your-api-key"},
files={"prompt": "a beautiful sunset over mountains"},
)
SD与竞品AI绘画工具对比
我测试了2026年主流的AI绘画工具,以下是详细对比:

| 对比维度 | Stable Diffusion 3.5 | Midjourney V7 | DALL-E 4 | Flux Pro | Leonardo.ai |
|---|---|---|---|---|---|
| 图片质量 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 可控性 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 上手难度 | 较难 | 简单 | 简单 | 中等 | 中等 |
| 价格 | 免费(本地) | $10-60/月 | $15/月 | $0-30/月 | 免费-$12/月 |
| 生成速度 | 取决于显卡 | 30-60秒 | 10-15秒 | 5-10秒 | 10-20秒 |
| 模型选择 | 无限(开源) | 固定 | 固定 | 多个 | 多个 |
| 中文理解 | 一般(需翻译) | 较好 | 好 | 较好 | 一般 |
| 隐私性 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐ | ⭐⭐ | ⭐⭐⭐ |
| 商业授权 | 完全自由 | 需付费版 | 需付费版 | 需付费版 | 需付费版 |
我的建议:追求极致可控性和免费使用选Stable Diffusion,追求简单快速出图选Midjourney,追求中文理解选DALL-E 4。
正向提示词(Positive Prompt)完整指南
正向提示词告诉AI”你想要什么”。一个好的正向Prompt通常包含以下要素,按重要性排列:

提示词结构公式
[质量词] + [媒介/风格] + [主体描述] + [环境/背景] + [光影] + [构图] + [色调]
要素一:质量提升词
这些词放在Prompt最前面,用于提升整体图片质量:
| 质量词 | 效果说明 | 适用场景 |
|---|---|---|
| masterpiece, best quality | 基础质量提升 | 所有场景 |
| ultra detailed, highres | 增加细节和分辨率 | 需要细节的场景 |
| 8k, photorealistic | 超高清照片效果 | 写实风格 |
| professional, award-winning | 专业水准 | 商业作品 |
| intricate details, sharp focus | 精细细节和锐对焦 | 特写和微距 |
| RAW photo, DSLR | 相机RAW效果 | 摄影风格 |
| cinematic lighting, dramatic | 电影级光影 | 电影感场景 |
| studio quality, soft lighting | 棚拍效果 | 人像和商业摄影 |
要素二:媒介与风格
| 风格类型 | 关键词示例 | 效果 |
|---|---|---|
| 摄影写实 | photograph, DSLR, 35mm, film grain | 真实照片效果 |
| 数字绘画 | digital painting, concept art, illustration | 数字插画风格 |
| 油画 | oil painting, canvas texture, brush strokes | 传统油画质感 |
| 水彩 | watercolor, soft edges, color bleeding | 水彩画效果 |
| 动漫 | anime style, cel shading, manga | 日式动漫风格 |
| 3D渲染 | 3D render, octane render, unreal engine 5 | 3D立体效果 |
| 像素艺术 | pixel art, 16-bit, retro game style | 复古像素风 |
| 赛博朋克 | cyberpunk, neon lights, futuristic | 赛博朋克风格 |
要素三:主体描述
主体描述是Prompt的核心,需要尽可能详细:
人物描述示例:
1girl, solo, 25 years old, long black hair, brown eyes,
wearing white dress, smiling, standing in garden
场景描述示例:
a medieval castle on a cliff, overlooking the ocean,
stormy sky, lightning in background, ancient stone walls
物品描述示例:
a vintage pocket watch, gold color, intricate engravings,
roman numerals, leather chain, on wooden table
要素四:光影与环境
| 光影类型 | 关键词 | 效果 |
|---|---|---|
| 自然光 | natural lighting, golden hour, sunlight | 温暖自然的光线 |
| 逆光 | backlighting, silhouette, rim light | 轮廓发光效果 |
| 伦勃朗光 | Rembrandt lighting, dramatic shadows | 经典人像光影 |
| 霓虹灯 | neon lights, colorful glow, cyberpunk | 科幻感光线 |
| 体积光 | volumetric lighting, god rays, fog | 光线穿透效果 |
| 月光 | moonlight, night scene, blue hour | 夜晚氛围 |
| 烛光 | candlelight, warm glow, soft shadows | 温馨氛围 |
要素五:构图与镜头
| 构图类型 | 关键词 | 效果 |
|---|---|---|
| 特写 | close-up, macro, extreme detail | 面部或物体特写 |
| 半身 | upper body, medium shot, waist up | 半身人像 |
| 全身 | full body, wide shot, from head to toe | 全身展示 |
| 鸟瞰 | bird’s eye view, top down, aerial | 俯视角度 |
| 低角度 | low angle, looking up, worm’s eye | 仰视角度 |
| 广角 | wide angle, panoramic, fisheye | 宽广视野 |
| 长焦 | telephoto, compressed perspective, bokeh | 背景虚化 |
反向提示词(Negative Prompt)完整指南
反向提示词告诉AI”你不想要什么”,是SD中非常重要的组成部分。
通用反向提示词模板
(worst quality:1.4), (low quality:1.4), blurry, text, watermark,
signature, username, cropped, out of frame, duplicate,
deformed, ugly, disfigured, mutation, extra limbs,
extra fingers, missing fingers, bad anatomy, bad hands,
bad proportions, glitch, artifacts, noisy, grain
按场景的反向提示词
人像摄影反向:
(worst quality:1.4), (low quality:1.4), blurry, text, watermark,
deformed, ugly, bad anatomy, bad hands, extra fingers,
missing fingers, extra arms, fused fingers, poorly drawn hands,
long neck, mutated, cross-eyed, bad proportions,
disfigured, gross proportions, malformed limbs,
missing arms, missing legs, extra arms, extra legs,
cloned face, malformed, cropped, worst quality,
jpeg artifacts, signature, username
风景场景反向:
(worst quality:1.4), (low quality:1.4), blurry, text, watermark,
people, humans, buildings, cars, modern objects,
oversaturated, flat lighting, boring composition,
tilted horizon, noisy, artifacts, chromatic aberration
动漫风格反向:
(worst quality:1.4), (low quality:1.4), realistic, photograph,
3d render, blurry, text, watermark, deformed, ugly,
bad anatomy, extra limbs, bad proportions,
duplicate, morbid, mutilated, poorly drawn face,
mutation, extra fingers, fused fingers, too many fingers
反向提示词权重说明
在SD中,你可以用括号和数字来调整权重:
(keyword:1.0)- 默认权重(keyword:1.2)- 加强20%(keyword:1.4)- 加强40%(keyword:0.8)- 减弱20%(((keyword)))- 等同于高权重
实战Prompt模板(可直接复制使用)
使用Prompt的基本心得
在我生成超过五万张图片的过程中,我总结出一个核心经验:好的Prompt不是越长越好,而是要精准和有序。每个关键词都要有它存在的理由,关键词之间的排列顺序直接影响生成结果。根据我的测试,Stable Diffusion对Prompt中排在前面的关键词给予更高的权重,所以最重要的描述应该放在最前面。
另一个重要发现是,不同模型对同一个Prompt的理解可能完全不同。比如在写实模型上效果很好的关键词,放到动漫模型上可能会产生奇怪的结果。所以我建议大家在使用新模型之前,先花半小时测试不同关键词的效果,找到最适合该模型的Prompt组合。
模板1:写实人像
正向:
(masterpiece, best quality, ultra detailed:1.2),
RAW photo, portrait photograph of a young asian woman,
25 years old, natural makeup, long wavy brown hair,
looking at viewer, soft smile, wearing casual white shirt,
golden hour lighting, shallow depth of field, bokeh background,
shot on Canon EOS R5, 85mm f/1.4 lens,
cinematic color grading, film grain
反向:
(worst quality:1.4), (low quality:1.4), blurry, text, watermark,
deformed, ugly, bad anatomy, bad hands, extra fingers,
overexposed, underexposed, plastic skin, airbrushed,
cartoon, anime, illustration, painting
模板2:奇幻场景
正向:
(masterpiece, best quality:1.2), digital painting, concept art,
a mystical floating island in the sky, ancient ruins covered in vines,
waterfall cascading off the edge into clouds below,
giant glowing crystals embedded in rock,
bioluminescent plants, magical atmosphere,
dramatic sunset sky with multiple moons,
volumetric lighting, god rays through clouds,
wide angle shot, epic scale, fantasy art style,
inspired by Studio Ghibli and Lord of the Rings
反向:
(worst quality:1.4), (low quality:1.4), blurry, text, watermark,
modern buildings, cars, people, ugly, boring,
flat lighting, oversaturated, noisy, artifacts
模板3:产品摄影
正向:
(masterpiece, best quality, ultra detailed:1.2),
product photography, a luxury perfume bottle,
crystal glass with gold cap, elegant design,
on white marble surface, water droplets on bottle,
soft studio lighting, gradient background from white to gray,
reflection on surface, commercial photography,
shot with macro lens, sharp focus, clean composition,
magazine advertisement quality
反向:
(worst quality:1.4), (low quality:1.4), blurry, text, watermark,
messy background, cluttered, ugly, deformed,
cheap looking, poor lighting, amateur, noisy
模板4:动漫角色
正向:
(masterpiece, best quality:1.2), anime style,
1girl, solo, blue hair, twin tails, red eyes,
wearing school uniform, pleated skirt, ribbon,
energetic pose, jumping, cherry blossom petals falling,
bright sunny day, school rooftop background,
vibrant colors, cel shading, clean linework,
key visual quality, official art style
反向:
(worst quality:1.4), (low quality:1.4), realistic, photograph,
3d, blurry, deformed, ugly, bad anatomy,
extra limbs, bad proportions, duplicate,
poorly drawn face, mutation, text, watermark
模板5:建筑可视化
正向:
(masterpiece, best quality, ultra detailed:1.2),
architectural visualization, modern minimalist villa,
floor-to-ceiling glass walls, infinity pool,
tropical garden with palm trees,
sunset golden hour lighting, warm interior lights on,
reflecting pool, concrete and wood materials,
photorealistic render, octane render,
professional architectural photography,
drone shot, 45 degree angle, wide angle lens
反向:
(worst quality:1.4), (low quality:1.4), blurry, text, watermark,
old buildings, damaged, dirty, cluttered,
oversaturated, unrealistic proportions,
cartoon, sketch, painting style
高级参数设置指南
采样器选择
| 采样器 | 速度 | 质量 | 推荐场景 |
|---|---|---|---|
| Euler a | 快 | ⭐⭐⭐⭐ | 快速预览 |
| DPM++ 2M Karras | 中等 | ⭐⭐⭐⭐⭐ | 日常使用(推荐) |
| DPM++ SDE Karras | 慢 | ⭐⭐⭐⭐⭐ | 高质量输出 |
| DDIM | 快 | ⭐⭐⭐ | 大批量生成 |
| UniPC | 中等 | ⭐⭐⭐⭐ | 人像和风景 |
CFG Scale(提示词相关性)
- CFG 3-5:AI自由发挥多,画面更有创意但可能偏离Prompt
- CFG 7-9:平衡点,既遵循Prompt又有自然感(推荐)
- CFG 10-15:严格遵循Prompt,但可能出现过饱和和伪影
- CFG 15+:不推荐,画面质量下降
步数(Steps)
- 15-20步:快速预览
- 25-35步:标准质量(推荐)
- 40-50步:高质量输出
- 50+步:收益递减,不建议
进阶技巧
技巧一:LoRA模型组合
LoRA是小型微调模型,可以给SD增加特定风格或角色。这是Stable Diffusion生态中最强大的功能之一,因为它让你可以在不重新训练整个模型的情况下,添加特定的风格、角色或概念。
根据我的使用经验,LoRA的权重设置非常关键。权重太高会导致画面过于夸张,太低则效果不明显。一般来说,风格类LoRA的权重设置在零点五到零点八之间效果最好,角色类LoRA的权重设置在零点六到零点九之间比较合适。
我常用的LoRA组合:
- 写实人像:add_detail(增加细节)+ soft_lighting(柔光效果)+ skin_texture(皮肤质感),三个LoRA的权重分别设为零点八、零点五和零点四
- 动漫风格:anime_lineart(动漫线条)+ vibrant_colors(鲜艳色彩)+ cel_shading(赛璐璐着色),权重分别设为零点七、零点六和零点五
- 风景场景:atmospheric(氛围感)+ volumetric_lighting(体积光)+ nature_detail(自然细节),权重分别设为零点六、零点七和零点五
技巧二:区域控制(Regional Prompter)
使用Regional Prompter插件可以对画面不同区域使用不同的Prompt。这个功能在复杂场景中特别有用,比如你想让天空是夕阳效果、地面是绿色的草地、中间有一棵大树,如果使用普通Prompt,这三个元素可能会互相干扰。使用区域控制后,每个区域的描述都能被精确执行。
我在实际使用中发现,区域控制的关键在于合理划分区域边界。过于精确的边界可能会导致区域之间出现不自然的分割线,所以我通常会设置一定的重叠区域,让AI自然过渡。
技巧三:ControlNet精确控制
ControlNet可以通过参考图控制生成结果,这是让Stable Diffusion从”随机生成”进化到”精确控制”的关键工具。我在商业项目中几乎每次都会用到ControlNet,它让我的出图效率和质量都有了质的飞跃。
- Canny:保持边缘轮廓,适合根据草图生成完整图片
- Depth:保持深度关系,适合需要精确空间构图的场景
- OpenPose:控制人物姿势,是人像生成的必备工具
- Segmentation:控制区域分割,适合复杂的场景布局
- Lineart:基于线稿上色,适合漫画和插画创作
技巧四:分步生成策略
这是我总结的一套高效出图流程,适用于所有类型的图片生成:
- 先用低分辨率(五百一十二乘以五百一十二)快速测试Prompt效果,生成十到二十张图,找到最满意的构图和色调
- 确定满意的构图后,切换到目标分辨率重新生成,这一步通常需要二十五到三十五步
- 使用图生图功能进一步细化,将去噪强度设置在零点三到零点五之间,保留整体构图但提升细节质量
- 最后用高分辨率修复或外部超分辨率工具放大到最终尺寸,同时增强细节
技巧五:提示词权重微调
使用括号精确控制每个元素的权重。这是Stable Diffusion提示词系统中最精细的控制手段,掌握它可以让你对生成结果有非常精确的把控。
数字越大,该元素在画面中的存在感越强。建议每次调整幅度不超过零点二,逐步找到最佳平衡点。我在实践中发现,权重超过一点五时容易出现画面不自然的情况,所以一般将最高权重控制在一点四以内。
AI绘画的商业应用场景
根据我的实际经验,Stable Diffusion在以下商业场景中已经可以替代传统的图片制作方式:
场景一:电商产品图
我帮一个做跨境电商的朋友用Stable Diffusion生成产品展示图。以前他需要花几千元请摄影师拍摄产品图,现在只需要提供产品的简单照片,再用SD生成各种场景背景,将产品合成到不同场景中。每张图片的制作成本从几百元降到了接近零,而且可以选择的场景几乎没有限制。他告诉我,自从使用AI生成产品图后,他的店铺点击率提升了百分之三十,因为图片更加精美且场景丰富。
场景二:社交媒体素材
对于做自媒体运营的朋友来说,Stable Diffusion简直是救星。以前找配图要么用版权图库(每月几百元订阅费),要么用搜索引擎找图(有侵权风险)。现在可以直接用SD生成符合文章主题的原创配图。我建议他们建立一套自己的风格模板,确保所有配图在视觉上保持一致性,这样既能建立品牌识别度,又不用担心版权问题。
场景三:游戏和动漫概念设计
我认识几位独立游戏开发者,他们用Stable Diffusion快速生成游戏角色和场景的概念图。以前一个角色设计可能需要画师花两三天时间,现在用SD可以在一个小时内生成几十个不同方案,然后从中选择最满意的进行深化。这不仅大大降低了开发成本,还让创意探索的范围扩大了很多倍。
场景四:建筑和室内设计
一位室内设计师朋友告诉我,她现在用Stable Diffusion给客户展示设计方案的效果图。以前做一个3D渲染效果图需要一整天的时间,现在用SD加上ControlNet,可以在十分钟内生成多种不同风格和配色的效果图供客户选择。客户选定方案后,她再用专业软件做精确的施工图。这种方式让她的客户沟通效率提升了五倍。
常见问题与解决方案
Q1:生成的图片总是模糊不清?
原因:步数不够、CFG设置不当、或分辨率太低。 解决方案:
- 步数设为25-35
- CFG设为7-9
- 基础分辨率至少512x768(SDXL至少1024x1024)
- 添加”sharp focus, ultra detailed, 8k”到正向Prompt
- 使用Hires.fix进行二次放大
Q2:人物手指总是畸形的?
原因:这是SD的已知弱点,手指和手部生成质量不稳定。 解决方案:
- 在反向Prompt中添加”bad hands, extra fingers, missing fingers, fused fingers”
- 使用ControlNet的OpenPose控制手部姿势
- 生成后用inpainting局部重绘手部
- 选择手部质量好的模型(如SDXL比SD1.5手部更好)
- 构图上避免手部特写
Q3:图片总是和Prompt描述不一致?
原因:Prompt权重分配不合理,或使用了模型不理解的关键词。 解决方案:
- 检查拼写是否正确
- 重要元素放在Prompt前面(SD对前面的词更敏感)
- 使用括号增加关键元素的权重
- 尝试换不同的模型(不同模型擅长的风格不同)
- 减少Prompt中的元素数量,聚焦核心描述
Q4:怎么用中文写Prompt?
解决方案:
- SD的Prompt本质上是英文关键词,中文直接输入效果很差
- 使用翻译工具(DeepL或Google翻译)将中文描述转为英文
- 或者使用支持中文的SD衍生工具(如LiblibAI)
- 建议学习常用英文关键词,直接使用英文更高效
Q5:显卡显存不够怎么办?
解决方案:
- 使用—medvram或—lowvram启动参数
- 降低生成分辨率,后期用超分辨率放大
- 使用xformers优化(启动参数加—xformers)
- 关闭不必要的扩展
- 考虑使用在线平台(Google Colab免费GPU)
Q6:如何找到好的模型和LoRA?
推荐资源:
- Civitai(civitai.com):最大的模型分享社区
- Hugging Face:官方模型仓库
- LiblibAI:中文社区,适合国内用户
- 关注模型评分和下载量,选择高质量模型
- 下载前查看作者的示例图片和Prompt
相关工具推荐
以下是本文提到或相关的AI工具,点击即可查看详细介绍:
-
LocalBanana:一个专注于AI图像提示词收集与结构化的工作空间,帮助用户通过参考图像、场景或想法高效生成视觉内容。
-
蚂上有创意:蚂上有创意是支付宝官方推出的AI智能营销设计平台,为商家提供商品图生成、海报制作、图像处理及创意诊断等一站式服务,旨在通
-
Canva可画:Canva可画是一款集成AI写作、绘画、修图等功能的一站式智能设计工具平台,旨在提升设计与内容创作效率。
-
灵光AI:蚂蚁集团推出的全模态通用AI助手,支持自然语言交互、快速生成小应用及多端同步。
推荐阅读
- Stable Diffusion:Stable Diffusion教程:2026从安装到入门
- Midjourney提示词:Midjourney提示词指南2026:50个出图Prompt公式
- AI绘画赚钱:2026年AI绘画赚钱全攻略:Stable Diffusion+ComfyUI接单变现
- AI做壁纸赚钱:AI做壁纸赚钱2026:生成+分发+变现完整攻略