文生图(Text-to-Image)是通过文字描述生成图像的技术,是 AI 绘画的核心能力。理解它的原理与提示词技巧,能显著提升生成质量。
AI Glossary
文生图(Text-to-Image)指通过文字描述直接生成图像的技术。输入一句话,模型根据语义生成对应的画面——这是 AI 绘画的核心能力,也是普通人最先体验到的生成式 AI 应用。
直观理解:你当「导演」用文字描述画面(主体、场景、风格、光线),模型当「画师」把描述画出来。描述得越具体,画得越接近你的想象。
文生图模型经历了从 GAN 到扩散模型(Diffusion)的演进:
当前主流的文生图模型(Stable Diffusion、Midjourney 等及其国内版本)都基于这一思路,在分辨率、一致性、风格控制上持续进步。
提示词是文生图的「导演脚本」,遵循「主体 + 细节 + 风格 + 画质」结构:
实用技巧:
限制:
常见误区:
文生图让「文字变画面」成为现实,是生成式 AI 应用最直观的入口。掌握「主体+细节+风格+画质」的提示词结构,多轮迭代,就能稳定产出可用图像。它是内容创作、电商、设计领域的效率杠杆,也带来了版权与真实性的新议题。
用通俗中文解释 AI 技术术语,帮助你看懂工具页面里的模型、协议和工作流。