CPU3D3D、视频与音频的 AI 工具

Qwen(通义千问)发布用于改写提示词的模型 Qwen-Image-2.1-PE-T2I

2026 年 9 月 20 日,模型 Qwen/Qwen-Image-2.1-PE-T2I 在 HuggingFace 上发布。这不是图像生成器,而是用于准备提示词的辅助模型:它接收任意语言的简短描述,并将其转换为详细的英文提示词,同时给出主模型 Qwen-Image-2.1 的推荐宽高比。

这意味着什么

该模型包含 94 亿参数,仓库中的模型权重以 safetensors 格式占用 17.5 GB,最大的文件为 4.7 GB。架构为 DiT,是视觉语言模型 Qwen3.5-VL 9B 的微调版本。许可证为 Qwen RESEARCH LICENSE AGREEMENT:仅可在非商业目的、研究或评估中使用、修改和分发该模型。商业应用需向权利人申请单独许可证。分发时须附上许可证副本、保留署名声明并标注修改。若该模型被用于训练其他 AI 模型,须在文档中注明「Built with Qwen」或「Improved using Qwen」。 开发者未说明最低显存要求,也未说明具体用什么来运行该模型。代码已开源,因此只要有合适的 GPU,就可以在本地部署该模型。对于已经在使用 Qwen-Image-2.1 的人来说,这个模型无需外部服务即可解决提示词准备的问题。想关注生成工具的相关动态,可以查看 CPU3D 动态
Qwen-Image-2.1-PE-T2I:提示词准备 简短提示词 任意语言 场景描述 Qwen-Image-2.1-PE-T2I 9.4 亿参数 DiT,Qwen3.5-VL 9B 微调 17.5 GB safetensors 许可证:RESEARCH 详细提示词 英文 含宽高比 比例 Qwen-Image-2.1 主模型 图像生成 无需外部服务 图像 已生成 本地 模型为 Qwen-Image-2.1 准备提示词,替代外部服务
该方法的原理。示意图根据这篇简讯绘制。

相关阅读