
把中文排版当母语来排
这是 Qwen 图像家族的主场。我们要求生成一张音乐会海报:四字中文标题以宋体竖排在画面左侧——得到的正是如此:每个字都正确,笔画粗细一致,英文副标题以疏排大写拼写无误——标题旁还多了一枚我们没要求的红色印章,恰恰是熟悉中文海报传统的设计师会加的东西。本页下方的双语茶叶罐也是两种文字全对。如果你的工作需要中英文同框,这就是选它最有力的理由。
Qwen Image 3 Pro 是阿里巴巴 Qwen-Image 系列的旗舰,值得用它的理由是双语排版——中英文同处一图。
Qwen Image 3 Pro 是阿里巴巴 Qwen-Image 3.0 系列的旗舰档,2026 年 7 月 21 日发布。阿里巴巴把它对准信息密集的活儿——长指令、版式、以及极小字号的画面内文字——但发布时没有技术报告、没有模型卡、也没有可下载的权重,所以竞技场分数和独立测试就是仅有的第三方证据。
它并非什么都擅长。独立测试者报告过韩文元音错乱、图表看着精致但数据出错、人像不及写实专精模型。我们自己的十次实测大多顺利——但下方的小字测试在段落中途崩掉了,仍然可读的单词里还有两个拼写错误。要追求皮肤与材质的极致写实,请用 Seedream 5 Pro;要最可靠的小字,请用 GPT Image 2。
竞技场名次来自 Artificial Analysis 文生图排行榜,查询于 2026 年 8 月 19 日: Artificial Analysis leaderboard
“这是阿里巴巴迄今在画面内文字上最强的模型。”
“小至 10px 的文字仍可读,皮肤与发丝质感接近摄影。”
“与 GPT Image 2、Nano Banana Pro 这类专有模型相比,只能算次一等的替代品。”
下方每张图都是 2026 年 8 月 19 日在本页生成的——十条提示词,十次首发成图,每张耗时 57 到 93 秒,并附所用的完整提示词。包括暴露出真实短板的那个测试。

这是 Qwen 图像家族的主场。我们要求生成一张音乐会海报:四字中文标题以宋体竖排在画面左侧——得到的正是如此:每个字都正确,笔画粗细一致,英文副标题以疏排大写拼写无误——标题旁还多了一枚我们没要求的红色印章,恰恰是熟悉中文海报传统的设计师会加的东西。本页下方的双语茶叶罐也是两种文字全对。如果你的工作需要中英文同框,这就是选它最有力的理由。

菜单板比一句标题难得多:三个栏目、六道菜名、六个价格和一行小字页脚要同框成立。我们得到的成图里每个单词、每个价格都正确,从手绘感的标题一直到 'Served till 11am'。有个怪癖值得知道:我们的指令用斜杠分隔菜名,模型把这些斜杠也照画到了板子上。它执行文字指令近乎过分地忠实——不想被画出来的标点,就别放进引号里。

阿里巴巴的发布宣称包括 10 像素仍可读的文字。于是我们要求生成一张复古食谱卡,上面有整整四十个单词的小字做法段落。结果是本页最诚实的一张图:标题和前五行是真实可读的英文,段落中段随即崩解成只是形似文字的墨迹,最后七行又干净地恢复。可读的单词里还有两个拼写错误——'soffened' 和 'toothpack'。在这里,展示字号的文字可靠;大段小字不可靠。让段落文字留在图外,或者事后自己排上去。
Pro 档对 1K 和 2K 分开计价,于是我们把同一条提示词各跑了一次。两张都保住了真实的风霜感皮肤——皱纹、胡茬、日晒痕——而不是这个模型家族常被诟病的抹平脸;2K 那张的渔网与缆绳细节明显更精细。两次它还都做了我们没要求的事:往场景里写字,一张在系缆柱上写了 'PIER 7',另一张在木箱上印了 'HARBOR FISHERIES',展示字号全对,而木箱字样下方更小的一行劣化了。这一对图正好概括它的性格:它不停地主动加字,字号门槛决定这些字能不能活下来。
1K · 3:2 · 76 秒
2K · 3:2 · 93 秒同一条提示词,均为首发成图。我们没有固定种子,所以两张构图不同——可比的是渲染质量,不是取景。要做严格同构图的对比,请在高级参数里固定种子。

独立评测里最尖锐的批评是数据完整性:图表看起来对,数字却是错的。我们直接去探——一条柱状图指令,给定五个精确数值并要求严格等比。成图把五个数字全部印对,星期四最高、星期五最矮的次序也对,甚至超出了指令:它自己加了一行 'Total Cups Sold: 950'——正是这五个数的正确总和——还有与数据一致的峰值标注。唯一的瑕疵是图例里多了一个图中并不存在的 'Daily Target' 系列。一次探测通过并不能撤销这条批评——评测者的失败案例有据可查——但它说明失败也并非必然。图表出手前把每个数字都核一遍;在这张图上,这件事只要一分钟。
同一批 2026 年 8 月 19 日实测里的另外四张首发成图,均附完整提示词——微距细节、双语包装、食物与 21:9 超宽画幅。十次生成合计:最快 57 秒,最慢 93 秒,中位数 79 秒。

Extreme macro photograph of an open mechanical watch movement: polished gears, blued screws, a coiled balance spring and engraved bridges, one warm raking light from the left revealing machining marks on the metal, shallow depth of field, jewel bearings glinting ruby red.

Studio product photograph of a tea tin on pale linen: the cylindrical tin's label reads '云雾龙井' in refined Chinese calligraphy across the centre, with 'MISTY DRAGONWELL — GREEN TEA' in small spaced capitals beneath it and a tiny line 'NET WT 100g' near the base, sage green and cream label design, soft window light, both scripts sharp and correctly written.

Overhead editorial food photograph of a lacquer tray holding a bowl of hand-pulled noodles in clear broth, chopsticks resting on a ceramic stand, small dishes of chilli oil and pickled greens beside it, steam rising, warm side light on a dark slate table, crisp texture in the noodles and scallions.

Ultra-wide cinematic frame: a night train crossing an illuminated bridge over a calm river, city lights doubled in the water, cool blue night tones against the warm carriage windows, anamorphic composition with the bridge running the full width of the frame.
每一条都对应本页演示过的能力——不是愿望清单。
中英文同框的包装、海报与店铺素材,两种文字都排对——上面的茶叶罐和古琴海报就是这类活。面向顾客的内容仍请母语者校对一遍。
我们的菜单测试里,三级字号、六个价格和一行页脚全部成立。把最小的字保持在标签字号而不是正文字号,就能保持可读。
机芯微距和拉面托盘展示了 Pro 档买到的东西:连贯的细小结构——齿轮齿、蒸汽、葱花——而不是被抹平的质感。
我们的五数值图表探测回来数字全对,连自加的总计都对。但在你逐个读过之前,把每个数字都当作未经核实——评测者描述的失败模式真实存在,只是并非必然发生。
我们的四十词段落中途崩掉了,独立测试者也记录过韩文的元音级错误。长文案自己排;读不懂的文字,请找看得懂的人校对。
同一个工作区、同一份订阅——在这几个之间切换只需一次点击。
| Qwen Image 3 Pro | Qwen Image 3 | GPT Image 2 | Seedream 5 Pro | |
|---|---|---|---|---|
| 每张图积分 | 1K 30 · 2K 50 | 统一 20 积分——1K 与 2K 同价 | 5 到 560 积分,按分辨率 × 质量档而定(每张参考图 +10) | 1K 50 积分 · 2K 100 积分 |
| 最高分辨率 | 2K | 2K | 4K | 2K |
| 参考图 | 3 | 3 | 16 | 5 |
| 每次出图数量 | 1 | 1 | 最多 10 张 | 1 |
| 宽高比 | 8 种,从 1:1 到 21:9 | 8 种,从 1:1 到 21:9 | 9 种,含自动 | 8 种加自动,或指定精确像素 |
| 画面内文字(我们自己的实测) | 五次测试中展示字号文字全对;一段小字正文崩掉 | 未测试 | 我们测过的模型里最可靠的一个 | 展示级文字强;CJK 正确,阿拉伯语拼写错误 |
| 我们实测的速度 | 57–93 秒,中位数 79 秒(10 次) | 未实测 | 2K 下 low 32 秒 · medium 68 秒 · high 166 秒(见其页面) | 1K 约 87 秒,2K 约 107 秒(15 次实测) |
积分、参考图上限、分辨率与宽高比数量均读取自本站模型注册表(2026 年 8 月 19 日)——GPT Image 2 按分辨率 × 质量矩阵计价,所以那一格是区间而非单一数字。速度是我们自己的实测,样本量如标注,各在其模型页面上测得。没测过的格子如实写明,而不是抄厂商数字。
把 Qwen Image 3 Pro 和其他图像模型放在同一个工作台里对比,一键即可切换。
| 模型 | qwen3/pro-text-to-image 与 qwen3/pro-image-to-image,出自阿里巴巴 Qwen 团队(Qwen-Image 3.0 系列,2026 年 7 月 21 日发布) |
|---|---|
| 竞技场排名 | Artificial Analysis 文生图竞技场第 8 名,Elo 1284——查询于 2026 年 8 月 19 日 |
| 模式 | 文生图,以及最多 3 张参考图的引导编辑 |
| 画质档位 | 1K 与 2K |
| 宽高比 | 8 种预设,从 1:1 到 21:9 超宽 |
| 每次出图数量 | 1 张 |
| 提示词控制 | 负向提示词、固定种子、自动提示词扩写(默认开启);提示词最长 5,000 字符 |
| 文字渲染 | 五次文字测试中中英文展示字号全部正确;四十词小字段落部分崩解 |
| 积分 | 1K 每张 30 积分 · 2K 每张 50 积分 |
| 实测速度 | 57–93 秒,中位数 79——我们 2026 年 8 月 19 日的 10 次生成 |
创建免费账号——不需要 API key,也不需要阿里云控制台。本页的生成器已预设为 Qwen Image 3 Pro。
先写场景,再把必须出现在画面上的文字放进引号,中英文皆可。它对引号内文字的执行近乎过分忠实——连标点也照画——所以只把你想画出来的内容放进引号。
八种宽高比最高到 21:9;用 1K 迭代、2K 出成品。运行前会显示准确的积分消耗。
固定种子可以对满意的结果做受控变体,负向提示词写明要避免什么。历史记录保留每条提示词与参数。
免费开始创作,注册即送欢迎积分。升级解锁高级模型、更快生成与 4K 输出。
按年计费 · $240/year
展示字号的画面内文字与信息密集版式,中英文兼可。它是阿里巴巴 Qwen-Image 系列的旗舰,在 Artificial Analysis 文生图竞技场排名第八、Elo 1284。我们的五次展示文字测试——海报、菜单、包装,外加两处它自己加的招牌——全部拼写正确。
先用标准版打草稿:统一 20 积分,2K 不加价。当成品需要更细的质感、或画面里有要紧的文字时,再换 Pro。两者控制项完全一致,同一条提示词和参考图可以原样带过去。
论大段小字,不强——我们的四十词段落测试在这里崩掉了,而 GPT Image 2 仍是我们测过最可靠的小字模型,它还支持 4K 和 16 张参考图。论按本地设计师习惯排出的中文或双语排版,Qwen Image 3 Pro 更强,而且每档价格固定、可预期。
我们 2026 年 8 月 19 日的十次实测:57 到 93 秒,中位数 79。生成是异步的——你可以继续做别的,结果会连同提示词和参数一起存进历史记录。
三件事值得提前规划。大段小字:我们的四十词段落回来一半是乱码,可读单词里还有两个拼错。你无法校对的文字:独立测试者记录过韩文的元音级错误。数据图表:评测者报告过图表外观正确但数字错误——我们自己的五数值探测通过了,但出手前请核对每个数字。它还会不停往场景里加没被要求的文字;展示字号通常正确,但要检查。
三者都支持。负向提示词写明要避免什么,固定种子做受控变体;自动提示词扩写保持开启可以让短指令被扩充——想让措辞被逐字执行时再关掉它。
1K 每张 30 积分、2K 每张 50 积分,每次生成一张。所选档位的准确消耗会先显示在生成按钮上,花费任何积分之前都看得到。
可以。根据我们的服务条款,你生成的图片可用于个人和商业项目。提示词内容、商标及肖像权相关责任仍由你自行承担。
生成前后的活儿都有一键工具——修饰、换风格、直接分享。