用不上 GPT Image 别纠结,Qwen-Image 3.0 来了
Qwen-Image 3.0 把长指令、中文小字、复杂排版和真实细节做到了一张图里。对公众号、课件、电商和设计工作来说,生图工具终于不用只盯着 GPT Image。

如果一直用不上 GPT Image,今天可以少纠结一点了。
阿里通义刚发布 Qwen-Image 3.0 。它没有把重点放在“再画得漂亮一点”,而是开始解决生图最麻烦的几件事:长提示词能不能听懂,中文小字能不能写对,复杂版式能不能一次生成,图片能不能直接拿去干活。
对做公众号、课件、电商图和产品原型的人来说,这比多一种滤镜、多一种画风实在得多。
一张图,能塞进多少有效信息
Qwen-Image 3.0 支持最长 4.5k token 的输入。官方给出的 3×3 信息图并非九张图拼接,而是一次生成。九个格子分别包含隧道安全漫画、空间几何、物理抛体运动、生物学、医学、群论、银行内控和 DNA 对比等内容,里面还有中英文、公式、图表和人物。

这类能力很适合信息卡片、课程讲义、故事板和长图。以前写得越详细,模型越容易顾此失彼;现在至少从官方案例看,长指令和多区域排版已经能一起处理。
它还展示了另一种复杂度:在一张图里依次嵌套 VS Code 、 Qwen Chat 、微信界面和手冲咖啡海报,每层都保留各自的界面特征。

这对产品原型、界面概念图和短剧分镜很有用。生图模型开始理解“界面里还有界面”,而非只在画面上摆几个相似的方框。
中文小字,终于被当成正经需求
Qwen-Image 3.0 宣称可以清晰渲染小至 10px 的文字。官方展示了鲸鲨知识图、代数几何论文、报纸版面和书页批注,压力测试里包含公式上下标、希腊字母、分数线、定理编号以及密集的中英文排版。



这恰好击中了中文生图长期以来最难用的地方。做一张公众号封面不难,难的是标题别写错;做一张知识图也不难,难的是十几个标签都能读。只要文字可靠性接近官方展示的水平,海报、课件、菜单、电商详情页和信息图都会省掉大量返工。
图片编辑也覆盖到了。书页可以增加接近真实手写的红色批注,包括下划线、波浪线、圈选、箭头和短评;旧画修复则会补齐缺失部分,并尽量维持笔触和墨色。

它也不只会写中文
模型原生支持 12 种语言、 100 多种艺术风格,还能模拟网页、游戏和直播间等常见界面。官方案例展示了日语、韩语和西班牙语,也展示了基于真实昆虫照片补充分类信息、形态标注、局部放大和比例尺。
它还可以联网获取新信息,例如生成指定日期的杭州天气图。这里需要留个心眼:联网检索能补充时效信息,不能替代事实核对。天气、价格、日期、医学和学术内容,发布前仍然要逐项检查。
GPT Image 依然好用,但没必要只等它
这次展示的是 Qwen 官方案例,暂时不能当成独立横评。复杂文字的稳定率、连续多次生成的一致性、编辑时对主体的保持程度,以及实际使用成本,都还要靠更多实测验证。
但有一点已经很明确:中文用户不必把整个生图工作流押在一个国外模型上。 Qwen-Image 3.0 已经把中文文字、复杂排版、长指令和图片编辑摆到了核心位置,官方博客也给出了 Qwen Chat 的体验入口。
如果 GPT Image 能顺畅使用,继续用就好;如果账号、地区或支付一直卡着,也不用再等。先用 Qwen-Image 3.0 把封面、配图、信息卡和课件跑起来,哪个模型在具体任务里效果好,就选哪个。
你最想拿它先做什么:公众号配图、 PPT 、中文海报,还是电商详情页?