阿里千问推出Qwen-Image-3.0:超长指令一键生成复杂图文
时间:2026-07-22 13:10:50
小编:china
阅读:
7月21日消息,今日,阿里发布了最新的图像生成基础模型:Qwen-Image-3.0。
新模型支持最大4.5k token超长输入,可一次生成涵盖公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解、复杂UI界面。
同时,该模型还支持12国语言和20多款字体原生渲染,字字清晰,大幅降低多语言产品海报、影视/漫画分镜等可读可用”商业素材的生产成本。
据悉,Qwen-Image-3.0是千问图像生成和编辑模型系列的第三代基础模型,核心能力全面升级。
GPT-Image-2擅长的直播间页面,Qwen-Image-3.0也能轻松生成,从人像摄影,到数学试卷、古碑拓片,千问生成的图片细节满满,栩栩如生。
此次Qwen-Image-3.0重点提升了模型对于复杂信息的承载能力,较前代在文本输入长度上实现了4.5倍的跃升。
这意味着,在影视短剧分镜、复杂信息图、产品说明页等需要超长提示词输入的场景中,用户不再需要将需求压缩成一句话。
而是可以像给设计师撰写需求文档一样,完整描述画面结构、文字内容、视觉风格和排版细节,从而让模型更精准地生成图文内容,减少反复生成和人工调试成本。
凭借Qwen-Image-3.0对于语义并置和空间控制能力的极致把握,新模型可一次性生成涵盖9种不同领域的9宫格知识图解,字字清晰,幅幅准确。
此外,Qwen-Image-3.0还拥有更详实的知识,能轻松理解复杂指令和画面的逻辑嵌套关系。
新模型可根据一条指令,在同一幅图中生成网页、软件界面、聊天窗口、海报等多类视觉内容的组合式表达。
比如,当用户输入在VSCode编程界面中,通过千问App生成一张发布在聊天界面里的手冲咖啡海报”时,模型能够准确理解其中的多层UI嵌套关系,并依次生成VSCode编程界面、千问App界面、社交媒体聊天界面和咖啡海报。
在保持各层界面结构、风格准确的同时,甚至连手机截图里的时间数字,低至10像素的小字,都清晰可辨。

图说:Qwen-image-3.0生成的多层UI界面嵌套模拟图片
新模型在文生图中积累的文字渲染能力、细节质感和世界知识也迁移到了编辑场景中,诸如古画修复、全景图生成、手绘草图转PPT、多镜头机位生成等复杂编辑任务,均可一键完成。
用户无需在生成与编辑之间反复切换工具,也无需担心风格、文字、细节在二次处理时出现偏差。
据了解,阿里云百炼、千问AI平台已开通API邀测,Qwen Studio和千问APP也即将上线供免费体验。
-
阿里千问推出Qwen-Image-3.0:超长指令一键生成复杂图文7月21日消息,今日,阿里发布了最新的图像生成基础模型:Qwen-Image-3 0。新模型支持最大4 5k token超长输入,可一次生成涵盖公式符号、几时间:2026-07-22 -
小米18即将发布:安卓最强规范版搭载2nm骁龙8E6与徕卡双2亿像素摄像头7月21日消息,据多方爆料,小米18系列今年将打破往年惯例,采取分批次发布的全新策略。今年9月份,小米仅推出小米18 Pro和小米18 Pro Ma时间:2026-07-22 -
realme徐起发布回忆短片 网友热议期待其早日回归7月21日消息,realme副总裁、全球营销总裁徐起在社交媒体上发布了一段关于realme新品发布会的回忆短视频。从2019年realme第一次回归国内市时间:2026-07-22 - 空调与健康:研究揭示低温环境如何加速衰老7月21日消息,夏天一到,开不开空调便成为许多家庭的日常争论。年轻人更倾向于享受凉爽,空调一开便是一整天;而一些中老年人却坚信长时间时间:2026-07-22
-
热门阅读
-
哥哥抚慰腮腺炎弟弟 得知传染秒变脸
阅读:136
-
华为FreeClip 2推送鸿蒙OS 6晋级,支撑星闪音频 抗搅扰才能提拔
阅读:99
-
95岁广东白叟扮演一字马火了 自己谈长命诀要,1天喝2瓶可乐
阅读:78
-
刘文祥塌房紫薯精改吃大理寺米线 网友,筹办整理升咖
阅读:74
-
这才是东北春季最霸气的开场,百万只大雁春季迁移
阅读:66




![[错误] API响应格式错误](http://www.2d2d.com/uploadfile/2026/0722/20260722124856132.jpg)






