YYaaa News

Qwen-Image-3.0 发布|4.5k token 输入、9 宫格信息图、10 px 小字全渲染

一句话总结

QwenTeam 7 月 21 日发布 Qwen-Image-3.0,最长 4.5k token 输入(前代 1k),可一次生成九宫格信息图、报纸、试卷、分镜与多层嵌套界面。细节能力提升,可准确渲染 10 px 小字、论文公式、发丝毛孔纹理。支持 12 国语言、100+ 艺术风格,并可结合联网信息。

QwenTeam 7 月 21 日发布 Qwen-Image-3.0——把图像生成的定位从「好看」推到「真正可用」。核心卖点是最长 4.5k token 输入(Qwen-Image-2.0 是 1k token),可一次生成九宫格信息图、报纸、试卷、分镜与多层嵌套界面这类高信息密度内容。

细节能力是这代升级的实质差别。Qwen-Image-3.0 能够准确渲染 10 px 小字、论文公式、纸张批注,微观纹理层面发丝、毛孔和传统绘画修复都能还原。这是首个把「细节到毛孔级」写进主打宣传的中国原生图像模型——过去这条线由 Midjourney v6FLUX.1 占据。

支持12 国语言100+ 艺术风格多类 UI 界面模拟——最后一项意味着 Qwen-Image-3.0 可以直接生成产品原型截图、Web 仪表板 mockup。模型还可结合联网信息生成更贴近真实场景的图像,这是 Qwen 生态上下游整合的直接红利:搜索 + 检索 + 图像在一个 API 内闭环。

放在时间线里看——Kimi K3 刚开源、Qwen3.8-Max Preview 刚上线、Qwen-Image-3.0 今日发布。阿里 + Moonshot 两家在 7 月中下旬连续三次抛出前沿模型,开源速度已经是 OpenAI + Anthropic 节奏的两倍。

技术指标背后是节奏对比——中国模型正在把「7 到 10 天发一次前沿」变成常态。

via QwenTeam