8月5日,阿里巴巴千问图像生成模型 Qwen-Image-3.0 正式上线千问 AI 平台,面向所有用户全部开放。旗舰版 Qwen-Image-3.0-Pro 与标准版 Qwen-Image-3.0-Standard 同步开放 API,文生图 0.18 元/张起。在国际评测平台 Arena.ai 最新文生图榜单中,Qwen-Image-3.0 位列国内第一。

双版本并行,按需取用

此次发布的两个版本覆盖了从日常批量生成到高品质创作的不同需求场景。Standard 版主打大批量日常生成,1K 与 2K 分辨率均按 0.18 元/张计费;Pro 版则面向对画质、细节和指令遵循有更高要求的专业场景,1K 分辨率 0.25 元/张,2K 分辨率 0.5 元/张。API 已在千问 AI 平台上线,海外用户可通过 Qwen Cloud 接入。

三大核心能力:内容丰实、细节真实、知识厚实

Qwen-Image-3.0 以“内容丰实、细节真实、知识厚实”三个维度作为核心支撑。

内容丰实方面,模型支持最长 4.5k Token 的超长指令输入。一张 3.7k Token 的九宫格知识信息图,可将数学、物理、文学、医学、金融等九个领域内容同屏排列、一次生成。报纸、分镜、试卷、菜单等复杂版面均可一次性精准生成。

细节真实方面,模型具备 10px 小字精准渲染能力。整页代数几何学术论文的 LaTeX 公式、上下标和定理编号可逐一还原。人像方面,毛孔、发丝和微表情经得起放大查看,皮肤质感接近实拍照片。模型还能以与原画一致的笔法修复破损古画。

知识厚实方面,模型原生支持 12 种语言及 20 余种字体渲染。在多语言产品海报、影视分镜、复杂 UI 界面等高价值生产力场景中,优势尤为显著。

生图编辑一体化

Qwen-Image-3.0 采用图像生成与编辑一体化架构。模型同时支持文生图和图生图/图像编辑。在文生图中积累的文字渲染能力、细节质感和世界知识,自然迁移到了编辑场景中——古画修复、全景图生成、手绘草图转 PPT、多镜头机位生成等复杂编辑任务,均可一键完成。

权威榜单验证:国内第一,全球第五

在国际评测平台 Arena.ai 最新文生图榜单中,Qwen-Image-3.0 位列国内第一。Qwen-Image-3.0-Pro 在全球排名中位居第五。Arena.ai 是一个在 AI 产业中广泛使用的众包评测平台,其文生图排行榜已成为开发者评估模型品质的重要参考基准。

从“炫技”到“生产力”

Qwen-Image-3.0 的正式上线,标志着图像生成模型正在从“能画图”走向“能干活”。4.5k Token 的超长指令输入,让模型可以一次性处理此前需要多次拼接才能完成的复杂任务;10px 小字精准渲染,让 AI 出图真正可用于学术论文、产品说明书、UI 设计稿等对文字精度有严格要求的场景;12 国语言原生支持,让跨国团队可以共享同一套创作工具。

图像生成领域的竞争正在从单纯的画质比拼,转向效果、成本与生产力适配度的综合较量。当 0.18 元/张的价格门槛被踩到脚底,当 4.5k Token 的超长指令让复杂版面一次成型,图像生成正在从一个“需要调参师”的精细活,变成一个“谁都能用”的基础能力。