>
正文
Qwen发布图像模型3.0,支持4.5k Token输入
2026-07-21 14:57

据 Woofun AI 消息,通义千问推出第三代图像生成模型 Qwen-Image-3.0。该模型支持最高 4.5k Token 的输入数据,核心优势在于提升复杂布局、小字体文字及基于知识图像的生成能力。通过长指令,模型可生成报纸、试卷、分镜图及 3x3 信息网格,并能在单图中呈现多主题、公式、图表及中英文文字。官方演示显示,其能处理约 3.7k Token 的指令以生成包含九个独立类别的网格。文本渲染方面,模型可清晰生成小至 10 像素的文字,并支持 LaTeX 公式、上下标、手写注释及复杂排版。

此外,毛孔、发丝等细节表现更真实,原生支持 12 种语言及 100 多种艺术风格,应用于天气地图、画作修复及信息图表创建等场景。

免责声明:本内容为作者独立观点,不代表平台立场。未经允许不得转载,文中内容仅供参考,不作为实际操作建议,交易风险自担。
标签:
Qwen AI
Qwen-Image-3.0
Qianwen
分享:
back