登录
注册
据 Woofun AI 消息,通义千问推出第三代图像生成模型 Qwen-Image-3.0。该模型支持最高 4.5k Token 的输入数据,核心优势在于提升复杂布局、小字体文字及基于知识图像的生成能力。通过长指令,模型可生成报纸、试卷、分镜图及 3x3 信息网格,并能在单图中呈现多主题、公式、图表及中英文文字。官方演示显示,其能处理约 3.7k Token 的指令以生成包含九个独立类别的网格。文本渲染方面,模型可清晰生成小至 10 像素的文字,并支持 LaTeX 公式、上下标、手写注释及复杂排版。
此外,毛孔、发丝等细节表现更真实,原生支持 12 种语言及 100 多种艺术风格,应用于天气地图、画作修复及信息图表创建等场景。