登錄
註冊
據 Woofun AI 消息,通義千問推出第三代圖像生成模型 Qwen-Image-3.0。該模型支持最高 4.5k Token 的輸入數據,核心優勢在於提升複雜佈局、小字體文字及基於知識圖像的生成能力。通過長指令,模型可生成報紙、試卷、分鏡圖及 3x3 信息網格,並能在單圖中呈現多主題、公式、圖表及中英文文字。官方演示顯示,其能處理約 3.7k Token 的指令以生成包含九個獨立類別的網格。文本渲染方面,模型可清晰生成小至 10 像素的文字,並支持 LaTeX 公式、上下標、手寫註釋及複雜排版。
此外,毛孔、髮絲等細節表現更真實,原生支持 12 種語言及 100 多種藝術風格,應用於天氣地圖、畫作修復及信息圖表創建等場景。