阿里巴巴千問 AI 平台推出 Qwen-Image-3.0 圖像生成模型 全面向用户開放

根據阿里雲的消息,阿里巴巴的千問圖像生成模型 Qwen-Image-3.0 正式上線千問 AI 平台,並對所有用户全面開放。旗艦版 Qwen-Image-3.0-Pro 與標準版 Qwen-Image-3.0-Standard 同時開放 API,文生圖的價格從 0.18 元/張起。API 已在千問 AI 平台上線,海外用户可通過 Qwen Cloud 接入。

在國際評測平台 Arena.ai 的最新文生圖榜單中,Qwen-Image-3.0 位列中國第一。

Qwen-Image-3.0 模型實現三大核心升級

千問科技注意到,Qwen-Image-3.0 模型實現了三大核心升級:首先是內容豐實,支持最大 4.5k token 超長輸入,與前代相比提升 4.5 倍。用户不再需要將需求壓縮成一句話,而是可以像給設計師撰寫需求文檔一樣,完整描述畫面結構、文字內容、視覺風格和排版細節。無論是報紙版面、影視分鏡、數學試卷還是 PPT,模型都能一次性精準生成。

其次是細節真實,支持 10px 小字精準渲染,毛孔與髮絲等微觀質感逼真還原。在人像攝影、古碑拓片等場景中具備較強的細節還原能力。實測中,模型在文字對齊、畫面細節還原、多圖敍事一致性、複雜構圖渲染等核心維度實現了大幅升級。

最後是知識厚實,原生支持 12 種語言和 20 多款字體渲染,即使提示詞同時包含中文、英文、韓文等多語種文字,也能精準輸出,並不會出現缺字、亂碼、錯位變形。模型還可輕鬆生成涵蓋公式符號、幾何圖形、邏輯推導步驟等多元素融合的知識圖解和複雜 UI 界面。

Qwen-Image-3.0 將 AI 圖像生成推向新高度

Qwen-Image-3.0 將 AI 圖像生成從「好看」推向了「好用」。在影視短劇分鏡場景中,模型可一次性生成 20 個分鏡的豎版短篇條漫,前後劇情銜接流暢,對話氣泡中文字清晰通順。在內容創作場景中,用户可一次性生成涵蓋 9 種不同領域的 9 宮格知識圖解,包含精確的中英文文字、公式、圖表和漫畫人物。在商業設計場景中,模型支持多語言產品海報、網頁原型、遊戲及直播界面仿真。

旗艦版 Qwen-Image-3.0-Pro 與標準版 Qwen-Image-3.0-Standard 同時開放 API。模型已上線千問 AI 平台和阿里雲百煉,Qwen Studio 和千問 APP 也即將上線供免費體驗。海外用户可通過 Qwen Cloud 接入。

想睇更深入嘅 AI 模型與工程科技報道?
前往 The Base Principle 繁體中文 AI 新聞 →
Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:日本語版 / TechNipponThe Base Principle(AI・工程)