Qwen 開源 Qwen-Image-2.1,整合圖像生成與編輯並支援透明圖
Qwen 團隊於 9 月 20 日開源 Qwen-Image-2.1 模型,將文生圖與圖像編輯功能整合於單一模型中。該視覺生成組件僅 7B 參數,原生支援透明圖像的生成與編輯。模型支援最多 10 張參考圖,並可透過多種遮罩方式進行局部編輯。架構上採用混合粒度注意力機制以提升推理效率,並優化了文字渲染與人像保真度。
摘要由 AI 依據原文撰寫,並非投資建議。
Qwen 團隊於 9 月 20 日開源 Qwen-Image-2.1 模型,將文生圖與圖像編輯功能整合於單一模型中。該視覺生成組件僅 7B 參數,原生支援透明圖像的生成與編輯。模型支援最多 10 張參考圖,並可透過多種遮罩方式進行局部編輯。架構上採用混合粒度注意力機制以提升推理效率,並優化了文字渲染與人像保真度。
摘要由 AI 依據原文撰寫,並非投資建議。