2025年8月5日,阿里通义千问团队开源首个图像生成基础模型Qwen-Image。该模型为20B参数的MMDiT模型,在复杂文本渲染和精确图像编辑方面表现突出,支持多行布局、段落级文本生成及细粒度细节呈现,尤其在中文高保真输出上领先现有模型。其在多个公开基准测试中取得SOTA性能,涵盖通用图像生成和图像编辑任务。Qwen-Image支持多种艺术风格生成与专业级编辑功能,如风格迁移、细节增强、文字编辑等。开源地址包括ModelScope、Hugging Face、GitHub等平台,同时提供技术报告与在线Demo。
原文链接
本文链接:https://kx.umi6.com/article/22997.html
转载请注明文章出处
相关推荐
换一换
小米大模型团队提出对角蛇形自回归图像生成方式
2025-04-18 17:22:44
腾讯混元图像2模型发布 支持文本、语音、草图等交互方式
2025-05-16 17:13:07
微软 Copilot 已支持 GPT-4o 图像生成技术,能力大提升
2025-05-19 19:24:47
8张GPU训出近SOTA模型,超低成本图像生成预训练方案开源
2025-03-19 12:25:56
GPT-4o的P图太火了,GPU在融化,官方终于限流了
2025-03-28 21:07:22
GPT-4o骗了所有人,逐行画图只是前端特效?!底层架构细节成迷,奥特曼呼吁大家别玩了
2025-03-31 12:26:06
X 平台承诺:Grok AI 不会再将真人的照片改成“比基尼照”
2026-01-15 09:23:06
OpenAI发布生图神器狙击Google,一句话精细P图
2025-03-26 08:41:03
UniToken:多模态AI的“全能选手”,一次编码搞定图文理解与图像生成!
2025-04-25 15:13:42
阿里千问 App 上线 Wan2.5 视频模型与 Qwen-Image 满血版 ,用户可免费体验
2025-12-02 12:11:18
ChatGPT 原生图像生成功能已向免费用户推出
2025-03-31 12:32:33
超越扩散模型!自回归新范式仅需2.9秒就生成高质量图像
2024-06-27 13:56:56
国产SOTA新模型精准get“画(3+6)条命的动物” | 开源
2025-06-20 17:00:54
719 文章
809691 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30