2025年8月5日,阿里通义千问团队开源首个图像生成基础模型Qwen-Image。该模型为20B参数的MMDiT模型,在复杂文本渲染和精确图像编辑方面表现突出,支持多行布局、段落级文本生成及细粒度细节呈现,尤其在中文高保真输出上领先现有模型。其在多个公开基准测试中取得SOTA性能,涵盖通用图像生成和图像编辑任务。Qwen-Image支持多种艺术风格生成与专业级编辑功能,如风格迁移、细节增强、文字编辑等。开源地址包括ModelScope、Hugging Face、GitHub等平台,同时提供技术报告与在线Demo。
原文链接
本文链接:https://kx.umi6.com/article/22997.html
转载请注明文章出处
相关推荐
换一换
ChatGPT能靠吉卜力风翻盘吗?
2025-04-09 18:01:29
国产SOTA新模型精准get“画(3+6)条命的动物” | 开源
2025-06-20 17:00:54
ChatGPT 原生图像生成功能已向免费用户推出
2025-03-31 12:32:33
AI 人像以假乱真,阿里通义 Qwen-Image-2512 模型开源发布
2025-12-31 18:33:39
阿里发布Qwen-Image模型新版本 千问APP首发接入
2025-12-02 12:11:21
可能是目前效果最好的开源生图模型,混元生图3.0来了
2025-09-30 21:34:24
超越扩散模型!自回归新范式仅需2.9秒就生成高质量图像
2024-06-27 13:56:56
OpenAI 将 ChatGPT 新图像生成技术引入 API,每张图约 2 美分起
2025-04-24 08:29:07
X 平台承诺:Grok AI 不会再将真人的照片改成“比基尼照”
2026-01-15 09:23:06
国内最强生图模型Wan2.7-Image来了
2026-04-01 18:01:59
GPT-4o骗了所有人,逐行画图只是前端特效?!底层架构细节成迷,奥特曼呼吁大家别玩了
2025-03-31 12:26:06
GPT-4o图像生成今起免费!奥特曼坐镇紧急发布,指令遵循/文本控制表现惊艳
2025-03-26 10:43:57
腾讯混元图像2模型发布 支持文本、语音、草图等交互方式
2025-05-16 17:13:07
726 文章
927793 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47