【摘要】近日,智源研究院发布原生多模态世界模型Emu3,该模型可实现视频、图像、文本三种模态的统一理解与生成。当前行业中的多模态大模型多为针对特定任务的专用模型,Emu3则首次证明了下一token预测在多模态任务中的高效表现,为构建多模态AGI提供了技术前景。智源研究院院长王仲远指出,Emu3能统一表示空间,实现跨模态的统一训练和生成,有望推动机器人、自动驾驶、多模态对话等领域的发展。此外,Emu3采用统一的Tokenizer系统,将不同模态信息映射至同一空间,简化了训练过程,降低了基础设施需求。此次发布标志着多模态大模型向AGI迈进的重要一步,相关技术或将在未来加快产业化进程。(10月22日,《科创板日报》报道)
原文链接
本文链接:https://kx.umi6.com/article/7656.html
转载请注明文章出处
相关推荐
换一换
GPT-6 或将比 GPT-5 强 10 倍!奥尔特曼揭秘 ChatGPT 如何诞生
2025-10-05 20:26:06
国产新一代大模型MiniMax 3上半年发布:多模态、全球顶级性能
2026-03-03 22:38:04
微软 CEO 纳德拉谈 AGI:若单一主导 AI 模型普及,市场将终结
2025-11-14 22:16:42
李飞飞团队推出首款商用世界模型Marble
2025-11-13 17:12:35
视频理解霸榜!快手Keye-VL旗舰模型重磅开源,多模态视频感知领头羊
2025-11-28 17:39:28
DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍
2026-09-01 18:52:06
OpenAI掌舵人三年演讲梳理:一文读懂Altman
2025-10-22 18:50:58
谢赛宁李飞飞LeCun搞的寒武纪,究竟是个啥?
2025-11-24 15:02:36
AGI残酷真相:一半人明天不上班,GDP不会掉一点
2025-09-23 15:20:49
Transformer亲爹痛斥:当前AI陷死胡同,微调纯属浪费时间!
2026-01-20 09:46:08
NVIDIA再快也不行!科学家示警AGI阻碍在算力:已接近物理极限
2025-12-15 15:46:39
马斯克“新战书”:xAI最早明年实现AGI 两三年内超越竞争对手!
2025-12-18 20:04:46
源神启动!一张消费级显卡跑“Opus级”Agent,Qwen3.8-27B多项榜单反超Claude
2026-08-15 15:11:44
775 文章
966454 浏览
24小时热文
更多
-
2026-09-03 16:29:04 -
2026-09-03 15:28:35 -
2026-09-03 11:19:32