《科创板日报》17日消息,字节跳动旗下豆包大模型团队今日发布并开源了UI-TARS-1.5,这是一款基于视觉-语言模型打造的开源多模态智能体。该模型具备在虚拟环境中高效完成多种任务的能力,尤其在7个GUI图形用户界面评测基准中达到了SOTA(最高性能)。此外,UI-TARS-1.5首次展示了其在游戏中的长时推理能力和开放空间中的交互能力,标志着多模态智能体技术的重要进展。
原文链接
本文链接:https://kx.umi6.com/article/17367.html
转载请注明文章出处
相关推荐
换一换
马斯克罕见低头:开源????推荐算法,自嘲“很烂”不过未来月更
2026-01-21 13:07:44
商汤科技发布并开源日日新SenseNova U1
2026-04-28 21:39:58
抖音&LV-NUS开源多模态新模,以小博大刷新SOTA,8B推理比肩GPT-4o
2025-10-14 12:13:47
Claude封杀龙虾后推自家Agent服务,又被开源平替了
2026-04-09 15:12:47
网易有道发布TTS语音合成引擎Confucius4-TTS:3秒音频素材即可语音克隆
2026-06-23 17:48:26
AI“以小博大”新标杆:三星开源 TRM 模型,700 万参数、特定任务性能媲美 Deepseek R1 等万倍大模型
2025-10-11 10:06:15
蚂蚁集团开源Avernet,让人与智能体像组织一样高效协作
2026-08-07 12:18:09
一封律师函引发的GitHub风暴:拓竹为何惹毛了全球极客?
2026-05-18 16:47:32
智谱上线并开源文本转语音模型 GLM-TTS:只需 3 秒语音样本即可克隆声音
2025-12-11 10:42:18
蚂蚁发布并开源万亿参数思考模型Ring-1T
2025-10-14 17:25:02
阿里云通义千问开源 Qwen3-VL-30B-A3B 模型:智能体任务等领域媲美 GPT-5-Mini
2025-10-04 14:01:20
黄仁勋率先开源量子AI大模型
2026-04-15 12:57:46
北京人形机器人创新中心开源Pelican-VL 1.0模型
2025-11-13 21:24:03
757 文章
996026 浏览
24小时热文
更多
-
2026-09-07 10:44:22 -
2026-09-06 21:14:00 -
2026-09-06 20:12:34