正文:8月6日,小红书hi lab正式发布并开源首个多模态AI大模型dots.vlm1。该模型基于DeepSeek V3 LLM构建,配备从零训练的12亿参数视觉编码器NaViT,并支持动态分辨率和多种感知能力优化。通过引入多样化合成数据及图文交错网页数据重写,dots.vlm1在视觉感知与推理方面接近SOTA水平,在MMMU、MathVision等基准测试中表现优异,同时具备一定的文本推理能力。尽管部分细分任务仍有提升空间,其综合性能为开源多模态模型树立了新标杆。项目已开源。
原文链接
本文链接:https://kx.umi6.com/article/23131.html
转载请注明文章出处
相关推荐
换一换
批量生产的AI奶奶,正在小红书扮演人生导师
2024-10-16 14:28:47
小红书几天就搓出的翻译功能,到底是啥水平?
2025-01-21 08:32:43
小红书:AI生成合成内容须主动标识 未标识内容将限制推荐
2026-02-12 20:43:23
小红书新做的这个AI搜索,有Perplexity们都眼馋的能力
2025-01-13 10:49:29
小红书公布虚假内容治理报告:封禁黑灰产账号超1000万个
2025-06-12 18:40:10
小红书开源多模态大模型
2025-08-07 14:53:39
钛媒体AGI独家
2025-02-21 10:45:51
小红书搭起巴别塔:新的翻译功能被玩疯了
2025-01-20 20:23:49
小红书开源首个大模型 预训练未使用合成数据
2025-06-10 09:46:30
低调上线AI机器人达芬奇,吃喝玩乐小达人,小红书的未来就靠它了
2024-06-24 20:47:15
独家|小红书卖老股,估值3500亿
2026-02-05 02:23:06
独家|小红书正研发视频剪辑类AI产品OpenStoryline
2026-02-09 11:06:07
小红书怎么一夜成为全世界网友都爱的翻译软件?
2025-01-20 21:24:11
785 文章
1019116 浏览
24小时热文
更多
-
2026-09-07 10:44:22 -
2026-09-06 21:14:00 -
2026-09-06 20:12:34