在最新的AI竞赛中,Gemini视频推理模型在Video-MME基准测试中大幅领先,首次全面评估大模型的视频理解能力。Google首席科学家Jeff Dean连续转发Video-MME消息,肯定了这项由中科大等高校合作推出的全人工标注高质量数据集。Video-MME测试涵盖了不同时长、模态和类型的视频,从11秒至1小时,评估模型在长视频理解上的表现。Gemini 1.5 Pro表现出色,尤其在加字幕的长视频中超越开源模型。然而,所有模型在长视频处理上仍有提升空间,暗示未来研究将聚焦于多模态长上下文理解和高质量长视频数据集的建设。
原文链接
本文链接:https://kx.umi6.com/article/1567.html
转载请注明文章出处
相关推荐
换一换
微调 GPT-4o AI 模型新维度,OpenAI 开放图片视觉微调功能
2024-10-09 09:50:54
GPT-4o失控,突然呻吟尖叫发癫,引发研究人员恐慌
2024-08-09 18:50:30
OpenAI 宣布升级 GPT-4o 并面向所有付费用户开放,免费用户仍需等待数周
2025-03-28 08:32:24
起猛了,GPT-4o被谷歌新模型击败,ChatGPT官号:大家深吸一口气
2024-08-02 14:54:04
全球首款集成GPT-4o的智能眼镜,会成为爆款吗?
2024-07-03 08:19:05
首次引入GPT-4o!图像自动评估新基准来啦
2024-06-28 00:32:37
奥尔特曼:OpenAI 正逐步撤回 GPT-4o“过于奉承”的更新
2025-04-30 19:31:59
GPT-4o前研发负责人辞职创业
2024-09-11 12:25:26
交互效果对标 GPT-4o,商汤发布国内首个所见即所得模型“日日新 5o”
2024-07-05 22:48:41
国内首个!商汤科技发布“日日新5o”,实时多模态流式交互对标GPT-4o
2024-07-05 21:18:05
研究发现,OpenAI 的 GPT-4o 道德推理能力胜过人类专家
2024-06-24 12:02:59
“计算机视觉被GPT-4o终结了”(狗头)
2025-03-29 17:49:47
研究显示 GPT-4o 会为“自保”而避免“被关闭”,牺牲用户利益也在所不惜
2025-06-12 08:28:18
723 文章
777698 浏览
24小时热文
更多
-
2026-07-24 12:36:48 -
2026-07-24 11:35:13 -
2026-07-24 10:33:39