1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

4月22日,英伟达发布了Eagle 2.5视觉语言AI模型,参数规模仅8B却在多项测试中表现优异。该模型专注于长上下文多模态学习,擅长处理高分辨率图像和长视频序列。在Video-MME基准测试中,Eagle 2.5以512帧输入获得72.4%的高分,接近更大规模的Qwen2.5-VL-72B和InternVL2.5-78B。其成功得益于信息优先采样(IAP)与渐进式后训练策略,IAP通过保留60%以上图像区域提升效率,ADS动态平衡视觉与文本输入。模型还采用了定制数据集Eagle-Video-110K,结合自上而下与自下而上标注方法增强数据质量。Eagle 2.5在MVBench、MLVU等视频及DocVQA、ChartQA等图像任务中均取得亮眼成绩,消融研究表明关键策略不可或缺。

原文链接
本文链接:https://kx.umi6.com/article/17631.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
黄仁勋:下一个浪潮是物理人工智能
2025-05-19 23:25:01
英伟达黄仁勋:人工智能下一个浪潮是物理 AI
2025-07-17 12:21:44
英伟达,上海将有新布局
2025-05-23 18:11:51
24小时热文
更多
扫一扫体验小程序