8月23日,苹果研究团队开源了SlowFast-LLaVA-1.5长视频多模态大语言模型,在1B、3B、7B参数规模下刷新LongVideoBench、MLVU等基准纪录。该模型通过创新双流设计,‘慢流’捕捉高分辨率场景细节,‘快流’追踪运动变化,解决现有模型冗余帧和上下文窗口限制等问题。新版本在视频与图像理解任务中表现出色,涵盖知识问答、数学推理及OCR等领域,并兼容公开数据集训练,已在GitHub和Hugging Face开源。
原文链接
本文链接:https://kx.umi6.com/article/24057.html
转载请注明文章出处
相关推荐
换一换
苹果回应马斯克指控:App Store设计上公平且无偏见
2025-08-13 14:37:51
库克虎口夺食:马斯克盯上的北大校友AI公司被苹果抢走
2025-10-11 12:26:14
iPhone大卖,给不了苹果安全感
2025-08-03 11:36:33
库克终于放下重担,Siri一句「我听不懂」,苹果的AI时代就过去了
2026-04-30 17:38:10
苹果官方App误打包了Claude.md,这么大的公司也Vibe Coding啊?
2026-05-02 12:25:41
苹果组建新团队:专攻搜索
2025-08-04 15:59:58
苹果据悉探索利用谷歌Gemini为新版Siri赋能
2025-08-23 02:55:42
库克在抖音卖iPhone,M5芯片却偷偷上MacBook Pro,网友:没有Pro/Max,你咋敢?
2025-10-17 17:22:55
AI投资洪流中,苹果如何另辟蹊径“稳扎稳打”?
2025-10-31 10:28:00
提速 128 倍:苹果发布 FS-DFM 模型,AI 长文写作不再等待
2025-10-14 14:18:04
OpenAI首批智能硬件传出新消息
2025-09-20 09:24:50
苹果×NVIDIA“梦幻联动”!两台DGX Spark+Mac Studio合体:AI性能暴涨2.8倍
2025-10-17 16:26:00
苹果首款AI穿戴设备最早可能在2027年发布
2026-01-22 18:06:16
785 文章
1019116 浏览
24小时热文
更多
-
2026-09-07 10:44:22 -
2026-09-06 21:14:00 -
2026-09-06 20:12:34