2025年8月,英伟达韩松团队推出全新高效语言模型Jet-Nemotron,基于后神经架构搜索(PostNAS)技术。该模型在MMLU等基准测试中表现优异,吞吐量较Qwen3-1.7B快47倍,缓存缩小至1/47,同时在数学、常识推理、编码等任务上超越多个基线模型。研究团队通过全注意力层优化、动态卷积模块设计及硬件感知搜索提升效率,并计划开源代码与模型。团队成员均来自华人学者,包括清华大学、麻省理工学院等顶尖机构的研究人员。这一成果显著推进了高效语言模型的发展。
原文链接
本文链接:https://kx.umi6.com/article/24232.html
转载请注明文章出处
相关推荐
换一换
马斯克新模型背后算法来自英伟达???
2025-09-26 16:31:12
上海这场大赛有点“野”:让AI自主科研、控核聚变、认甲骨文
2026-07-23 09:36:06
AI 终端混战:谁在做加法,谁在重写规则
2026-07-22 11:57:57
成本直降 90%!原来 Kimi K3 叠 Claude Code 还能这么玩
2026-07-23 12:51:59
1.5B开源通用VLA模型,冲进具身智能第一梯队
2026-07-20 13:14:39
阿里Qoder上线全新安全能力,为每位用户配备一位专属安全工程师
2026-07-21 14:07:01
微软又给Windows找了个塞Copilot的地方:文件管理器新增快捷按钮
2026-07-22 20:13:24
冷门的哲学,成了“治”AI的热门
2026-07-19 21:35:46
国内首个!阿里健康氢离子达成NEJM、JAMA、BMJ三大医学顶刊内容合作
2026-07-21 15:10:45
趋境科技华东区域总部落地钱江世纪城,五年内建成万卡级高品质 AI Token 工厂
2026-07-23 13:47:01
Windows真不差:实测AI性能3.4倍碾压Linux!
2026-07-20 18:30:38
2026世界人工智能大会“未来计算·未来算力”专题论坛在沪召开,共识凝聚五问
2026-07-19 19:28:01
苏度 WAIC 首秀:从1到10+技能跃迁,探索通用机器人 Scaling 路径
2026-07-19 15:24:53
694 文章
727024 浏览
24小时热文
更多
-
2026-07-24 12:36:48 -
2026-07-24 11:35:13 -
2026-07-24 10:33:39