2025年8月,英伟达韩松团队推出全新高效语言模型Jet-Nemotron,基于后神经架构搜索(PostNAS)技术。该模型在MMLU等基准测试中表现优异,吞吐量较Qwen3-1.7B快47倍,缓存缩小至1/47,同时在数学、常识推理、编码等任务上超越多个基线模型。研究团队通过全注意力层优化、动态卷积模块设计及硬件感知搜索提升效率,并计划开源代码与模型。团队成员均来自华人学者,包括清华大学、麻省理工学院等顶尖机构的研究人员。这一成果显著推进了高效语言模型的发展。
原文链接
本文链接:https://kx.umi6.com/article/24232.html
转载请注明文章出处
相关推荐
换一换
马斯克新模型背后算法来自英伟达???
2025-09-26 16:31:12
GPT-6带火循环Transformer,阿里早已布局
2026-09-05 23:32:44
卡车自动驾驶里程超10亿公里,嬴彻科技定义“货运物理AI”
2026-09-04 10:10:22
拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」
2026-09-03 17:33:12
还有人用吗 本年最火的AI产品小龙虾OpenClaw 2.0史诗级更新
2026-08-31 18:55:52
巨简单,更懂家!海信JUOS正式发布:行业首个家庭智能伴侣级AIOS
2026-09-02 10:24:20
DeepSeek Harness 的插件体验短板:安全权限未生效,好插件用户找不到
2026-09-01 16:51:10
企业级Agent落地样板间!百融硅基员工批量上岗,按结果领工资
2026-09-02 11:26:07
陈大年复出,入局大模型
2026-09-03 18:32:42
今年最难的机器人Demo,“机器人含量”为0
2026-09-03 10:15:24
还在为大模型洗数据熬夜?蚂蚁拿下VLDB工业最佳论文,一套宽表搞定35PB语料,效率狂飙5.6倍
2026-09-02 15:35:06
急急急用电!马斯克开造燃气轮机叶片
2026-09-01 16:46:29
香港首个真实开放场景服务机器人落地兰桂坊
2026-09-02 10:25:57
702 文章
838117 浏览
24小时热文
更多
-
2026-09-07 13:49:31 -
2026-09-07 12:47:55 -
2026-09-07 10:44:22