清华大学KVCache.AI团队与趋境科技联合发布的KTransformers开源项目取得重大进展,成功在RTX 4090单卡上实现DeepSeek-R1满血运行,解决了大模型本地部署难题。该项目于2月10日成功运行DeepSeek-R1、V3的671B满血版,速度提高3~28倍。KTransformers不仅支持DeepSeek模型,还兼容各类MoE模型,预处理速度最高达286 tokens/s,推理生成速度达14 tokens/s。此技术有望降低AI大模型的运行成本,使其更加普及。
原文链接
本文链接:https://kx.umi6.com/article/13467.html
转载请注明文章出处
相关推荐
换一换
DeepSeek-R1秘籍轻松迁移,只需原始数据0.3% | 邱锡鹏团队联合出品
2025-02-24 16:26:25
vivo 正式上线满血版 DeepSeek-R1
2025-02-25 17:01:36
梁文锋不着急
2025-05-30 21:56:33
DeepSeek全尺寸模型上线阿里云百炼
2025-02-09 14:48:13
AI界“拼多多”DeepSeek国内外刷屏!龙头20CM一字板,受益上市公司梳理
2025-02-01 16:25:38
DeepSeek官方推荐:R1要这样设置
2025-02-15 13:02:24
超越 DeepSeek-R1,英伟达开源模型 Llama-Nemotron 登顶
2025-05-06 17:56:45
DeepSeek-R1超级外挂!“人类最后的考试”首次突破30分,上海交大等开源方案碾压OpenAI、谷歌
2025-07-09 14:04:55
中文在线:已在部分内部 AI 网文创作流程中部署 DeepSeek-R1
2025-02-05 22:14:26
海外用户也有份,传音 Infinix AI 接入 DeepSeek-R1 满血版
2025-02-24 00:07:55
DeepSeek登《Nature》封面,梁文锋带队,首次回应争议
2025-09-18 13:54:10
接入 DeepSeek-R1,星纪魅族 21、20 系列等机型 Aicy 语音助手获 11.3.19 版本升级
2025-02-11 02:29:56
2张4090竟能本地微调万亿参数Kimi K2!趋境联合清华北航把算力门槛击穿了
2025-11-05 16:12:15
825 文章
873779 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30