1月21日消息,DeepSeek计划于2月农历新年期间发布新一代旗舰AI模型DeepSeek V4,预计将具备更强的代码编写能力。1月20日,开发者发现DeepSeek在GitHub更新的代码中多次提到未知标识符“MODEL1”,可能代表全新架构。与现有模型“V32”相比,“MODEL1”在键值缓存布局、稀疏性处理及FP8解码支持等方面存在显著差异,表明新架构或优化内存与计算效率。此外,DeepSeek近期发布的两篇论文介绍“优化残差连接(mHC)”和“AI记忆模块(Engram)”,可能整合到新模型中。此前爆料称,DeepSeek V4的编程能力有望超越OpenAI GPT及Anthropic Claude。
原文链接
本文链接:https://kx.umi6.com/article/31947.html
转载请注明文章出处
相关推荐
换一换
DeepSeek发布梁文锋署名新论文 开源相关记忆模块Engram
2026-01-13 09:25:44
DeepSeek大量招人,该梁文锋上场了
2026-01-16 15:41:13
估值4800亿,DeepSeek火速开启新一轮融资!最快明年IPO
2026-07-15 09:47:34
美称中国一人工智能企业违反美出口管制 外交部:中方已多次表明原则立场
2026-02-24 15:53:46
DeepSeek更新GitHub仓库 新模型“MODEL1”曝光
2026-01-21 11:03:39
DeepSeek注册资本提高50%
2026-04-28 09:06:54
DeepSeek新论文剧透V4新框架!用闲置网卡加速智能体推理性能
2026-02-27 16:53:38
DeepSeek:特殊字符引发模型幻觉 不涉及安全问题或隐私泄露
2026-05-19 19:54:37
梁文锋狙击战:深扒那些梁文锋署名的论文有多牛
2026-09-25 19:30:23
DeepSeek急招Agent方向!一口气放17个岗位,重度Vibe Coding优先
2026-03-25 15:37:07
Deepseek官网公布deepseek-v4接口文档
2026-04-24 11:10:00
DeepSeek网页及API相关服务已恢复
2026-05-08 19:36:09
六大AI拿1万美元真实交易:DeepSeek最能赚,GPT-5亏麻了,AI能让周杰伦少亏上亿
2025-10-20 17:12:32
749 文章
948391 浏览
24小时热文
更多
-
2026-09-28 10:56:13 -
2026-09-28 10:54:55 -
2026-09-28 09:51:22