DeepSeek低调推出DeepSeek-V3-0324,被称为“小版本迭代”,但实测表现远超预期。该模型在代码生成、前端开发方面显著提升,部分能力比肩Claude 3.7 Sonnet,引发热议。
在KCORES测试中,DeepSeek-V3-0324代码能力达328.3分,超越普通版Claude 3.7 Sonnet(322.3分),接近其思维链版本(334.8分)。在Aider LLM Leaderboard中,其多语言基准得分55%,略低于R1,但在非推理模型中排名第二。
成本方面,DeepSeek-V3-0324表现极佳,仅为R1的约1/5。性能对比显示,Claude Sonnet 3.7 Thinking成本是其33倍,o1则高达167倍。用户可通过关闭“深度思考”选项使用新模型,Hugging Face也提供开源下载。
该模型包含685B参数,采用MoE架构,激活参数370亿,支持4-bit量化,运行流畅且磁盘占用仅352GB。前端开发表现尤为突出,媲美顶级商业模型。测试中,仅用简单提示词即可生成高质量代码。
在物理模拟和UI设计结合的测试中,DeepSeek-V3-0324生成的水分子交互模拟表现出色,温度滑块可动态调整分子运动。Reddit网友认为,其潜力源于强化学习技术的应用空间广阔。
整体来看,DeepSeek-V3-0324不仅技术指标逼近顶级商业AI,还以低成本和高自由度推动行业变革。此次更新可能预示R2的来临,全球AI竞争格局或迎新变局。
原文链接
本文链接:https://kx.umi6.com/article/16107.html
转载请注明文章出处
相关推荐
换一换
DeepSeek等开源模型,更“浪费”token吗?
2025-10-11 10:17:13
马斯克预测GLM明年Q1追平Fable,智谱唐杰:没那么久
2026-06-25 13:21:31
刚刚,OpenAI发布2款开源模型,手机笔记本也能跑,北大校友扛大旗
2025-08-06 07:23:51
出圈一周年,DeepSeek的变与不变
2026-01-16 15:50:22
对话朱啸虎:搬离中国,假装不是中国AI创业公司,是没有用的
2025-09-20 20:35:10
具身开源模型新王!千寻Spirit v1.5模型登顶 RoboChallenge,终结 Pi0.5领跑时代
2026-01-12 16:41:44
DeepSeek V4终于发布!打破最强闭源垄断,明确携手华为芯片
2026-04-24 13:09:49
100万亿Token揭示今年AI趋势,硅谷的这份报告火了
2025-12-09 14:39:59
阿里开源4款Qwen3.5小尺寸模型,马斯克点赞:惊人的智能水平
2026-03-03 11:53:36
月之暗面 Kimi K2 Thinking 训练成本被曝仅 460 万美元,性能超越数十亿美元投入的 OpenAI GPT 模型
2025-11-08 15:49:04
Qwen又立功,全球最快开源模型诞生,超2000 tokens/秒!
2025-09-10 19:40:11
爆火全网FLUX.2重磅上线,开源版Nano Banana来了!
2025-11-26 17:55:27
HuggingChat Omni 集成式 AI 平台发布,可针对用户指令从百款开源模型库中挑选最适合回答
2025-10-18 10:30:57
701 文章
869692 浏览
24小时热文
更多
-
2026-09-07 10:44:22 -
2026-09-06 21:14:00 -
2026-09-06 20:12:34