DeepSeek低调推出DeepSeek-V3-0324,被称为“小版本迭代”,但实测表现远超预期。该模型在代码生成、前端开发方面显著提升,部分能力比肩Claude 3.7 Sonnet,引发热议。
在KCORES测试中,DeepSeek-V3-0324代码能力达328.3分,超越普通版Claude 3.7 Sonnet(322.3分),接近其思维链版本(334.8分)。在Aider LLM Leaderboard中,其多语言基准得分55%,略低于R1,但在非推理模型中排名第二。
成本方面,DeepSeek-V3-0324表现极佳,仅为R1的约1/5。性能对比显示,Claude Sonnet 3.7 Thinking成本是其33倍,o1则高达167倍。用户可通过关闭“深度思考”选项使用新模型,Hugging Face也提供开源下载。
该模型包含685B参数,采用MoE架构,激活参数370亿,支持4-bit量化,运行流畅且磁盘占用仅352GB。前端开发表现尤为突出,媲美顶级商业模型。测试中,仅用简单提示词即可生成高质量代码。
在物理模拟和UI设计结合的测试中,DeepSeek-V3-0324生成的水分子交互模拟表现出色,温度滑块可动态调整分子运动。Reddit网友认为,其潜力源于强化学习技术的应用空间广阔。
整体来看,DeepSeek-V3-0324不仅技术指标逼近顶级商业AI,还以低成本和高自由度推动行业变革。此次更新可能预示R2的来临,全球AI竞争格局或迎新变局。
原文链接
本文链接:https://kx.umi6.com/article/16107.html
转载请注明文章出处
相关推荐
换一换
科研AI出了个狠角色:开源30B小模型,硬刚Gemini和Claude
2026-03-09 12:34:15
谷歌前 CEO 施密特:大多数国家最终可能使用中国的 AI 模型
2025-11-12 16:13:53
商汤开源 SenseNova-MARS,突破多模态搜索推理天花板
2026-01-30 18:41:28
最强开源大模型除夕登场!397B参数千问3.5超越Gemini 3,百万Tokens低至8毛
2026-02-16 19:34:51
中国AI模型崛起!已拿下全球15%份额:一年前才1%
2026-01-19 17:05:01
英伟达全新开源模型:三倍吞吐、单卡可跑,还拿下推理SOTA
2025-07-29 15:31:43
智谱发布新一代旗舰开源模型 GLM-4.5,专为智能体应用打造
2025-07-28 22:20:02
可能是目前效果最好的开源生图模型,混元生图3.0来了
2025-09-30 21:34:24
消息称智谱 GLM-4.5 今晚开源新模型,知情人士回应确有其事
2025-07-28 16:20:04
机器人线下真机对线打PK!这届黑客松可太会玩了
2026-03-31 14:52:20
出圈一周年,DeepSeek的变与不变
2026-01-16 15:50:22
微软将 OpenAI 最小开源模型 gpt-oss-20b 引入 Windows,本地也能跑
2025-08-07 11:47:50
百元级硬件流畅运行百亿参数大模型!上交&本智激活开源端侧原生大模型
2025-07-27 18:00:02
685 文章
751182 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30