2024-08-23 13:13:45
浪潮信息发布源 2.0-M32 大模型 4bit / 8bit 量化版:运行显存仅需 23GB,号称性能媲美 LLaMA3
阅读:1546
浪潮信息于8月23日发布源2.0-M32大模型的4bit和8bit量化版,该版本旨在通过量化模型精度至int4和int8级别,实现模型性能基本不变的同时大幅降低计算资源需求。相较于700亿参数的LLaMA3大模型,4bit量化版仅需23.27GB运行显存,每token算力消耗为1.9GFLOPs,仅为LLaMA3-70B的1/80。这一创新使得大模型部署运行更为高效经济。经过评测,在MATH和ARC-C任务中,源2.0-M32量化版性能超越了700亿参数的LLaMA3大模型。目前,该版本已经开源,用户可通过Hugging Face或ModelScope平台下载使用,以探索其在不同领域的应用潜力。
原文链接
本文链接:https://kx.umi6.com/article/5363.html
转载请注明文章出处
相关推荐
换一换
Agent要数量也要脑子!浪潮信息一边单柜养4万Agent,一边让大模型组队答题
2026-07-13 20:27:21
浪潮信息发布自动驾驶分布式计算框架AutoDRRT 2.0
2024-09-21 11:14:27
AI转型最大的门槛,不是技术,是人
2026-06-17 20:53:26
浪潮信息营收新高背后,毛利率下滑至7.6%,海外市场提高171.54%
2024-08-27 17:00:23
浪潮信息驶入AI深水区
2025-12-05 16:40:08
Reddit 为何「叫板」Google?
2026-07-27 19:26:38
黄仁勋倡议的开源联名信,Anthropic 为何不愿签名?
2026-07-28 15:05:34
首个鸿蒙PC开源AI统一工作台JiuwenSwarm,办公编程一站式搞定
2026-07-29 11:44:53
AI最尴尬的短板,中国科学院出手了
2026-07-27 13:11:50
黄仁勋发了人生第一条社媒帖子:都给我开源!
2026-07-27 17:22:07
超越OpenAI、Anthropic!国产AI安全智能体杀进全球前四、国内第一
2026-07-29 16:56:31
AI幻觉最可怕的人类副作用出现了
2026-07-28 16:09:37
这这这…翁荔光速回OpenAI上班了
2026-07-30 09:29:43
764 文章
846492 浏览
24小时热文
更多
-
2026-08-01 19:39:09 -
2026-08-01 19:37:08 -
2026-08-01 19:35:13