标题:大模型热度退潮,真正的技术创新者开始被「看见」
“过去两年中国的大模型投资更多是投商业模式,而非技术本身。硅谷的投资人更倾向于押注技术突破。”一位投资人对AI科技评论表示。
相较于商业模式驱动的投资,技术投资更看重持续创新的高度。在DeepSeek扬名之前,追随OpenAI成为吸金焦点;而今,“独立创新”已成主流。
融资热度虽有所下降,但行业正朝健康方向发展。截至2025年6月,智谱AI与专注端侧AI的面壁智能宣布了新一轮融资。裸泳者退出,装备齐全者登场。
DeepSeek开创云上千亿级大模型先河,推动所有公司直面技术创新。同样注重基础技术革新的团队也开始崭露头角,面壁智能就是其中之一。其新一代“小钢炮4.0”展示了端侧推理与架构创新的潜力。
AGI落地正向云端及终端双向发展。DeepSeek与面壁智能各领风骚,分别聚焦云上应用与终端智能。在架构与推理上的创新尤为关键,面壁通过InfLLM v2稀疏注意力结构大幅提升端侧效率。
MiniCPM 4.0不仅在数据、学习、推理与架构四方面优化,还大幅减少层数,提升效率。其创新的“稀疏注意力”模式让模型在长短文本场景间灵活切换。此外,CPM.cu推理框架、BitCPM量化算法与ArkInfer跨平台部署框架进一步增强了性能。
面壁团队通过底层优化、数据筛选与高效训练策略,使MiniCPM 4.0在多个维度超越同行。从数据采集到模型训练,每一步都力求最优。而风洞2.0方案更将实验次数削减一半。
DeepSeek的成功证明了多样化创新的可能性。而面壁的故事则展现了如何在有限资源下追求效率最优,为领域持续贡献力量。这表明,端侧探索可能是通往通用智能的重要答案。
原文链接
本文链接:https://kx.umi6.com/article/20542.html
转载请注明文章出处
相关推荐
换一换
MiniMax M3一手实测:老黄PPT上74个Logo,我以为能难住它
2026-06-03 00:53:27
Kimi即将推出新一代万亿大模型:开源王者刷新 去年已超GPT5
2026-01-20 22:33:50
上海已发布超150款备案大模型
2026-03-28 20:16:44
大模型的尽头 怎么是费大厨辣椒炒肉?
2026-05-24 15:42:37
美国公司又吹牛!首例AI自主勒索攻击被拆穿:人类幕后操盘、AI只配敲键盘
2026-07-07 17:39:23
亚马逊云科技发布多款大模型
2025-12-03 14:25:54
殷勇调研月之暗面:在投融资、场景应用、算力供给等方面加大支持力度
2026-01-09 14:21:38
长三角一体化大模型发布 AI将为区域发展提供决策支撑
2026-01-12 09:40:07
智谱、MiniMax争夺「大模型第一股」
2025-12-24 10:30:23
马年4大顶流模型会师阿里云Coding Plan开工!Token量大管饱,自由切换真香
2026-02-26 00:01:12
月之暗面近20天收入超去年全年
2026-02-23 19:11:04
国产大模型连续5周霸榜全球冠军
2026-03-22 15:57:12
天天卖断货的GLM-5.2 用起来到底值不值
2026-06-18 07:16:32
743 文章
839554 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30