综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
6月11日,谷歌正式发布全新开放AI模型DiffusionGemma。该模型基于文本扩散机制,摒弃传统自回归逐一生成方式,通过并行处理全部文本单元完成内容生成,本地AI推理速度较传统模型提升4倍。其采样速率达每秒1479个文本单元,单次生成仅0.84秒,整体能力与Gemma 4持平。在代码生成方面综合表现与Gemini 2.0 Flash-Lite旗鼓相当,数学推理在AIME 2025测试中得分23.3%,优于同期对比模型。硬件适配上,该模型充分发挥英伟达GPU并行计算性能,在DGX Station设备上每秒可生成2000个文本单元。目前,DiffusionGemma已按Apache 2.0协议在Hugging Face平台开源,供开发者下载及二次开发。
原文链接
2026年5月22日,AMD CEO苏姿丰在中国台北论坛活动中指出,全球AI投资过去两三年聚焦于大规模模型训练,但该领域无法实现盈利。她强调,AI商业回报的关键在于推理阶段,即模型为用户执行任务时的调用。苏姿丰预测,随着智能体AI普及,CPU与GPU配比正向1:1演进,并提到供应链中CPU和高带宽内存存在短缺,半导体产业正协同扩产以满足需求。此外,她对AI PC市场前景乐观,预计将迎来两位数增长,下一波爆发点将是机器人、工业制造与物理AI的结合。
原文链接
银河证券5月19日研报指出,云服务行业正进入需求放量、量价共振的上行周期。随着词元消耗量持续增长,全社会AI推理需求规模化释放,对阿里云等云服务商形成利好。词元成为智能时代的核心结算单位,云计算商业模式从传统IaaS模式转向以词元消耗为核心的MaaS按量计费体系。这一转变推动云厂商高毛利AI服务收入扩大,优化盈利结构,行业迎来新的增长机遇。
原文链接
4月2日,英伟达宣布向半导体公司Marvell Technology投资20亿美元,并建立深度战略合作伙伴关系,消息推动Marvell股价盘中一度大涨超10%。合作核心是将Marvell接入英伟达AI生态系统,特别是‘NVLink Fusion’平台,该平台支持半定制AI基础设施开发。Marvell将提供定制化XPU及兼容NVLink Fusion的网络解决方案,实现客户自研芯片与英伟达GPU等无缝集成。英伟达CEO黄仁勋称,AI推理转折点已至,全球正建设‘AI工厂’,此次合作助力客户规模化构建专用AI计算能力。对Marvell而言,这笔投资不仅是资金支持,也肯定了其技术实力。英伟达近期还向新思科技、CoreWeave等公司分别投资20亿美元,持续布局AI生态。
原文链接
3月27日,趋境科技在2026中关村论坛发布ATaaS高效能AI Token生产服务平台,打造日均万亿产能的“Token工厂”。郑纬民院士指出,2026年是“Token爆发元年”,AI产业核心从模型服务转向Token服务。平台依托四大自研技术,破解算力投入与Token产出失衡难题,提升资源利用率和推理效率。论坛汇聚产学研用多方代表,探讨国产算力生态优化实践,并宣布2026春季启元人工智能大赛启动,推动AI产业规模化应用与人才培养。
原文链接
谷歌研究院于3月26日推出全新AI内存压缩技术TurboQuant,有效解决AI推理中的内存瓶颈问题。该技术通过向量量化方法压缩缓存,在不损失精度的前提下,可将大语言模型的缓存内存占用缩减至少6倍,推理速度最高提升8倍。其核心技术包括PolarQuant量化方法和QJL优化手段,计划在下月的ICLR 2026会议上正式发布。实验显示,TurboQuant在Gemma和Mistral等开源模型上无需预训练或微调即可实现高效压缩,键值缓存降至3比特,并在长上下文测试中保持零精度损失。此外,在H100 GPU加速器上,4比特TurboQuant运行速度较32比特基准提升8倍,为AI系统效率与成本优化带来突破性进展。
原文链接
2026年3月23日,NVIDIA在GTC大会上发布全新LPU芯片,旨在重塑AI推理。首席科学家Bill Dally透露,NVIDIA正研究片上通信静态调度技术,可大幅降低延迟至30纳秒,并取消路由开销等瓶颈。Dally表示,未来单用户推理速度可达每秒1万到2万Token,较当前普遍不足100Token的速度提升显著。此外,通过优化架构和采用SRAM缓存,能耗可降低1000倍,但SRAM成本较高,LPU30仅集成500MB缓存。新技术将推动AI推理效率飞跃,为行业带来革命性变化。
原文链接
3月16日,英伟达CEO黄仁勋在GTC大会上宣布,AI推理市场迎来拐点,行业从训练阶段转向推理与执行阶段,推理算力需求激增。英伟达将与专注推理技术的初创公司“格罗克”合作,推出全新AI服务器系统,强化在低成本、低延迟推理计算领域的布局,以支撑万亿级算力市场需求。这一举措标志着英伟达正积极抢占AI推理市场的下一波发展机遇。(央视财经)
原文链接
2026年3月17日,华为在数据存储新春发布会上推出面向AI推理场景的新一代AI数据基础设施。新产品包括针对中心训推场景的AI数据平台和适用于分支边缘推理场景的FusionCube A1000超融合一体机。AI数据平台整合知识库、KV Cache加速和记忆库能力,通过UCM技术统一管理调度,可将Agent推理准确率提升30%。FusionCube A1000支持通算智算全栈部署,兼容主流智能体与大模型,能缩短AI应用上线周期80%,并提升算力利用率30%。这一发布为AI推理场景提供了高效、灵活的数据支持。(记者 黄心怡)
原文链接
根据TrendForce集邦咨询最新调查,2025年第四季度,全球前五大企业级SSD品牌厂营收季增高达51.7%,突破99亿美元。这一增长主要得益于AI推理应用普及对存储系统的高需求、企业大规模升级通用服务器,以及HDD供应短缺带来的转单效应。此次市场变化凸显了存储行业在AI驱动下的强劲发展势头,预计将进一步推动企业级SSD的市场规模和技术升级。
原文链接
加载更多
暂无内容