综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
8月28日,OpenAI公布自研推理芯片Jalapeño跑分数据,其Token吞吐与延迟表现亮眼,引发与NVIDIA Rubin的对比热议。这标志着GPU推理路线正走向分裂:NVIDIA引入Groq 3 LPU专攻低延迟Decode;Google则推出分立训练与推理的TPU 8t和8i。大模型硬件竞争坐标已从单纯算力转向Token成本与效率。随着Agent应用爆发,推理对内存带宽要求剧增。未来AI芯片竞争的关键,不再是打造更强单芯,而是如何精准拆分任务,实现系统级Token成本的最优解。#AI芯片# #OpenAI#
原文链接
加载更多
暂无内容