测试显示这款芯片每瓦 AI 工作量是英伟达 GB200/GB300 的 1.5 至 1.9 倍,端到端延迟仅为对手的 28% 至 59%,能效表现十分出色。#OpenAI自研芯片#...
在 SemiAnalysis 的 InferenceX 测试中,Jalapeño 无论是单用户 token 处理量,还是每千瓦吞吐量,都超过了目前市面上的顶尖推理处理器。...
别按训练的逻辑规划推理存储——AI推理场景的存储选型与ZStoneZBS能力解析关于AI存储的讨论,近两年几乎全部聚焦于训练环节:高吞吐、大带宽、并行文件系统、GB/s级读取速率。...
AMD 和 Cerebras Systems (CBRS)于本周三宣布建立技术合作伙伴关系,受利好消息影响,Cerebras Systems 股价今天盘中上涨 11%。...