三星(Samsung)在Hot Chips 2026上展示了LPDDR5X-PIM,将内存内处理逻辑添加到低功耗DRAM中用于AI推理。
在初步测试中,该公司在Llama 3.1 8B上显示了2.28倍的模型运行时间改进和3.01倍的每秒token数增加,以及声称的8倍带宽提升。这些数字基于特定工作负载,而非通用系统性能结果。
Hot Chips议程将该环节列为三星基于LPDDR5X的PIM解决方案,用于AI推理,而演示则描述了放置在存储体旁边的逻辑,使选定的乘加工作能够在更靠近存储数据的地方进行。
演示中的两个性能数字衡量不同方面。Tom's Hardware报道了使用PIM时模型运行时间改进2.28倍和每秒token数增加3.01倍。
同一报道描述了在边缘AI加速器上使用Llama 3.1 8B的测试。三星还报告称,LPDDR5X-9600的76.8GB/s峰值带宽通过PIM可提升至614GB/s,这个8倍的增益与减少在内存中执行工作的数据传输相关。
所报告的设计使用常规单存储体操作以及多存储体PIM模式,因此潜在收益取决于哪些操作可在内存中运行以及主机如何协调它们。
( 素材来自:Samsung 智算芯能前沿网综合)
本文由智算芯能前沿网编辑整理,转载请注明出处。
