65nm做AI芯片能效远超A100!SK海力士这次玩大了
快科技7月11日新闻,,,,SK海力士、TetraMem和南加州大学联合搞了个大事,,,,宣布了基于忆阻器(memristor)的存内盘算(IMC)SoC(片上系统)芯片,,,,专攻边沿AI装备。。
这款芯片焦点卖点是能效,,,,在100MHz下抵达21.3 TOPS/W,,,,400MHz下也有11.9 TOPS/W,,,,论文称其能效比英伟达A100的INT8模式横跨一个数目级。。
但性能就有点拉了,,,,峰值只有2.54 TOPS,,,,比微软Copilot+的要求低了16倍。。
芯片用65nm老工艺制造,,,,内含10个NPU(神经网络处理单位),,,,9个跑古板操作,,,,1个专门优化深度可疏散卷积(DWC)。。
优化后的NPU用了锯齿形交织阵列拓扑,,,,把选择线改成斜向走线,,,,实现28个自力的3×3卷积并行,,,,阵列使用率拉满。。
忆阻器编程精度只有约2 bit,,,,团队用双子阵列赔偿手艺提升到约4 bit,,,,思绪类似英伟达NVFP4,,,,但一个走数字赔偿,,,,一个走模拟赔偿。。
现实演示用MobileNetV1Small跑测试,,,,端到端推理精度80.36%,,,,与4-bit软件模子相当,,,,但10个NPU只用了6个,,,,论文没披露满载的真实吞吐量。。
SK海力士认真忆阻器器件开发和制造,,,,用后端工艺把阻变存储单位集成在65nm CMOS电路上方。。
这篇论文实质是个看法验证,,,,能效数据亮眼但性能数字不太能打,,,,不过对功耗敏感的边沿AI场景,,,,这个偏向值得关注。。
文章点评
未盘问到任何数据!
揭晓谈论
◎接待加入讨论,,,,请在这里揭晓您的看法、交流您的看法。。