IP属地:北京
毫无疑问,GPU和AI加速器才是AI时代算力的最大提供者。训练AI模型需要GPU的超大算力,但一块GPU越来越存不下今天的模型,互联多块GPU成...
五月份买了12代Alder Lake架构的笔记本,CPU型号是i7 1280p,6大8小的配置。最近终于有机会研究一下这个架构的特性,顺便记录一...
本文作为上一篇文章(后面简称前文) M1 Max初相遇,快快乐乐写卷积 - 简书[https://www.jianshu.com/p/04382...
11月份入了M1 Max版本的MBP14,吃了两个月灰,春节终于有时间体验了一下apple silicon的威力~ 这颗SoC的能力非常夸张,有...
之前为了验证一个技术上的想法,随手写的一段汇编: https://github.com/pigirons/sgemm_hsw/blob/mast...
恩,这个系列的第一篇文章,先谈点轻松的,常用CPU架构浮点峰值的理论计算和实测。做性能优化,先要知己知彼,了解自己优化的CPU的能力上限。这样优...