头版Folia Daily Briefing
← 返回头版
科技半导体

Assembly Hall of Shame:x86指令延迟性能的极限探索

研究人员Christopher Domas发布了《Assembly Hall of Shame》项目,通过极端汇编优化技术对x86处理器单条指令的性能表现进行了系统测试 [1]。该研究揭示了CPU架构在指令执行延迟方面的性能边界和设计约束 [1]。

项目涵盖了27个指令样本,在Intel和AMD处理器上进行了测试 [1]。研究发现,性能表现跨度极大:最低延迟指令为nop,在Intel Core i7-8559U上仅需1周期 [1];而最高延迟指令为fxrstor64,在AMD Ryzen 7 5800H上达到198,002,498,236周期,耗时62秒 [1]。

为了获得这些极端性能数据,研究采用了多种技术手段,包括利用PCIe fabric高延迟MMIO区域、饱和总线以及多核并行读取等方法 [1]。


x86汇编CPU指令延迟性能测试MMIOChristopher Domas

来源

  1. Hacker NewsAssembly Hall of Shame