三种缓存映射类型对比-EDN 电子技术设计

 在计算机中，整个内存可以根据访问时间和容量分为不同的级别。更小、更快的内存会更靠近处理器。如果处理器所需要的数据离处理器越近，访问时间就越少。因此，我们希望让处理器所需要的数据离它更近。但这是怎么实现的呢？

在计算机中，整个内存可以根据访问时间和容量分为不同的级别。图1显示了内存层次结构中的不同级别。更小、更快的内存会更靠近处理器。如果处理器所需要的数据离处理器越近，访问时间就越少。因此，我们希望让处理器所需要的数据离它更近。但这是怎么实现的呢？EwLednc

EwLednc

图1：内存层次结构。EwLednc

根据局部性原则，当处理器访问一个字节的内存时，它更有可能再次访问该内存位置。此外，处理器更有可能很快访问附近的字节。在图2中，诸如比较“i”和“n”、递增“i”、将“a”加1等指令执行了多次。像“i”、“a”、“b”、“n”和“c”这样的变量被多次使用。这些指令和变量在工作集中。如果工作集可以保存在缓存中，程序将运行得更快。随着程序的执行，工作集发生了变化。EwLednc

EwLednc

图2：简单的C语言for循环。EwLednc

缓存

缓存是临时存储数据的高速存储器。它们的大小较小，从几KB到几MB不等。CPU缓存通常分为不同的级别(L1缓存、L2缓存和L3缓存)。离CPU越远，缓存越大，访问时间越长。因此，L2缓存可以存储比L1缓存更多的缓存行，而L3缓存可以存储比L2缓存更多的缓存行。当处理器启动并运行时，缓存控制器会接收请求以确定所请求的数据是否存在于缓存中。如果没有，可能会要求缓存控制器分配缓存行。那么，当数据从下游返回时，缓存控制器如何将其放入缓存中呢？EwLednc

存在三种不同类型的缓存映射：直接映射、全相联映射和组相联映射。EwLednc

直接映射缓存

在直接映射缓存中，一个内存块只能映射到缓存中的一个可能位置。例如，让我们考虑一个8KB缓存，缓存行大小为64字节。这意味着缓存有128个缓存行。在缓存的传入地址中，需要6位来寻址缓存行中的每个字节(2^6=64)，它们被称为缓存偏移位(图3)。地址中接下来的7位用于将内存块映射到缓存行(2^7=128)，它们被称为索引位。其余位存储在缓存中以标识内存块。这些位称为标记。EwLednc

EwLednc

图3：直接映射缓存的缓存地址。EwLednc

全相联缓存

在全相联缓存中，内存块可以放置在任何缓存行中。如果上述示例中的同一个缓存是全相联的，那么就不需要任何位来索引任何缓存行。因此，除了6个缓存偏移位之外，其余的都是标记位(图4)。EwLednc

EwLednc

图4：全相联缓存的缓存地址。EwLednc

组相联缓存

组相联缓存是直接映射缓存和全相联缓存的组合。在组相联缓存中，每个内存块都可以映射到一个组，这些组可能包含“n”个缓存行。例如，一个4路组相联缓存在每个组中有4个缓存行。在每个组中，缓存映射是全相联的。因此，组相联缓存需要一些位来索引地址以表示组。让我们将上述示例中的相同缓存视为4路组相联，这意味着将有32个组(128/4=32)。索引到一个组中需要5位(图5)。EwLednc

EwLednc

图5：组相联缓存的缓存地址。EwLednc

缓存场景

现在，让我们看一下具有8次迭代的for循环(图6)。在每次迭代中，数组的一个元素(数据类型为“int”)都会递增。假设在第一次迭代中，将带有a[0]元素(4字节)的内存块(64字节)从主内存引入一级缓存(图7)。在接下来的连续迭代中，处理器所需要的所有数据(a[1]、a[2]、a[3]、…a[7])都将位于L1缓存中。这在很大程度上降低了内存访问时间。EwLednc

EwLednc

图6：C语言for循环。EwLednc

EwLednc

图7：主内存和缓存中的内存块表示。EwLednc

现在让我们看一个不同的场景。EwLednc

EwLednc

图8：C语言指令。EwLednc

让我们考虑一个具有128个缓存行和64字节缓存行大小的直接映射缓存。为了执行第一条语句，需要将内存块从主内存中的地址0引入一级缓存的索引0。执行第二条语句需要将地址为32'h80的内存块引入缓存中。由于地址32'h80映射到索引0，因此需要驱逐现有的有效缓存行以引入新的内存块。这增加了更多的延迟。同样，下一条指令需要地址32'h100处的内存块，将会触发缓存行驱逐和内存块提取。当使用直接映射缓存时，此程序会导致性能不佳。EwLednc

现在让我们看看具有128个缓存行和64字节缓存行大小的全相联缓存的行为方式。当执行这些指令中的每一个时，就会将新的内存块引入缓存，但不需要驱逐内存块，因为内存块可以放置在缓存中的任何位置，前提是缓存具有无效的缓存行。EwLednc

4路组相联缓存每个组有4个缓存行。因此它最多可以为同一个索引分配4个内存块而不会驱逐。因此，上面的三个指令将导致在组0下分配三个内存块。EwLednc

当连续的指令获取映射到一个索引或一个组的内存块时，直接映射缓存和组相联缓存会遇到更多冲突。将会发生驱逐和引入新的内存块。但这些类型的缓存也有优势。在直接映射缓存中，在缓存查找期间，缓存控制器只需要查找一个地方。这使得缓存查找速度更快。在缓存查找期间，全相联缓存需要将所有缓存行与传入地址进行比较，以确定它是否具有缓存行的有效副本。这需要许多比较器，这使得与直接映射缓存相比，全相联缓存更加昂贵。这也意味着全相联缓存会消耗功率来查找缓存。组相联缓存是全相联缓存和直接映射缓存之间的权衡。组相联缓存受到了广泛使用，因为它们受益于以下两个方面：关联性和将内存块映射到组的想法。EwLednc

EwLednc

Krishnakanth是英特尔的图形硬件工程师。他毕业于圣何塞州立大学，获得了电气工程硕士学位。EwLednc

EwLednc

（原文刊登于EDN姊妹网站Embedded，参考链接：Understanding cache placement，由Franklin Zhao编译。）EwLednc

责编：Franklin

阅读全文，请先

缓存/存储技术处理器/DSP 嵌入式系统技术实例

上一篇： 中国存储标准化,《存储产业标准化白皮书(2022)》发布 下一篇： 优傲预测2023年五大自动化趋势

微信扫一扫
一键转发
最前沿的电子设计资讯
请关注“电子技术设计微信公众号”

631.2亿美元的市场，创新制造工艺将为柔性电子带来什么？柔性电子设备的新型制造技术正在迅速涌现。有些人可能想知道它们是否比传统方法更好，以及它们什么时候会商业化，它们会影响电子设计工程师未来的创新吗？
雷击之后加强我的NAS备份，谨慎遵循3-2-1备份规则？在我之前报道被雷击事故时，我曾提到过，这次被雷击损坏的电子设备中包括一台网络存储设备(NAS)。这次挫折迫使我不能再忽视我数据备份防护中一个长期存在的漏洞···
2025值得关注的八大前沿技术 2024年临近尾声，在这一年又有哪些技术得到了突破？这些技术又将如何影响我们的生活？EDN分析师团队将继续从行业背景、技术思路和未来应用三个层面出发，为读者朋友们献上2025年最值得关注的前沿技术！
英特尔Ultra处理器，用普通内存也能超频到10000 MT/s+？目前内存超频的世界记录是12666MT/s，而想要达成这样的频率不光需要降低CPU频率，还需要辅助液氮等特殊的冷却方案，对内存进行降温。但已有主板可以在没有特殊冷却方案的情况下，超频到10000 MT/s以上···
英伟达或推中国特供RTX 5090 D，硬件与5090完全相同？据外媒曝光的消息，英伟达即将推出的50系显卡也会推出专门的中国特供版本，名称为GeForce RTX 5090 D···
普通CTP处理不过来？试试这个预累加器VFC处理方案 VFC的数字化是天然集成的，因此具有固有的高噪声抑制能力和可编程分辨率，遗憾的是，它的转换速度并不优秀···
看似简单的冲击激励石英振荡器，这几个细节要注意这个电路看似极其简单，但却表现出不同寻常的行为。它产生奇整数石英谐波的近似方波，包括其主频率···
CXL IP以两位数纳秒延迟扩展GPU内存纳米级超低延迟CXL控制器IP利用低成本存储介质，可扩展GPU系统内存至TB级……
硬核科技，赋能未来：解码芯片产业创新趋势在近日举办的E维智库第12届中国硬科技产业链创新趋势峰会暨百家媒体论坛上，邀请了来自艾迈斯欧司朗、Qorvo、RAMXEED（原富士通半导体）、飞凌微、安谋科技、清纯半导体等企业的多位行业专家，共同探讨芯片技术在各个领域的应用和发展方向···
为什么DAC和ADC对于扩展量子计算机至关重要？ DAC和ADC将在量子计算机扩展过程中发挥关键作用，加速量子计算机朝向更复杂的实际应用发展…
意法半导体推出Page EEPROM二合一存储器，提升智能边缘 EEPROM的字节级写操作灵活性，实现真正的两全其美···
采用RISC-V架构，紫光同芯发布全球首颗开放式架构安全芯近日，紫光同芯发布了全球首颗开放式架构安全芯片E450R，这款芯片不仅同时具有开放式硬件+软件架构，还获得了多项权威认证，标志着安全芯片领域的重大突破···

机器人所需要的传感器有哪些？随着机器人技术的迭代升级，传感器的重要性将持续提升，其功能性、精度和适配性也将得到显著改进，作为机器人不可
2024年墨西哥市场分析，中国品牌崛起 2024年，墨西哥汽车市场以近10%的增长率展现了强劲的复苏势头，中国品牌的崛起为市场注入了新活力，当然现在的政
2025，大众汽车集团在中国如何转型？ 2024 年，大众汽车集团（中国）在复杂多变的市场环境中成功达成销量目标，向客户交付超过 290 万辆汽车，新能源汽车领
国产射频芯片公司汇总对于射频芯片这项卡脖子技术，国内很多公司在这方面努力，而且也做出了不错的成绩。一些射频芯片公司无论从研发
拆解报告：松下电器1200W电吹风松下EH-NW90电吹风内置10万转高速无刷电机，并具备三档风速和四档风温可选。电吹风内置纳诺怡技术，为秀发提供
拆解报告：白牌电动工具电池多功能放电转换器这款白牌多功能放电转换器适配得伟电动工具电池使用，将电动工具电池和放电转换器组装起来，即可组成移动电源和
拆解报告：MOMA猛玛LARK M2无线麦克风 MOMA猛玛LARK M2无线麦克风在外观方面，采用了极富创新的设计，提供了轻盈舒适的佩戴使用体验。发射器采用了夹
阿根廷2024年：销量下滑，北汽增长240.1%。 2024年阿根廷汽车市场在整体销量下滑的背景下，依然展现出多元化的发展趋势···
2025年第3周：全球最快四足机器人发布 2025年将成为机器人产业的关键时间点，业内预期27年人形机器人出货量可达50~100万台。从技术进步到供应链成熟
欧洲2024年汽车市场：微弱复苏和电动化加速并存 2024年，欧盟新车注册量小幅增长0.8%，达到约1060万辆，欧盟+英国+北欧国家的销量为1296.4万台，同比增长0.9%，整个欧
射频微波领域有哪些高质量期刊？今天我们结合网络上的资料一起整理一份射频微波领域的期刊列表，以便同学们投稿时可以选择···
拆解报告：Portal智能屏幕24W电源适配器 Portal智能屏幕电源适配器采用黑色直板机身，外观整洁，配有2米长黑色输出线。适配器采用美规固定插脚，支持100-2

性能飞跃！升级电流传感器NSM201x-P系列赋能汽车三电和光伏逆变器纳芯微推出全新车规级集成电流路径霍尔传感器NSM201x-P系列。该系列产品是对纳芯微已量产的NSM201x系列的完
意法半导体推出STSPIN32G0新列电机驱动器，满足工业自动化和家电市意法半导体STSPIN32系列集成化电机驱动器新增八款产品，满足电动工具、家用电器、工业自动化等应用的低成本、
Melexis推出性能先进的温度传感器，以红外技术创新实现电磁炉智能全球微电子工程公司Melexis宣布，推出专为电磁炉设计的非接触式红外温度传感器芯片MLX90617···
康佳特SMARC模块更新: 全新英特尔酷睿3处理器低功耗 SMARC 模块AI 加速和图形处理性能再次提升···
康佳特针对要求苛刻的实时应用推出新型高性能COM-HPC模块基于英特尔酷睿 Bartlett Lake S处理器的模块性能全面提升···
为汽车安全保驾护航，纳芯微推出基于AMR技术的ABS轮速传感器纳芯微宣布推出全新基于AMR（各向异性磁阻技术）的轮速传感器NSM41xx系列。该系列产品通过集成先进的磁性传感敏
Microchip推出全新Switchtec™ PCIe® 4.0 16通道交换机系列 PCI100x系列器件可为任何需要加速或专用计算的应用提供高性能和成本效益···
RK3576有多强？实测三屏八摄像头轻松搞定-米尔米尔基于他们推出的MYD-LR3576开发板开发了一个3屏异显，8路摄像头输入的DEMO，实测下来，RK3576轻松搞定了该任
SynQor®推荐先进的军用级三相输入UPS（UPS-1500-S-1U-T） SynQor的三相输入UPS电源能使单相负载在电源端呈现出符合MIL-STD-1399-300B标准的清洁、表现良好且几乎零反
村田开发超小尺寸、超低功耗的Type 2GQ GNSS模块，以匠心品质助在几年前，定位系统充斥于生活方方面面的情节还仅见于各式的科幻影片，而今具备这一功能的产品已经以各种形态步
瑞萨推出性能卓越的新型MOSFET 瑞萨全新晶圆技术可以帮助MOSFET实现导通电阻降低30%、栅漏电荷减少40%、封装尺寸缩小50%的目标···
加特兰集成 Cadence Tensilica ConnX 220 DSP 全面升级汽 ConnX 220 DSP 集成至基于下一代 Andes SoC 的加特兰雷达解决方案后，将带来显著优势，包括提高灵活性、

热门评论
最新评论

换一换

杂志声明

三种缓存映射类型对比

缓存

直接映射缓存

全相联缓存

组相联缓存

缓存场景