CPU学习笔记(一)------SkyLake Microarchitecture详解

2023-12-06 21:10

本文主要是介绍CPU学习笔记(一)------SkyLake Microarchitecture详解,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

最近在学习CPU架构相关内容,做个笔记,不足之处还望指出,共同交流进步

Sky Lake Architecture

    • 1. CPU总体架构简图
    • 2.CPU前端(Front End)
      • L1 Instruction Cache
      • Instruction Fetch & PreDecode
      • Instruction Queue
      • MS ROM (MocroCode Sequencer ROM)
      • DSB (Decode Stream Buffer)
      • SE (Stack Engine)
      • Allocation Queue (IDQ)
      • 总结
    • 3.CPU后端
      • ROB (Reorder Buffer)
      • RS(Scheduler unified reservation station)
      • Store Buffer && LoadBuffer
    • 4. 参考资料

1. CPU总体架构简图

SkyLake总体架构

图中将CPU分为三个部分:

  • Front End(前端)
  • Out of Order Engine(无序执行引擎)
  • Memory Pipeline (存储系统)
    图中标色部分表示现在存在系统安全性漏洞的组件,这张图主要是为了解释Meltdown漏洞,所以更加突出了OoO(Out of Order)部分的内容. 一般的,我们按照指令的执行过程将CPU分为前后端。本文以四段指令流水线为例。
    四段指令流水线:Fetch、Decode、Execution、WriteBack/Store
    前端| Fetch、Decode 后端| Execution、WriteBack/Store

2.CPU前端(Front End)

CPU前端 Front-end

L1 Instruction Cache

Instruction Fetch & PreDecode

从L2 Cache取得数据,是CPU最直接的数据来源,当CPU需要处理数据时,即从最近的L1cache中读取,若发生cache miss 则查Instruction TLB从L2中获取所需数据,若L2也发生cache miss,则逐级查询,直到查到指定数据或者发生页面错误。

Instruction Fetch & PreDecode

Instruction Queue
一个时钟周期读取16Bytes 对Cache Line中的二进制数据进行初步的识别解码,识别其中有几个汇编指令,确定指令边界,并将识别出的指令传入Instruction Queue

Instruction Queue

Instruction Queue

Instruction Fetch & PreDecode中识别出的汇编指令进行优化。这一步主要填补应用程序员编码时留下的坑,有的高级代码有更加简介的写法,但是写的更复杂了。
本部分中Macro-Fusion将相近的多个汇编指令替换成一个或者更简单的指令执行,通过这一步骤的优化,减少汇编指令的数量,使得CPU有限的资源能够得到最大的利用,不做无意义的操作。

MS ROM (MocroCode Sequencer ROM)

 MS ROM (MocroCode Sequencer ROM)
Instruction Queue中传入的优化后的汇编指令进行解码,将指令长度不同的MOP替换成指令长度一样的微操作uOP
图中可以看出,具有三个简单解码器,一个复杂编码器。简单编码器输出长度为1的微操作,大于1小于等于4个微操作由复杂解码器解码。需要指出的是:当Complex Decoder进行工作时,至少有一个Simple Decoder停止工作;当MS ROM工作时,所有的Complex/Simple Decoder停止工作。
MOP解码后分为大于4个的uOP,则直接去MS ROM中进行查询生成,可以将 MS ROM 看作一个Cache。

DSB (Decode Stream Buffer)

DSB
微操作Cache,将一些已经解码的MOP对应的uOP存在其中,进一步加快解码速度。

SE (Stack Engine)

SE
查询多路选择器MUX的输出结果中是否有return、Call等需要栈的操作,若有则执行,从而避免CPU执行时还需要中断处理,进而进一步加快CPU处理速度。

Allocation Queue (IDQ)

IDQ曾名为Instruction Decoder Queue,IDQAllocation Queue作为前端与执行单元的接口,是Core前端的最后的一个部件。分配队列的目的是将微指令uOP进行重新整合与融合,发给执行单元进行乱序执行。分配队列又包含了Loop Stream Detector(LSD) 循环流检测器,对循环操作进行标记,避免重复解码与 up-Fusion(微指令融合单元)。融合是为了让后续解码单元更有效率并且节省ROB(re-order buffer)的空间。

总结

总而言之,Front End的目的是为了使得后端繁忙起来。


3.CPU后端

CPU后端 backend

ROB (Reorder Buffer)

ROB
ROB(re-order buffer):重新排序缓冲区。ROB的存在ROB的目的为存储out-of-order的处理结果,作为EU的入口兼部分出口,它是乱序执行的最基本保证。当指令被传如ROB中,微指令流会以顺序执行的方式传入到后面的RS,在经过ROB时,会占用ROB的一个位置,这个位置是存储微指令乱序执行处理完成时候的结果,之后经过整合会顺序写回到相应的寄存器。而微指令在经过ROB时候会做一些优化。(消除寄存器移动,置零指令与置一指令等)。此外对于超线程中的寄存器别名技术在此经过RAT(寄存器别名表)进行寄存器重命名。

RS(Scheduler unified reservation station)

在这里插入图片描述

RS(Scheduler unified reservation station):统一调度保留站。指令经过前面千辛万苦来到这里,此时微指令不在融合在一起,而是被单独的分配给下面各个执行单元,从架构图中可以看到,RS下面挂载了八个端口,每个端口后面挂载不同的执行模块应对不同的指令需求。

Store Buffer && LoadBuffer

LoadBuffer中存在ZombieLoad漏洞,后续文章详解。

4. 参考资料

  1. 【知乎】计算机与服务器底层世界-CPU架构篇-Core author:Lucars
  2. 【大图】SkyLake MicroArchitecture
  3. 【知乎】Skylake Microarchitecture Author:yyz
  4. 【文档-英文】SkyLake MicroArchitecture(client)详细参数

这篇关于CPU学习笔记(一)------SkyLake Microarchitecture详解的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/463346

相关文章

Python函数作用域示例详解

《Python函数作用域示例详解》本文介绍了Python中的LEGB作用域规则,详细解析了变量查找的四个层级,通过具体代码示例,展示了各层级的变量访问规则和特性,对python函数作用域相关知识感兴趣... 目录一、LEGB 规则二、作用域实例2.1 局部作用域(Local)2.2 闭包作用域(Enclos

Python实现对阿里云OSS对象存储的操作详解

《Python实现对阿里云OSS对象存储的操作详解》这篇文章主要为大家详细介绍了Python实现对阿里云OSS对象存储的操作相关知识,包括连接,上传,下载,列举等功能,感兴趣的小伙伴可以了解下... 目录一、直接使用代码二、详细使用1. 环境准备2. 初始化配置3. bucket配置创建4. 文件上传到os

Java内存分配与JVM参数详解(推荐)

《Java内存分配与JVM参数详解(推荐)》本文详解JVM内存结构与参数调整,涵盖堆分代、元空间、GC选择及优化策略,帮助开发者提升性能、避免内存泄漏,本文给大家介绍Java内存分配与JVM参数详解,... 目录引言JVM内存结构JVM参数概述堆内存分配年轻代与老年代调整堆内存大小调整年轻代与老年代比例元空

Python中注释使用方法举例详解

《Python中注释使用方法举例详解》在Python编程语言中注释是必不可少的一部分,它有助于提高代码的可读性和维护性,:本文主要介绍Python中注释使用方法的相关资料,需要的朋友可以参考下... 目录一、前言二、什么是注释?示例:三、单行注释语法:以 China编程# 开头,后面的内容为注释内容示例:示例:四

mysql表操作与查询功能详解

《mysql表操作与查询功能详解》本文系统讲解MySQL表操作与查询,涵盖创建、修改、复制表语法,基本查询结构及WHERE、GROUPBY等子句,本文结合实例代码给大家介绍的非常详细,感兴趣的朋友跟随... 目录01.表的操作1.1表操作概览1.2创建表1.3修改表1.4复制表02.基本查询操作2.1 SE

MySQL中的锁机制详解之全局锁,表级锁,行级锁

《MySQL中的锁机制详解之全局锁,表级锁,行级锁》MySQL锁机制通过全局、表级、行级锁控制并发,保障数据一致性与隔离性,全局锁适用于全库备份,表级锁适合读多写少场景,行级锁(InnoDB)实现高并... 目录一、锁机制基础:从并发问题到锁分类1.1 并发访问的三大问题1.2 锁的核心作用1.3 锁粒度分

MySQL数据库中ENUM的用法是什么详解

《MySQL数据库中ENUM的用法是什么详解》ENUM是一个字符串对象,用于指定一组预定义的值,并可在创建表时使用,下面:本文主要介绍MySQL数据库中ENUM的用法是什么的相关资料,文中通过代码... 目录mysql 中 ENUM 的用法一、ENUM 的定义与语法二、ENUM 的特点三、ENUM 的用法1

MySQL count()聚合函数详解

《MySQLcount()聚合函数详解》MySQL中的COUNT()函数,它是SQL中最常用的聚合函数之一,用于计算表中符合特定条件的行数,本文给大家介绍MySQLcount()聚合函数,感兴趣的朋... 目录核心功能语法形式重要特性与行为如何选择使用哪种形式?总结深入剖析一下 mysql 中的 COUNT

一文详解Git中分支本地和远程删除的方法

《一文详解Git中分支本地和远程删除的方法》在使用Git进行版本控制的过程中,我们会创建多个分支来进行不同功能的开发,这就容易涉及到如何正确地删除本地分支和远程分支,下面我们就来看看相关的实现方法吧... 目录技术背景实现步骤删除本地分支删除远程www.chinasem.cn分支同步删除信息到其他机器示例步骤

Go语言数据库编程GORM 的基本使用详解

《Go语言数据库编程GORM的基本使用详解》GORM是Go语言流行的ORM框架,封装database/sql,支持自动迁移、关联、事务等,提供CRUD、条件查询、钩子函数、日志等功能,简化数据库操作... 目录一、安装与初始化1. 安装 GORM 及数据库驱动2. 建立数据库连接二、定义模型结构体三、自动迁