A64指令集架构之PCS过程调用标准

2024-02-07 03:28

本文主要是介绍A64指令集架构之PCS过程调用标准,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

Arm架构对通用寄存器的使用几乎没有限制。简而言之,整数寄存器和浮点寄存器都是通用寄存器。然而,如果你希望你的代码与他人编写的代码互动,或者与编译器生成的代码互动,那么你需要就寄存器的使用达成一致的规则。对于Arm架构,这些规则被称为过程调用标准(Procedure Call Standard),或者PCS。

PCS规定了:

  1. 用于将参数传递给函数的寄存器。
  2. 用于将值返回给调用函数(称为调用者caller)的寄存器。
  3. 被调用的函数(称为被调用者callee)可以破坏哪些寄存器。
  4. 被调用者不能破坏哪些寄存器。

考虑一个从main()调用的函数foo():

fcd40760ade94ceb9a1791a746e730b8.png

PCS规定第一个参数传递给X0,第二个参数传递给X1,以此类推,直到X7。任何额外的参数都传递到栈stack上。我们的函数foo()接受两个参数:b和c。因此,b将位于W0,c将位于W1。

为什么是W而不是X?因为这些参数是32位类型,因此我们只需要一个W寄存器。

【注意】:在C++中,X0用于传递指向被调用函数的隐式this指针。

接下来,PCS定义了哪些寄存器可以被破坏,哪些寄存器不能被破坏。如果一个寄存器可以被破坏,那么被调用的函数可以在不需要恢复的情况下覆盖它,正如PCS寄存器规则表所示:

e7dcbfc56a95412ea8a4155a6b833cfa.png

92674025036746d38ca905eadfbd26ad.png

例如,函数foo()可以使用寄存器X0到X15而无需保留它们的值。然而,如果foo()想要使用X19到X28,它必须先保存它们到栈,然后在返回之前从栈中恢复它们。

在PCS中,一些寄存器具有特殊的意义:

  • XR - 这是一个间接结果寄存器。如果foo()返回一个结构体,那么结构体的内存将由调用者分配,例如在前面的例子中是main()。XR是指向由调用者分配用于返回结构体的内存的指针。
  • X16和X17(IP0和IP1) - 这些寄存器是过程内调用可破坏寄存器。这些寄存器可以在调用函数和到达函数的第一条指令之间被破坏。链接器使用这些寄存器在调用者和被调用者之间插入veneers。veneers是一小段代码,最常见的例子是用于分支范围扩展。A64中的分支指令是有限的范围。如果目标超出了该范围,那么链接器需要生成一个veneer来扩展分支的范围。
  • FP - 帧指针。
  • LR - X30是用于函数调用的链接寄存器(LR)。

对于X16和X17,在《ARM安全架构——为复杂软件提供保护》一文中的BTI分支目标识别中会被特殊使用。

BTI如何实现?

        PSTATE包含一个字段,BTYPE,记录分支类型。在执行间接分支时,间接分支的类型记录在PSTATE.BTYPE中。以下列表显示了不同分支指令的BTYPE取值:

BTYPE=11:BR、BRAA、BRAB、BRAAZ、BRABZ,使用除X16或X17之外的任何寄存器
BTYPE=10:BLR、BLRAA、BLRAB、BLRAAZ、BLRABZ
BTYPE=01:BR、BRAA、BRAB、BRAAZ、BRABZ,使用X16或X17
        执行任何其他类型的指令,包括直接分支,都会将BTYPE设置为b00。

        为什么要存储两个位?一个简单的实现可以记录间接分支是否正在进行中。然而,记录间接分支的类型进一步限制了查找小工具的可能性。BTI指令的语法包括一个参数,指定它可以被哪些类型的间接分支定位:

39c3450ce71d44b9822f0dd882352526.png

        当BTYPE!=00时,处理器会检查目标指令是否是一个着陆点。如果它不是一个着陆点,或者如果它是错误类型的间接分支,将生成异常。

X16和X17

        架构之所以区分使用X16或X17的间接分支和不使用的间接分支,是因为X16和X17在Arm使用的过程调用标准中具有特殊的意义。它们被称为过程内调用破坏寄存器,或称为IP0或IP1。它们可以被静态链接器用于插入分支范围扩展的veneers,或者被动态链接器用于处理跳转表。

        这对我们而言是相关的,因为这意味着一个函数可能直接通过BL或BLR从调用者进入,也可能通过链接器生成的代码间接进入,使用X16或X17。因此,函数入口的着陆点需要能够接受这两种情况。

【注意】: 我们之前介绍了ALU标志,用于条件分支和条件选择。PCS规定ALU标志在函数调用之间无需保存。

对于浮点寄存器,有一套类似的规则:

f4d8815248924ea084e0ec7852e9245f.png

 

这篇关于A64指令集架构之PCS过程调用标准的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/686388

相关文章

浅析Spring Security认证过程

类图 为了方便理解Spring Security认证流程,特意画了如下的类图,包含相关的核心认证类 概述 核心验证器 AuthenticationManager 该对象提供了认证方法的入口,接收一个Authentiaton对象作为参数; public interface AuthenticationManager {Authentication authenticate(Authenti

mybatis的整体架构

mybatis的整体架构分为三层: 1.基础支持层 该层包括:数据源模块、事务管理模块、缓存模块、Binding模块、反射模块、类型转换模块、日志模块、资源加载模块、解析器模块 2.核心处理层 该层包括:配置解析、参数映射、SQL解析、SQL执行、结果集映射、插件 3.接口层 该层包括:SqlSession 基础支持层 该层保护mybatis的基础模块,它们为核心处理层提供了良好的支撑。

百度/小米/滴滴/京东,中台架构比较

小米中台建设实践 01 小米的三大中台建设:业务+数据+技术 业务中台--从业务说起 在中台建设中,需要规范化的服务接口、一致整合化的数据、容器化的技术组件以及弹性的基础设施。并结合业务情况,判定是否真的需要中台。 小米参考了业界优秀的案例包括移动中台、数据中台、业务中台、技术中台等,再结合其业务发展历程及业务现状,整理了中台架构的核心方法论,一是企业如何共享服务,二是如何为业务提供便利。

作业提交过程之HDFSMapReduce

作业提交全过程详解 (1)作业提交 第1步:Client调用job.waitForCompletion方法,向整个集群提交MapReduce作业。 第2步:Client向RM申请一个作业id。 第3步:RM给Client返回该job资源的提交路径和作业id。 第4步:Client提交jar包、切片信息和配置文件到指定的资源提交路径。 第5步:Client提交完资源后,向RM申请运行MrAp

如何在页面调用utility bar并传递参数至lwc组件

1.在app的utility item中添加lwc组件: 2.调用utility bar api的方式有两种: 方法一,通过lwc调用: import {LightningElement,api ,wire } from 'lwc';import { publish, MessageContext } from 'lightning/messageService';import Ca

【机器学习】高斯过程的基本概念和应用领域以及在python中的实例

引言 高斯过程(Gaussian Process,简称GP)是一种概率模型,用于描述一组随机变量的联合概率分布,其中任何一个有限维度的子集都具有高斯分布 文章目录 引言一、高斯过程1.1 基本定义1.1.1 随机过程1.1.2 高斯分布 1.2 高斯过程的特性1.2.1 联合高斯性1.2.2 均值函数1.2.3 协方差函数(或核函数) 1.3 核函数1.4 高斯过程回归(Gauss

数据治理框架-ISO数据治理标准

引言 "数据治理"并不是一个新的概念,国内外有很多组织专注于数据治理理论和实践的研究。目前国际上,主要的数据治理框架有ISO数据治理标准、GDI数据治理框架、DAMA数据治理管理框架等。 ISO数据治理标准 改标准阐述了数据治理的标准、基本原则和数据治理模型,是一套完整的数据治理方法论。 ISO/IEC 38505标准的数据治理方法论的核心内容如下: 数据治理的目标:促进组织高效、合理地

系统架构设计师: 信息安全技术

简简单单 Online zuozuo: 简简单单 Online zuozuo 简简单单 Online zuozuo 简简单单 Online zuozuo 简简单单 Online zuozuo :本心、输入输出、结果 简简单单 Online zuozuo : 文章目录 系统架构设计师: 信息安全技术前言信息安全的基本要素:信息安全的范围:安全措施的目标:访问控制技术要素:访问控制包括:等保

C 标准库 - `<float.h>`

C 标准库 - <float.h> 概述 <float.h> 是 C 标准库中的一个头文件,它定义了与浮点数类型相关的宏。这些宏提供了关于浮点数的属性信息,如精度、最小和最大值、以及舍入误差等。这个头文件对于需要精确控制浮点数行为的程序非常有用,尤其是在数值计算和科学计算领域。 主要宏 <float.h> 中定义了许多宏,下面列举了一些主要的宏: FLT_RADIX:定义了浮点数的基数。

Solr 使用Facet分组过程中与分词的矛盾解决办法

对于一般查询而言  ,  分词和存储都是必要的  .  比如  CPU  类型  ”Intel  酷睿  2  双核  P7570”,  拆分成  ”Intel”,”  酷睿  ”,”P7570”  这样一些关键字并分别索引  ,  可能提供更好的搜索体验  .  但是如果将  CPU  作为 Facet  字段  ,  最好不进行分词  .  这样就造成了矛盾  ,  解决方法