CPU亲和性设置 代码示例 sched_setaffinity sched_getaffinity

2024-09-07 23:04

本文主要是介绍CPU亲和性设置 代码示例 sched_setaffinity sched_getaffinity,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

视频教程在这:

cpu亲和性设置,NCCL,sched_setaffinity sched_getaffinity,CPU_ZERO、SET、ISSET、linux_哔哩哔哩_bilibili

一、CPU亲和性简介

CPU亲和性(CPU Affinity)设置是操作系统中一个重要的性能优化手段,它允许程序或进程被绑定到特定的CPU核心上运行。这样做的好处包括减少缓存未命中、降低线程迁移(context switching)的开销,以及提高缓存的局部性(cache locality),从而可能提升程序的整体性能。

对于我们NCCL集合通信,也用到亲和性设置,通过将需要与GPU交互的CPU设置为距离近的CPU核心,来优化GPUCPU间的通信路径

NCCL通信时也用到亲和性设置,来优化GPU和CPU间的通信路径。

二、Linux系统中CPU亲和性的设置方法

在Linux系统中,CPU亲和性可通过sched_setaffinity系统调用进行设置,可以将当前进程或线程绑定到一组特定的CPU上。

2.1 sched_setaffinity()和sched_getaffinity

这里大家重点了解两个函数:sched_setaffinity()和sched_getaffinity

#include <sched.h>  int sched_getaffinity(pid_t pid, size_t cpusetsize, cpu_set_t *mask);
int sched_setaffinity(pid_t pid, size_t cpusetsize, const cpu_set_t *mask);

        sched_setaffinity():设置进程或线程的CPU亲和性
        sched_ getaffinity():获取进程或线程的CPU亲和性

参数说明

pid:要获取 CPU 亲和性的进程或线程的 ID。对于当前进程,可以使用 0。
cpusetsize:cpu_set_t 类型变量的大小,通常通过 sizeof(cpu_set_t) 获得。
mask:指向 cpu_set_t 类型的指针,用于存储返回的 CPU 亲和性掩码。在这个掩码中,每个位代表一个 CPU,如果某位被设置(即值为 1),则表示该进程或线程可以被调度到对应的 CPU 上运行。

2.2 CPU_ZEROCPU_SETCPU_ISSET、CPU_CLR

CPU_ZERO

CPU_ZERO宏用于初始化cpu_set_t类型的变量,将其所有位都设置为0。这表示在初始状态下,没有CPU核心被选中。

cpu_set_t cpuset;  
CPU_ZERO(&cpuset); // 初始化cpuset,所有位都设为0

CPU_SET

CPU_SET宏用于将cpu_set_t类型变量中指定的CPU核心对应的位设置为1。这表示该CPU核心被选中,进程或线程可以运行在该核心上。

CPU_SET(1, &cpuset); // 将cpuset中CPU 1对应的位设置为1

CPU_CLR

CPU_CLR宏用于将cpu_set_t类型变量中指定的CPU核心对应的位清除(即设置为0)。这表示该CPU核心不再被选中。

CPU_CLR(1, &cpuset); // 将cpuset中CPU 1对应的位清除

CPU_ISSET

CPU_ISSET宏用于检查cpu_set_t类型变量中指定的CPU核心对应的位是否被设置(即是否为1)。

if (CPU_ISSET(1, &cpuset)) {  // 如果cpuset中CPU 1对应的位被设置,则执行此代码块  
}

三、代码示例

获取当前进程的亲和性,并将亲和性设置为CPU0和CPU1。

#include <stdio.h>  // 引入标准输入输出头文件  
#include <stdlib.h> // 引入标准库头文件,用于exit函数  
#include <sched.h>  // 引入调度头文件,提供CPU亲和性相关的函数和宏  
#include <string.h> // 虽然在这个示例中未直接使用,但通常用于字符串操作  int main() {    cpu_set_t cpuset;  // 定义一个cpu_set_t类型的变量cpuset,用于表示CPU集合  size_t cpusetsize = sizeof(cpu_set_t);  // 获取cpu_set_t类型的大小,用作sched_setaffinity和sched_getaffinity的参数  // 验证并打印当前进程的CPU亲和性  cpu_set_t get_cpuset;  // 定义一个变量get_cpuset用于获取当前进程的CPU亲和性  CPU_ZERO(&get_cpuset);  // 初始化get_cpuset  // 尝试获取当前进程的CPU亲和性  if (sched_getaffinity(0, cpusetsize, &get_cpuset) == -1) {    perror("sched_getaffinity failed");  // 如果获取失败,则打印错误信息  exit(EXIT_FAILURE);  // 并以失败状态退出程序  }    // 打印当前进程的CPU亲和性  printf("Current CPU affinity: ");    for (size_t i = 0; i < CPU_SETSIZE; i++) {  // 遍历CPU_SETSIZE范围内的所有CPU编号  if (CPU_ISSET(i, &get_cpuset)) {  // 检查get_cpuset中对应CPU的位是否被设置  printf("CPU %zu ", i);  // 如果被设置,则打印该CPU编号  }    }    printf("\n");  // 换行  // 初始化CPU集合,将所有位清零  CPU_ZERO(&cpuset);    // 设置CPU亲和性,将CPU 0和CPU 1的位设置为1,表示希望将进程绑定到这两个CPU上  CPU_SET(0, &cpuset);    CPU_SET(1, &cpuset);    // 尝试设置当前进程的CPU亲和性  if (sched_setaffinity(0, cpusetsize, &cpuset) == -1) {    perror("sched_setaffinity failed");  // 如果设置失败,则打印错误信息  exit(EXIT_FAILURE);  // 并以失败状态退出程序  }    // 验证并打印当前进程的CPU亲和性  CPU_ZERO(&get_cpuset);  // 初始化get_cpuset  // 尝试获取当前进程的CPU亲和性  if (sched_getaffinity(0, cpusetsize, &get_cpuset) == -1) {    perror("sched_getaffinity failed");  // 如果获取失败,则打印错误信息  exit(EXIT_FAILURE);  // 并以失败状态退出程序  }    // 打印当前进程的CPU亲和性  printf("Current CPU affinity: ");    for (size_t i = 0; i < CPU_SETSIZE; i++) {  // 遍历CPU_SETSIZE范围内的所有CPU编号  if (CPU_ISSET(i, &get_cpuset)) {  // 检查get_cpuset中对应CPU的位是否被设置  printf("CPU %zu ", i);  // 如果被设置,则打印该CPU编号  }    }    printf("\n");  // 换行  // 假设我们想要清除CPU 1的亲和性设置(仅作为演示,不会实际影响进程)  CPU_CLR(1, &cpuset);  // 修改cpuset变量,清除CPU 1的位  // 注意:这里的CPU_CLR只是修改了cpuset变量,并不会影响已经设置的进程亲和性  // 如果要重新设置进程的CPU亲和性,需要再次调用sched_setaffinity  // (可选)重新打印修改后的cpuset,但请注意它不会反映进程的当前亲和性  printf("Modified cpuset (not applied to process): ");    for (size_t i = 0; i < CPU_SETSIZE; i++) {  // 再次遍历CPU_SETSIZE范围内的所有CPU编号  if (CPU_ISSET(i, &cpuset)) {  // 检查cpuset中对应CPU的位是否被设置  printf("CPU %zu ", i);  // 如果被设置,则打印该CPU编号  }    }    printf("\n");  // 换行  return 0;  // 程序正常结束  
}

程序输出结果:

我们在ubuntu用g++编译并运行,输出三行信息:

1、没有设置CPU亲和性前,当前进程可以在CPU0、CPU1、CPU2、CPU3上运行。

2、将当前进程的亲和性设置为CPU0和CPU1,第二行输出进程可以在CPU0、CPU1上运行。

3、是利用 CPU_CLR修改cpuset变量,清除CPU 1的位,并输出cpuset。(注意,只是改变了变量值,并没有对亲和性进行设置)

 

这篇关于CPU亲和性设置 代码示例 sched_setaffinity sched_getaffinity的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1146416

相关文章

活用c4d官方开发文档查询代码

当你问AI助手比如豆包,如何用python禁止掉xpresso标签时候,它会提示到 这时候要用到两个东西。https://developers.maxon.net/论坛搜索和开发文档 比如这里我就在官方找到正确的id描述 然后我就把参数标签换过来

Android实现任意版本设置默认的锁屏壁纸和桌面壁纸(两张壁纸可不一致)

客户有些需求需要设置默认壁纸和锁屏壁纸  在默认情况下 这两个壁纸是相同的  如果需要默认的锁屏壁纸和桌面壁纸不一样 需要额外修改 Android13实现 替换默认桌面壁纸: 将图片文件替换frameworks/base/core/res/res/drawable-nodpi/default_wallpaper.*  (注意不能是bmp格式) 替换默认锁屏壁纸: 将图片资源放入vendo

poj 1258 Agri-Net(最小生成树模板代码)

感觉用这题来当模板更适合。 题意就是给你邻接矩阵求最小生成树啦。~ prim代码:效率很高。172k...0ms。 #include<stdio.h>#include<algorithm>using namespace std;const int MaxN = 101;const int INF = 0x3f3f3f3f;int g[MaxN][MaxN];int n

计算机毕业设计 大学志愿填报系统 Java+SpringBoot+Vue 前后端分离 文档报告 代码讲解 安装调试

🍊作者:计算机编程-吉哥 🍊简介:专业从事JavaWeb程序开发,微信小程序开发,定制化项目、 源码、代码讲解、文档撰写、ppt制作。做自己喜欢的事,生活就是快乐的。 🍊心愿:点赞 👍 收藏 ⭐评论 📝 🍅 文末获取源码联系 👇🏻 精彩专栏推荐订阅 👇🏻 不然下次找不到哟~Java毕业设计项目~热门选题推荐《1000套》 目录 1.技术选型 2.开发工具 3.功能

代码随想录冲冲冲 Day39 动态规划Part7

198. 打家劫舍 dp数组的意义是在第i位的时候偷的最大钱数是多少 如果nums的size为0 总价值当然就是0 如果nums的size为1 总价值是nums[0] 遍历顺序就是从小到大遍历 之后是递推公式 对于dp[i]的最大价值来说有两种可能 1.偷第i个 那么最大价值就是dp[i-2]+nums[i] 2.不偷第i个 那么价值就是dp[i-1] 之后取这两个的最大值就是d

pip-tools:打造可重复、可控的 Python 开发环境,解决依赖关系,让代码更稳定

在 Python 开发中,管理依赖关系是一项繁琐且容易出错的任务。手动更新依赖版本、处理冲突、确保一致性等等,都可能让开发者感到头疼。而 pip-tools 为开发者提供了一套稳定可靠的解决方案。 什么是 pip-tools? pip-tools 是一组命令行工具,旨在简化 Python 依赖关系的管理,确保项目环境的稳定性和可重复性。它主要包含两个核心工具:pip-compile 和 pip

D4代码AC集

贪心问题解决的步骤: (局部贪心能导致全局贪心)    1.确定贪心策略    2.验证贪心策略是否正确 排队接水 #include<bits/stdc++.h>using namespace std;int main(){int w,n,a[32000];cin>>w>>n;for(int i=1;i<=n;i++){cin>>a[i];}sort(a+1,a+n+1);int i=1

zeroclipboard 粘贴板的应用示例, 兼容 Chrome、IE等多浏览器

zeroclipboard单个复制按钮和多个复制按钮的实现方法 最近网站改版想让复制代码功能在多个浏览器上都可以实现,最近看网上不少说我们的代码复制功能不好用的,我们最近将会增加代码高亮等功能,希望大家多多支持我们 zeroclipboard是一个跨浏览器的库类 它利用 Flash 进行复制,所以只要浏览器装有 Flash 就可以运行,而且比 IE 的

uniapp设置微信小程序的交互反馈

链接:uni.showToast(OBJECT) | uni-app官网 (dcloud.net.cn) 设置操作成功的弹窗: title是我们弹窗提示的文字 showToast是我们在加载的时候进入就会弹出的提示。 2.设置失败的提示窗口和标签 icon:'error'是设置我们失败的logo 设置的文字上限是7个文字,如果需要设置的提示文字过长就需要设置icon并给

html css jquery选项卡 代码练习小项目

在学习 html 和 css jquery 结合使用的时候 做好是能尝试做一些简单的小功能,来提高自己的 逻辑能力,熟悉代码的编写语法 下面分享一段代码 使用html css jquery选项卡 代码练习 <div class="box"><dl class="tab"><dd class="active">手机</dd><dd>家电</dd><dd>服装</dd><dd>数码</dd><dd