Linux 3.x 内核学习笔记——页面的周转

2024-05-07 11:18

本文主要是介绍Linux 3.x 内核学习笔记——页面的周转,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

页面周转

本文以Linux-3.11.0为例。

内核中所有物理内存都有其对应的page结构,这些page在整个系统的运行中,会处于下图的5个状态中。

Freeze Page:并非所有内存都可以用于分配,有些内存被内核所保留使用,例如:内核映像本身所处的内存空间、一些硬件要求需要保留的地址区间、内核中一些固有的数据结构(如page结构本身)等。系统在初始化阶段将这些内存所对应的地址标识为reserve,在初始化完成时,并不会将这些reserve的地址对应的page结构释放入空闲页面管理区。因此这部分page始终处于Freeze Page状态,它们既不会被分配,也不会被释放。

流程1:在初始化完成时,将没有reservepage结构通过__free_pages函数直接释放到空闲页面管理区中(通过free_all_bootmem触发)。这些页面就可以在系统运行过程中被分配、释放。

Hot Cold:为了便于单个页面的快速分配和释放,内核为每个cpu建立了一个冷热队列(Hot Cold List)。

Free Area:每个区间(Zone)对应一组(通常为11个)Free Area队列,每个队列用于管理大小为2^n的连续物理页面。

流程2:释放单个页面时,直接挂入冷热队列(__free_pages -> free_hot_cold_page)。

流程3:释放多个页面(2^n个页面,且n >= 1 )时,挂入对应的Free Area队列(__free_pages -> __free_pages_ok)。同时如果满足页面合并的条件,还会将页面合并后挂入更高阶的Free Area队列。

流程4:页面挂入冷热队列后,如果发现队列中的页面数量超过一定的阀值,则将部分页面移到相应的Free Area队列中(free_pcppages_bulk)。

流程5:分配单个页面时,直接从冷热队列中获取(buffered_rmqueue)。

流程6:分配单个页面时,如果冷热队列中的页面不足,则从Free Area队列中再获取一些(buffered_rmqueue -> rmqueue_bulk)。

流程7:分配多个页面时,从某个ZoneFree Area队列中寻找满足条件的页面进行分配(buffered_rmqueue ->__rmqueue)。

Common Page:普通页面,这类页面使用周转很简单,就是一个简单的分配(流程10)、使用、释放(流程11)的过程。如vmalloc/kmalloc分配的页面属于这一类型。

Lru List:不同于普通页面,有些页面在使用时进行分配(流程8),而在系统内存紧张时将其内容交换到磁盘上,并将其page释放(流程9)以作它用。当需要再次使用这些内容时,再分配新的页面(流程8)并将内容从磁盘上读入。这样的页面包括:映射用户空间的页面、文件的读写缓冲页面等。上图中的Lru List是一个复合状态,其具体流程如下图。

 

Lru队列的页面周转

Linux内核为每个Zone建立了5Lru队列。用做盘区交换的页面,都挂入Active / Inactive Anon队列中;用于文件读写缓冲区的页面,都挂入Active / Inactive File队列中。这4个队列中的页面都是可被换出的,即可回收的(evictable)。与之相对应,还有一个队列是不可回收的(Unevictable),其内的页面不能换出。

需要注意,一个页面从Inactive Anon转到Unevictable队列后,当其再次变为evictable时,还是只能回到Inactive Anon队列,而不会进入Inactive File队列。File队列中的页面也是如此,上图中的状态变迁示意不要引起误解。

下面以盘区交换页面的周转为例,简要介绍一下Lru队列的页面周转流程。

用户空间的页面由缺页异常首次创建时,在do_anonymous_page 中通过page_add_new_anon_rmap将其挂入Active Anon队列。

Linux内核为每个内存节点(node)创建了一个kswapd进程(在kswapd_init中实现),kswapd周期运行,其首先扫描node下的zoneActive Anon队列(shrink_active_list)。

shrink_active_list中将部分处于Active Anon队列中的页面移出,并将其对应的页面映射pte表项的ACCESS标志置0,然后再将其移到Inactive Anon队列中。

此后通过shrink_inactive_lists扫描Inactive Anon队列,并将其中部分页面移出,并尝试进行解除映射,这是在shrink_page_list中通过try_to_unmap进行的。

页面映射pte表项的ACCESS标志是由cpu硬件进行设置的,当cpu通过MMU访问过一个页面时,就会将其对应的pte表项的ACCESS标志置1。而在try_to_unmap的调用过程中,会检测这个标志,如果这个标志为0,就表明距上次置0以后cpu没有访问过这个页面,那么就说明可以将其解除映射,以备换出;如果这个标志为1,则try_to_unmap返回失败,并将该页面放回到Active Anon队列中。

对于成功解除映射的页面,若其内容为dirty,则通过pageout将其内容写到磁盘。

最后将该页面释放。

当该页面对应的地址再次被cpu访问时,由于页面不在内存,缺页异常处理流程会来到do_swap_page中,将新换入的页面挂入Inactive Anon队列(在swapin_readahead ->  read_swap_cache_async -> lru_cache_add_anon 中实现)。这次该页面虽然挂到了Inactive队列,但是由于cpu刚刚访问过相应页面,因此pte表项的ACCESS标志为1,其实是不会立即被换出的。

另外,Linux提供了系统调用mlockmlockall用于将页面固定于内存中,不让其被换出。

当调用mlock / mlockall时,仅仅是将相应的vma->vm_flags加上一个VM_LOCKED标志(mlock_fixup中实现)。当kswapd在扫描某个页面试图将其换出时,如果发现相应的vma->vm_flagsVM_LOCKED标志,则会将其移入Unevictable队列,不让其换出。

当调用munlockmunlockall时,不仅要将相应的vma->vm_flagsVM_LOCKED标志清除,还要将其移入Inactive队列(munlock_vma_pages_range -> munlock_vma_page)。

 


来源:http://blog.csdn.net/liminyu/article/details/12909217

这篇关于Linux 3.x 内核学习笔记——页面的周转的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/967196

相关文章

Linux使用nload监控网络流量的方法

《Linux使用nload监控网络流量的方法》Linux中的nload命令是一个用于实时监控网络流量的工具,它提供了传入和传出流量的可视化表示,帮助用户一目了然地了解网络活动,本文给大家介绍了Linu... 目录简介安装示例用法基础用法指定网络接口限制显示特定流量类型指定刷新率设置流量速率的显示单位监控多个

ElasticSearch+Kibana通过Docker部署到Linux服务器中操作方法

《ElasticSearch+Kibana通过Docker部署到Linux服务器中操作方法》本文介绍了Elasticsearch的基本概念,包括文档和字段、索引和映射,还详细描述了如何通过Docker... 目录1、ElasticSearch概念2、ElasticSearch、Kibana和IK分词器部署

Linux流媒体服务器部署流程

《Linux流媒体服务器部署流程》文章详细介绍了流媒体服务器的部署步骤,包括更新系统、安装依赖组件、编译安装Nginx和RTMP模块、配置Nginx和FFmpeg,以及测试流媒体服务器的搭建... 目录流媒体服务器部署部署安装1.更新系统2.安装依赖组件3.解压4.编译安装(添加RTMP和openssl模块

linux下多个硬盘划分到同一挂载点问题

《linux下多个硬盘划分到同一挂载点问题》在Linux系统中,将多个硬盘划分到同一挂载点需要通过逻辑卷管理(LVM)来实现,首先,需要将物理存储设备(如硬盘分区)创建为物理卷,然后,将这些物理卷组成... 目录linux下多个硬盘划分到同一挂载点需要明确的几个概念硬盘插上默认的是非lvm总结Linux下多

Java深度学习库DJL实现Python的NumPy方式

《Java深度学习库DJL实现Python的NumPy方式》本文介绍了DJL库的背景和基本功能,包括NDArray的创建、数学运算、数据获取和设置等,同时,还展示了如何使用NDArray进行数据预处理... 目录1 NDArray 的背景介绍1.1 架构2 JavaDJL使用2.1 安装DJL2.2 基本操

linux进程D状态的解决思路分享

《linux进程D状态的解决思路分享》在Linux系统中,进程在内核模式下等待I/O完成时会进入不间断睡眠状态(D状态),这种状态下,进程无法通过普通方式被杀死,本文通过实验模拟了这种状态,并分析了如... 目录1. 问题描述2. 问题分析3. 实验模拟3.1 使用losetup创建一个卷作为pv的磁盘3.

Linux环境变量&&进程地址空间详解

《Linux环境变量&&进程地址空间详解》本文介绍了Linux环境变量、命令行参数、进程地址空间以及Linux内核进程调度队列的相关知识,环境变量是系统运行环境的参数,命令行参数用于传递给程序的参数,... 目录一、初步认识环境变量1.1常见的环境变量1.2环境变量的基本概念二、命令行参数2.1通过命令编程

Linux之进程状态&&进程优先级详解

《Linux之进程状态&&进程优先级详解》文章介绍了操作系统中进程的状态,包括运行状态、阻塞状态和挂起状态,并详细解释了Linux下进程的具体状态及其管理,此外,文章还讨论了进程的优先级、查看和修改进... 目录一、操作系统的进程状态1.1运行状态1.2阻塞状态1.3挂起二、linux下具体的状态三、进程的

Linux编译器--gcc/g++使用方式

《Linux编译器--gcc/g++使用方式》文章主要介绍了C/C++程序的编译过程,包括预编译、编译、汇编和链接四个阶段,并详细解释了每个阶段的作用和具体操作,同时,还介绍了调试和发布版本的概念... 目录一、预编译指令1.1预处理功能1.2指令1.3问题扩展二、编译(生成汇编)三、汇编(生成二进制机器语

Rsnapshot怎么用? 基于Rsync的强大Linux备份工具使用指南

《Rsnapshot怎么用?基于Rsync的强大Linux备份工具使用指南》Rsnapshot不仅可以备份本地文件,还能通过SSH备份远程文件,接下来详细介绍如何安装、配置和使用Rsnaps... Rsnapshot 是一款开源的文件系统快照工具。它结合了 Rsync 和 SSH 的能力,可以帮助你在 li