当前位置:首页 > 实用技巧 >

vfs文件(vfs文件怎么打开)

来源:原点资讯(www.yd166.com)时间:2023-11-28 11:48:44作者:YD166手机阅读>>

概述

本文将介绍一下Linux的VFS虚拟机文件系统,主要介绍该文件系统在Linux中的作用及概要实现。我们知道在Linux系统中一切皆文件,如果说文件系统是Linux系统的基石一点也不过分。在Linux系统中基本上把其中的所有内容都看作文件,除了我们普通意义理解的文件之外,目录、字符设备、块设备、 套接字、进程、线程、管道等都被视为是一个“文件”。例如对于块设备,我们通过fdisk -l显示块设备列表,其实块设备可以理解为在文件夹/dev下面的文件。只不过这些文件是特殊的文件。

root@vmhost:~# ls /dev/ -alh |grep sd brw-rw---- 1 root disk 8, 0 Dec 31 09:38 sda brw-rw---- 1 root disk 8, 16 Dec 31 09:38 sdb brw-rw---- 1 root disk 8, 32 Dec 31 09:38 sdc

如上面代码所示,每个块设备的前面有一个字符串brw-rw----,这个用于描述文件的属性,其中b字符表示这个文件是一个块设备,如果是d字符则表示是一个文件夹。同样,还有其它类型的设备也是一文件的形式进行表示的。那么Linux的文件系统要支持如此之多类型的文件是怎么做到的呢?那就是通过虚拟文件系统(Virtual File System简称VFS)。

vfs文件,vfs文件怎么打开(1)

图1 虚拟文件系统总图

VFS是一个抽象层,其向上提供了统一的文件访问接口,而向下则兼容了各种不同的文件系统。不仅仅是诸如Ext2、Ext4、XFS和Btrfs等常规意义上的文件系统,还包括伪文件系统和设备等等内容。由图1可以看出,虚拟文件系统位于应用与具体文件系统之间,其主要起适配的作用。对于应用程序来说,其访问的接口是完全一致的(例如open、read和write等),并不需要关系底层的文件系统细节。也就是一个应用可以对一个文件进行任何的读写,不用关心文件系统的具体实现。另外,VFS实现了一部分公共的功能,例如页缓存和inode缓存等,从而避免多个文件系统重复实现的问题。

VFS的存在可以让Linux操作系统实现非常复杂的文件系统关联关系。如图2所示,该系统根文件系统是Ext3文件系统,而在其/mnt目录下面又分别挂载了Ext4文件系统和XFS文件系统。最后形成了一个由多个文件系统组成的文件系统树。

vfs文件,vfs文件怎么打开(2)

图2 文件系统目录树

从VFS到具体文件系统

前文我们介绍到VFS是一个抽象层,VFS建立了应用程序与具体文件系统的联系,其提供了统一的访问接口实现对具体文件系统的访问(例如Ext2文件系统)。那么两者是怎么关联起来的呢?这里涉及如下几个处理流程:

  1. 挂载,也就是具体文件系统(例如Ext2)的挂载
  2. 打开文件,我们在访问一个文件之前首先要打开它(open)
  3. 文件访问,进行文件的读写操作(read或者write)

其中第1个流程其实是建立VFS和诸如Ext4文件系统的关联,这样当用户在后面打开某个文件的时候,VFS就知道应该调用那个文件系统的函数实现。而第2个流程则是初始化文件系统必要的数据结构和操作函数(例如read和write等),为后面的具体操作做准备。挂载的流程比较复杂,本文先概括的介绍一下,后续再做详细介绍。

挂载也是用户态发起的命令,就是我们知道的mount命令,该命令执行的时候需要指定文件系统的类型(本文假设Ext2)和文件系统数据的位置(也就是设备)。通过这些关键信息,VFS就可以完成Ext2文件系统的初始化,并将其关联到当前已经存在的文件系统中,也就是建立其图2所示的文件系统树。

本文不介绍代码细节,仅仅从数据结构方面介绍一下Linux文件系统挂载的具体原理。如图3是虚拟文件系统涉及的主要的数据结构。在挂载的过程中,最为重要的数据结构是vfsmount,它代表一个挂载点。其次是dentry和inode,这两个都是对文件的表示,且都会缓存在哈希表中以提高查找的效率。其中inode是对磁盘上文件的唯一表示,其中包含文件的元数据(管理数据)和文件数据等内容,但不含文件名称。而dentry则是为了Linux内核中查找文件方便虚拟出来的一个数据结构,其中包含文件名称、子目录(如果存在的话)和关联的inode等信息。

vfs文件,vfs文件怎么打开(3)

图3 文件系统核心数据结构

这里面dentry结构体最为关键,其维护了内核中的文件目录树。其中里面比较重要的几个结构体分别是d_name、d_hash和d_subdirs。其中d_name代表一个路径节点的名称(文件夹名称)、d_hash则用于构建哈希表,d_subdirs则是下级目录(或文件)的列表。这样,通过dentry就可以形成一个非常复杂的目录树。

vfs文件,vfs文件怎么打开(4)

图4 dentry数据结构

其中inode是文件的唯一表示,其中除了包含元数据和数据的索引之外,还包含关键操作的函数指针。比如对于文件读写和属性更改等操作接口都存在该结构体中,具体如图3所示。这里面主要涉及3个结构体,分别是address_space、inode_operations和file_operations,其中每一个结构体中都包含很多函数指针。

回到正题,所谓文件系统的挂载过程,其实就是构建上述几个结构体的过程,特别是inode结构体的初始化。以Ext4为例,在挂载的时候就会将其中的address_space、inode_operations和file_operations函数指针初始化为Ext4文件系统的函数。因此当对文件进行访问的时候,只要找到这个inode,就能知道是什么类型的文件系统。

处理流程示例

我们都知道,在用户态打开一个文件是返回的是一个文件描述符,其实也就是一个整数值。同时,访问文件也是通过这个文件描述符进行的,如下面代码所示的函数原型。那么操作系统是怎么通过这个整数值实现不同类型文件系统的访问呢?前文我们知道不同文件系统的差异其实就是inode中初始化的函数指针的差异,因此问题的关键是这个文件描述符和inode是怎么关联起来的。

int fd = open(const char *pathname,int flags,mode_t mode); ssize_t read(int fd, void * buf, size_t count);

在Linux操作系统中,文件的打开必须要与进程(或者线程)关联,也就是说一个打开的文件必须隶属于某个进程。在linux内核当中一个进程通过task_struct结构体描述,而打开的文件则用file结构体描述,打开文件的过程也就是对file结构体的初始化的过程。在打开文件的过程中会将inode部分关键信息填充到file中,特别是文件操作的函数指针。在task_struct中保存着一个file类型的数组,而用户态的文件描述符其实就是数组的下标。这样通过文件描述符就可以很容易到找到file,然后通过其中的函数指针访问数据。

vfs文件,vfs文件怎么打开(5)

图5 进程与文件

例如我们以Ext2文件系统的写数据为例,在调用用户态的写数据接口的时候,需要传入文件描述符。内核根据文件描述符找到file,然后调用函数接口(file->f_op->write)文件磁盘数据。其中file结构体的f_op指针就是在打开文件的时候通过inode初始化的。

vfs文件,vfs文件怎么打开(6)

图6 Ext2写数据流程

本文先简要介绍一下VFS的原理及如何与具体文件系统的关系。后续文章再逐个部件进行深入的剖析。

栏目热文

hdfs如何在文件中添加内容(hdfs创建文件并写入内容)

hdfs如何在文件中添加内容(hdfs创建文件并写入内容)

HDFS是基于Java的文件系统,可在Hadoop生态系统中提供可扩展且可靠的数据存储。因此,我们需要了解基本的HDFS...

2023-11-28 11:27:18查看全文 >>

过大的vfs文件会导致无法使用吗(vfs文件删除影响软件使用吗)

过大的vfs文件会导致无法使用吗(vfs文件删除影响软件使用吗)

一.VFS(虚拟文件系统)和Ext2关系:VFS是Linux中的一个虚拟文件文件系统,它为应用程序员提供一层抽象,屏蔽底...

2023-11-28 11:22:37查看全文 >>

vfs文件不存在(vfs文件是什么 求答案)

vfs文件不存在(vfs文件是什么 求答案)

前言为什么 Linux 内核的文件系统类型那么多,都能挂载上呢?为什么系统里可以直接 mount 其他文件系统呢?甚至能...

2023-11-28 11:19:23查看全文 >>

hdfs小文件的处理(hdfs的文件写入步骤)

hdfs小文件的处理(hdfs的文件写入步骤)

一、背景每个文件均按块存储,每个块的元数据存储在NameNode的内存中,因此hdfs存储小文件会非常低效。因为大量的小...

2023-11-28 11:25:24查看全文 >>

hdfs 文件分割不完整(hdfs小文件处理方法)

hdfs 文件分割不完整(hdfs小文件处理方法)

阅读此文前,麻烦您点击一下“关注”,既方便您进行讨论与分享,又给您带来不一样的参与感,感谢您的支持。求关注一、HDFS读...

2023-11-28 11:51:52查看全文 >>

hdfs 文件合并(hdfs小文件处理方法)

hdfs 文件合并(hdfs小文件处理方法)

HDFS作为Hadoop大数据处理框架下的分布式文件系统,深受开发人员的喜爱,为此许多人想在自己的linux单机上搭建出...

2023-11-28 11:18:45查看全文 >>

格式化hdfs找不到命令(hdfs重新格式化要怎么做)

格式化hdfs找不到命令(hdfs重新格式化要怎么做)

经过了前几期的介绍hadoop网络交互这块就告一段落了。接下来我们要入坑聊聊hdfs文件系统了。内容应该是越来越精彩了。...

2023-11-28 11:31:30查看全文 >>

应用文具有直接的什么价值(应用文具备什么特点)

应用文具有直接的什么价值(应用文具备什么特点)

应用文是人们在日常工作、学习、生产、生活、交流信息、处理事情、解决问题时而经常使用的,并且有一定惯用格式的实用文体。它具...

2023-11-28 11:40:56查看全文 >>

哪些应用文具有法规性(应用文具有直接的功能性吗)

哪些应用文具有法规性(应用文具有直接的功能性吗)

应用文写作能力已经越来越成为人才素质的一个重要的衡量指标。试想,领导交办“写个东西”交给我,结果交上来的东西杂乱无章、拖...

2023-11-28 11:15:56查看全文 >>

公文具有哪些作用(公文具有哪些特点作用)

公文具有哪些作用(公文具有哪些特点作用)

(一)领导和指导作用 公文的内容反映机关或部门工作的意图,所以具有领导和指导工作的作用,在传达贯彻党和国家的方针政策、...

2023-11-28 11:50:16查看全文 >>

文档排行