利用Node.js如何实现文件循环覆写

2023-03-13 原文

前言

这次编写Node.js项目的时候用到了日志模块，其中碰到了一个小问题。

这是一个定时执行可配置自动化任务的项目，所以输出信息会不断增加，也就意味着日志文件会随时间不断增大。如果对日志文件大小不加以控制，那么服务器的磁盘迟早会被撑满。所以限制文件大小是有必要的。

最理想的控制方式就是当文件大小超过限制时，清除最先记录的数据。类似一个FIFO的队列。

# 删除前面的数据
- 1 xxx
 ......
 100 abc
# 文件末尾追加数据
  101 xxxx

log4js的file rolling

一提到记录日志很多Node.js开发者肯定会找到log4js，先来看看log4js是怎么处理这个问题的。

log4js分为很多appenders（可以理解为记录日志的媒介），file rolling功能可以通过函数来进行配置。

file rolling功能有两种方式：日期和文件大小。

要控制文件大小，当然选择后者。

为了测试这个功能是否满足我们要求，写一段循环代码来写日志。

const log4js = require('log4js')
// 配置log4js
log4js.configure({
 appenders: {
 everything: {
 type: 'file',
 filename: 'a.log',
 maxLogSize: 1000,
 backups: 0
 },
 },
 categories: {
 default: {
 appenders: ['everything'],
 level: 'debug'
 }
 }
});
const log = log4js.getLogger();
for (let i = 0; i < 41; i  ) {
 const str = i.toString().padStart(6, '000000');
 log.debug(str);
}

执行之后生成两个文件a.log和a.log.1。

其中a.log.1有20行数据，实际大小1kb，a.log只有1行数据。

虽然确实控制了文件大小，但是会带来两个问题：

额外产生一个备份文件，总占用磁盘空间会超过文件限制。
日志文件内容的大小是变动的，查询日志的时候很可能需要联合备份文件进行查询（比如上面的情况日志文件只有1行数据）。

推测log4js的实现逻辑可能是下面这样：

检查日志文件是否达到限制大小，如果达到则删除备份文件，否则继续写入日志文件。
重命名日志文件为备份文件。

这显然不能完全满足需求。

字符串替换？

如果要在内存中完成循环覆写操作就比较简单了，使用字符串或Buffer的即可完成。

添加字符串/Buffer长度，如果超过大小则截取。
写入并覆盖日志文件。

但是有一个很大的问题：占用内存。

比如限制文件大小为1GB，有10个日志文件同时写入，那么至少占用10GB内存空间！

内存可是比磁盘空间更宝贵的，如此明显的性能问题，显然也不是最优解决方式。

file roll

按照需求可以把实现步骤拆成两步：

追加最新的数据到文件末尾。（Node.js的fs模块有相应函数）
删除文件开头超出限制部分。（Node.js没有响应函数）

这两步不分先后顺序，但是Node.js没有提供API来删除文件开头部分，只提供了修改文件指定位置的函数。

既然无法删除文件开头部分内容，那么我们就换个思路，只保留文件末尾部分内容（不超出大小限制）。

什么？这不是一个意思么？

略有区别~

删除是在原有文件上进行的操作，而保留内容可以借助临时文件来进行操作。

所以思路变成：

创建一个临时文件，临时文件的内容来自于日志文件。
往临时文件中增加数据。
将临时文件中符合文件大小限制的内容，从后往前（采取偏移量的形式）进行读取并复制到日志文件进行覆盖。
为了不占用额外的磁盘空间，写操作完成后删除临时文件。

这样就不会出现像log4js一样日志文件内容不全的现象，也不会保留额外的临时文件。但是对IO的操作会增加~
对于写操作可以采取tail命令来实现，最终实现代码如下：

private write(name: string, buf?: Buffer | string) {
 // append buf to tmp file
 const tmpName = name.replace(/(.*\/)(.*$)/, '$1_\.$2\.tmp');
 if (!existsSync(tmpName)) {
 copyFileSync(name, tmpName);
 }
 buf && appendFileSync(tmpName, buf);
 // if busy, wait
 if (this.stream && this.stream.readable) {
 this.needUpdateLogFile[name] = true;
 } else {
 try {
  execSync(`tail -c ${limit} ${tmpName} > ${name}`);
  try {
  if (this.needUpdateLogFile[name]) {
   this.needUpdateLogFile[name] = false;
   this.write(name);
  } else {
   existsSync(tmpName) && unlinkSync(tmpName);
  }
  } catch (e) {
  console.error(e);
  }
 } catch (e) {
  console.error(e);
 }
 }
}

总结

完成这个功能有两点感悟：

量变引起质变。当数据量变大时，很多简单的处理方式就不可以用了，比如写文件，如果直接使用writeFile会占用大量内存甚至有可能内存都不够用。所以要通过合适的方式进行拆分，拆分过程中又会碰到各种问题，比如本文中截取文件内容的要求。
学会借力。君子性非异也善假于物也~当无法在单个点完成操作的时候可以借助外部条件来实现，比如在本文中使用临时文件来保存数据内容。

好了，以上就是这篇文章的全部内容了，希望本文的内容对大家的学习或者工作具有一定的参考学习价值，谢谢大家对Devmax的支持。

利用Node.js如何实现文件循环覆写的更多相关文章

jQuery使用each遍历循环的方法

这篇文章主要介绍了jq 用each遍历循环的方法，本文通过实例代码给大家介绍的非常详细，具有一定的参考借鉴价值,需要的朋友可以参考下
CentOS 8.2服务器上安装最新版Node.js的方法

这篇文章主要介绍了CentOS 8.2服务器上安装最新版Node.js的方法，本文给大家介绍的非常详细，对大家的学习或工作具有一定的参考借鉴价值,需要的朋友可以参考下
node.js三个步骤实现一个服务器及Express包使用

这篇文章主要介绍了node.js三个步骤实现一个服务器及Express包使用，文章通过新建一个文件展开全文内容，具有一定的参考价值，需要的小伙伴可以参考一下
Node.js调试技术总结分享

Node.js是一个可以快速构建网络服务及应用的平台。该平台的构建是基于Chrome's JavaScript runtime，也就是说，实际上它是对Google V8引擎（应用于Google Chrome浏览器)进行了封装。今天介绍Node.js调式目前有几种技术，需要的朋友可以参考下。
node.js实现http服务器与浏览器之间的内容缓存操作示例

这篇文章主要介绍了node.js实现http服务器与浏览器之间的内容缓存操作,结合实例形式分析了node.js http服务器与浏览器之间的内容缓存原理与具体实现技巧,需要的朋友可以参考下
教你如何使用node.js制作代理服务器

本文介绍了如何使用node.js制作代理服务器，图文并茂，十分的详细，代码很简洁易懂，这里推荐给大家。
JQuery在循环中绑定事件的问题详解

下面小编就为大家带来一篇JQuery在循环中绑定事件的问题详解。小编觉得挺不错的，现在就分享给大家，也给大家做个参考。一起跟随小编过来看看吧
node.js中的fs.openSync方法使用说明

这篇文章主要介绍了node.js中的fs.openSync方法使用说明,本文介绍了fs.openSync方法说明、语法、接收参数、使用实例和实现源码,需要的朋友可以参考下
Node.js+ELK日志规范的实现

这篇文章主要介绍了Node.js+ELK日志规范的实现，小编觉得挺不错的，现在分享给大家，也给大家做个参考。一起跟随小编过来看看吧
node.js爬虫框架node-crawler初体验

这篇文章主要介绍了node.js爬虫框架node-crawler的相关资料，帮助大家利用node.js进行爬虫，感兴趣的朋友可以了解下

随机推荐

Error: Cannot find module ‘node:util‘问题解决

控制台安装 Vue-Cli 最后一步出现 Error: Cannot find module 'node:util' 问题解决方案1.问题C:\Windows\System32>cnpm install -g @vue/cli@4.0.3internal/modules/cjs/loader.js:638 throw err; &nbs
yarn的安装和使用(全网最详细)

一、yarn的简介：Yarn是facebook发布的一款取代npm的包管理工具。二、yarn的特点：速度超快。Yarn 缓存了每个下载过的包，所以再次使用时无需重复下载。同时利用并行下载以最大化资源利用率，因此安装速度更快。超级安全。在执行代码之前，Yarn 会通过算法校验每个安装包的完整性。超级可靠。使用详细、简洁的锁文件格式和明确的安装算法，Yarn 能够保证在不同系统上无差异的工作。三、y
前端环境本机可切换node多版本问题源头是node使用的高版本

前言投降投降重头再来重装环境也就分分钟的事偏要折腾这下好了1天了还没折腾出来问题的源头是node 使用的高版本方案那就用本机可切换多版本最终问题是因为nodejs的版本太高，导致的node-sass不兼容问题，我的node是v16.14.0的版本，项目中用了"node-sass": "^4.7.2"版本，无法匹配当前的node版本根据文章的提
nodejs模块学习之connect解析

这篇文章主要介绍了nodejs模块学习之connect解析,小编觉得挺不错的，现在分享给大家，也给大家做个参考。一起跟随小编过来看看吧
nodejs npm package.json中文文档

这篇文章主要介绍了nodejs npm package.json中文文档,本文档中描述的很多行为都受npm-config(7)的影响,需要的朋友可以参考下
详解koa2学习中使用 async 、await、promise解决异步的问题

这篇文章主要介绍了详解koa2学习中使用 async 、await、promise解决异步的问题，小编觉得挺不错的，现在分享给大家，也给大家做个参考。一起跟随小编过来看看吧
Node.js编写爬虫的基本思路及抓取百度图片的实例分享

这篇文章主要介绍了Node.js编写爬虫的基本思路及抓取百度图片的实例分享,其中作者提到了需要特别注意GBK转码的转码问题,需要的朋友可以参考下
CentOS 8.2服务器上安装最新版Node.js的方法

这篇文章主要介绍了CentOS 8.2服务器上安装最新版Node.js的方法，本文给大家介绍的非常详细，对大家的学习或工作具有一定的参考借鉴价值,需要的朋友可以参考下
node.js三个步骤实现一个服务器及Express包使用

这篇文章主要介绍了node.js三个步骤实现一个服务器及Express包使用，文章通过新建一个文件展开全文内容，具有一定的参考价值，需要的小伙伴可以参考一下
node下使用UglifyJS压缩合并JS文件的方法

下面小编就为大家分享一篇node下使用UglifyJS压缩合并JS文件的方法，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧