Linux系统下切割文件的split命令用法教程

   你曾经是否想要把一个大文件分割成多个小文件?比如一个5gb日志文件,我们需要把它分成多个小文件,这样我们才有可能使用普通的文本编辑器读取它。有时我们需要传输20gb的大文件到另一台服务器,这就需要我们把它分割成多个文件,这样便于传输数据。下面我们来讲解使用split命令来切割文件的方法。

  代码如下:

  [root@localhost database]# ls -lh gkdb.db

  -r--r--r-- 1 root root 411M Jul 23 17:20 gkdb.db

  将将这个276M文件分割成20M的小文件,文件分割操作如下:

  代码如下:

  [root@localhost database]# split -b 20m gkdb.db gkdb_pack_

  split 是命今。

  -B 20M 是指将每个分卷文件最大20M 。

  gkdb.db 需要分割的文件。

  gkdb_pack_ 是指分割后的文件开头, 分割后后的文件名一般为 gkdb_pack_aa、gkdb_pack_ab、gkdb_pack_ac依次类推。

  显示分割后的文件名及大小

  代码如下:

  [root@localhost database]# ll -lh gkdb_pack_a*

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_aa

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_ab

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_ac

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_ad

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_ae

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_af

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_ag

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_ah

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_ai

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_aj

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_ak

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_al

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_am

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_an

  -rw-r--r-- 1 root root 20M Jul 27 16:09 gkdb_pack_ao

  -rw-r--r-- 1 root root 20M Jul 27 16:10 gkdb_pack_ap

  -rw-r--r-- 1 root root 20M Jul 27 16:10 gkdb_pack_aq

  -rw-r--r-- 1 root root 20M Jul 27 16:10 gkdb_pack_ar

  -rw-r--r-- 1 root root 20M Jul 27 16:10 gkdb_pack_as

  -rw-r--r-- 1 root root 20M Jul 27 16:10 gkdb_pack_at

  -rw-r--r-- 1 root root 11M Jul 27 16:10 gkdb_pack_au

  最下面的那个文件是剩余的文件。 20*20+11=411MB

  合并文件

  代码如下:

  [root@localhost database]# cat gkdb_pack_*>gkdb.tar.gz

  组装前和组装后的MD5值都是一样的,不信的话可以使用md5sum命令来检测一下。

  如果要分割的是一个文本文件,比如有好几千行,当然每行的字符数是不等的,想要以行数为分割,比如每100行生成1个文件,只需要 -l 参数,如下:

  代码如下:

  [root@pps public_rw]# split -l 100 test.txt

  其实,如果不加任何参数,默认情况下是以1000行大小来分割的。

  实例1、以每个文件1000行分割

  split命令分割文件成每个文件1000行,并且文件名依次为 [前缀]aa, [前缀]ab, [前缀]ac等,默认的前缀是X,每个文件的行数为1000行,命令如下:

  代码如下:

  $ split mylog

  $ wc -l *

  4450 mylog

  1000 xaa

  1000 xab

  1000 xac

  1000 xad

  450 xae

  实例2、以每个文件20MB分割

  分割文件为多个20MB的文件,附带-b选项命令如下:

  代码如下:

  $ split -b 20M logdata

  $ ls -lh | tail -n +2

  -rw------- 1 sathiya sathiya 102M Jul 25 18:47 logdata

  -rw------- 1 sathiya sathiya 20M Jul 25 19:20 xaa

  -rw------- 1 sathiya sathiya 20M Jul 25 19:20 xab

  -rw------- 1 sathiya sathiya 20M Jul 25 19:20 xac

  -rw------- 1 sathiya sathiya 20M Jul 25 19:20 xad

  -rw------- 1 sathiya sathiya 20M Jul 25 19:20 xae

  -rw------- 1 sathiya sathiya 1.6M Jul 25 19:20 xaf

  实例3、以每个文件50MB指定前缀分割

  使用–bytes选项把文件分割成多个50MB的文件,–bytes类似-b选项,在第二个参数指定前缀。

  代码如下:

  $ split --bytes=50M logdata mydatafile

  $ ls -lh

  total 204M

  -rw------- 1 sathiya sathiya 102M Jul 25 18:47 logdata

  -rw------- 1 sathiya sathiya 50M Jul 25 19:23 mydatafileaa

  -rw------- 1 sathiya sathiya 50M Jul 25 19:23 mydatafileab

  -rw------- 1 sathiya sathiya 1.6M Jul 25 19:23 mydatafileac

  实例4、基于行数分割文件

  使用-l选项指定行数来把文件分割成多个行数相同的文件。

  代码如下:

  $ wc -l testfile

  2591 testfile

  $ split -l 1500 testfile importantlog

  $ wc -l *

  1500 importantlogaa

  1091 importantlogab

  2591 testfile

  实例5、以数字后缀命名分割文件

  使用-d选项可以指定后缀为数字,如00,01,02..,而不是aa,ab,ac。

  代码如下:

  $ split -d testfile

  $ ls

  testfile x00 x01 x02

时间: 2024-07-30 19:44:57

Linux系统下切割文件的split命令用法教程的相关文章

Linux系统下切割文件的split命令用法

  你曾经是否想要把一个大文件分割成多个小文件?比如一个5gb日志文件,我们需要把它分成多个小文件,这样我们才有可能使用普通的文本编辑器读取它.有时我们需要传输20gb的大文件到另一台服务器,这就需要我们把它分割成多个文件,这样便于传输数据.下面我们来讲解使用split命令来切割文件的方法. 复制代码 代码如下: [root@localhost database]# ls -lh gkdb.db -r--r--r-- 1 root root 411M Jul 23 17:20 gkdb.db 将

linux系统下hosts文件详解及配置_linux shell

hosts文件 hosts -- the static table lookup for host name(主机名查询静态表). hosts文件是Linux系统上一个负责ip地址与域名快速解析的文件,以ascii格式保存在/etc/目录下.hosts文件包含了ip地址与主机名之间的映射,还包括主机的别名.在没有域名解析服务器的情况下,系统上的所有网络程序都通过查询该文件来解析对应于某个主机名的ip地址,否则就需要使用dns服务程序来解决.通过可以将常用的域名和ip地址映射加入到hosts文件中

Linux系统下的文件传输工具:RZSZ的用法

Linux系统下传输方式很多,比如:通过FTP SFTP - 等等.linux服务器大多是通过ssh客户端来进行远程的登陆和管理的,使用ssh登陆linux主机以后,如何能够快速的和本地机器进行文件的交互呢,也就是上传和下载文件到服务器和本地,根据RZSZ特性,这里我们通过SecureCRT提供ZModem配合RZSZ传输工具进行讲解 首先先了解与ssh有关的两个命令可以提供很方便的操作: sz:将选定的文件发送(send)到本地机器 rz:运行该命令会弹出一个文件选择窗口,从本地选择文件上传到

Linux系统下iso文件的制作和解压以及加载

  linux下iso文件的制做和解压 1. 制作ISO镜像文件 切换为root账户,执行命令 代码如下: cp /dev/cdrom XXXXX.iso XXXXX.iso即为需要命名的ISO文件名.执行之后,光盘上所有文件就被映射成XXXXX.iso 2. 加载ISO文件 在root账户下执行命令 代码如下: rm -rf /dev/cdrom ln -s /dev/loop7 /dev/cdrom losetup /dev/loop7 /PATH(iso文件路径) mount /mnt/c

Linux系统中下载文件的wget命令行工具

简介 Linux系统中的wget是一个下载文件的命令行工具. 对于Linux用户是必不可少的工具,对于经常要下载一些软件或从远程服务器恢复备份到本地服务器,这个命令尤为重要.wget支持HTTP,HTTPS和FTP协议,可以使用HTTP代理. 自动下载 wget支持自动下载,即wget可以在用户退出系统的之后在后台执行.这意味这你可以登录系统,启动一个wget下载任务,然后退出系统,wget将在后台执行直到任务完成,这是个牛气冲天的功能. 完全重建 wget 可以跟踪HTML页面上的链接依次下载

在Linux系统下安装Terminator来增强命令行终端

Terminator,它可以在一个窗口内打开多个终端.该项目的目标之一是为摆放终端提供一个有用的工具.它的灵感来自于类似gnome-multi-term,quankonsole等程序,这些程序关注于按网格摆放终端.Terminator  0.98带来了更完美的标签功能,更好的布局保存/恢复,改进了偏好用户界面和多处 bug 修复. TERMINATOR 0.98 的更改和新特性 * 添加了一个布局启动器,允许在不用布局之间简单切换(用 Alt + L 打开一个新的布局切换器):* 添加了一个新的

linux系统下ubuntu重启apache服务命令

Linux系统为Ubuntu 一.Start Apache 2 Server /启动apache服务 # /etc/init.d/apache2 start or $ sudo /etc/init.d/apache2 start 二. Restart Apache 2 Server /重启apache服务 # /etc/init.d/apache2 restart or $ sudo /etc/init.d/apache2 restart 三.Stop Apache 2 Server /停止ap

Linux系统下转换文件编码的方法小结

  一.利用iconv命令进行文件内容编码转换 用法: iconv [选项...] [文件...] 有如下选项可用: 输入/输出格式规范: -f, --from-code=名称 原始文本编码 -t, --to-code=名称 输出编码 信息: -l, --list 列举所有已知的字符集 输出控制: -c 从输出中忽略无效的字符 -o, --output=FILE 输出文件 -s, --silent 关闭警告 --verbose 打印进度信息 -?, --help 给出该系统求助列表 --usag

Linux系统下基本的帮助查询命令小结

  命令名 –help | more 显示一个简略的命令帮助(对大部分命令有效).举个例子,试着使用 "cp –help | more"."--help"和和DOS下的"/h"开关功能类似.当输出超过一个屏幕时,加上"more"是很有必要的. man 命令 显示对应命令系统的帮助手册.输入"q"退出浏览器.如果你设置了高级选项,试着输入"man man".命令"info 命令名