如何在 Linux 中将文件编码转换为 UTF-8_系统运维

unix下转换文件编码的命令叫做iconv

iconv命令用法如下：

iconv

[选项...]

[文件...]

常用参数

-f,

--from-code=原始文本编码

-t,

--to-code=输出编码

-l,

--list

列举所有已知的字符集

-c

从输出中忽略无效的字符

-o,

--output=file

输出文件

举例：

iconv

-c

-f

gb2312

-t

utf-8

-o

utf8.txt

ansi.txt

linux下文件编码格式转换方法（gb18030/utf-8）在 Linux 做开发或者系统管理遇到乱码是经常的事情，主要windows下中文的默认编码是bg2312，而 linux下是utf-8。很多时候涉及到和windows平台系统的通信免不了编码的转化，可能大部分人都用iconv库函数（包含在glib中）和iconv命令来执行编码转换，即： iconv -f gb18030 -t utf-8 file1.txt -o file2.txt 说实话这个命令不好使，一方面容易重复转换，另一方面不支持通配符，无法成批转换，文件少了还好说，要是一大堆文件岂不是要累死？今天我要推荐的是另一个 Shell 下编码转换工具enca。用它不仅可以转换编码，还可以查看文件的原始编码，而且还支持成批转换。使用上也比iconv方便一些。安装enca很简单，一般用源安装就行了，enca用法如下： enca -L 当前语言文件名 enca -L zh_CN file ／／检查文件的编码 enca -L 当前语言 -x 目标编码文件名 enca -L zh_CN -x UTF-8 file ／／将文件编码转换为”UTF-8″编码 enca -L zh_CN -x UTF-8 <file1 >file2 ／／如果不想覆盖原文件可以这样除了有检查文件编码的功能以外，”enca”还有一个好处就是如果文件本来就是你要转换的那种编码，它不会报错，还是会print出结果来，而”iconv”则会报错。这对于脚本编写是比较方便的事情。

字符编码方案有很多种，比如 ASCII、ANCI、Unicode 等等。下面是 ASCII 编码的一个例子。

字符二进制

A 01000001

B 01000010

在 Linux 中，命令行工具 iconv 用来将使用一种编码的文本转化为另一种编码。

你可以使用 file 命令，并添加 -i 或 --mime 参数来查看一个文件的字符编码，这个参数可以让程序像下面的例子一样输出字符串的 mime (Multipurpose Internet Mail Extensions) 数据：

$ file -i Car.java

$ file -i CarDriver.java

欢迎分享，转载请注明来源：内存溢出

原文地址:https://54852.com/yw/8976794.html

如何在 Linux 中将文件编码转换为 UTF-8

发表评论

评论列表（0条）