设置linux编码 vim设置编码格式
大家好,今天来为大家分享设置linux编码的一些知识点,和vim设置编码格式的问题解析,大家要是都明白,那么可以忽略,如果不太清楚的话可以看看本篇文章,相信很大概率可以解决您的问题,接下来我们就一起来看看吧!
linux编码设置为gb2312linux编码设置
Linux系统的默认编码怎样设置?
查看默认编码:$:env|grepLANGLANG=en_US.UTF-8GDM_LANG=en_USLANGUAGE=en_US修改编码(加到/etc/profile中就能永久生效):exportLANG=xxx
linux下用什么函数判断字符串的编码方式?
如题,假设给你一个字符数组 chara="abc";在它的编码中gb2312和utf-8都一样对任意一个字符而言,并没有编码格式的概念。同样的一个字母,在不同编码集里面代表不同的东西,当然也有可能恰好代表相同的东西。编码集并不是文本本身的属性,而是观察者的角度,也就是说你用什么编码集来观察这段文本。——从程序的角度就是,你用什么软件去打开它。——编码识别大多通过非法字符进行识别,也就是说仅仅当我们判断具有非法的utf-8字符序列的时候,我们判断一个文本“不是utf-8”编码,但是我们永远无法判断一个文本“是utf-8编码”。——如果不包含任何非法字符,那么你就可以用任何编码去查看他:例如“逍遥”如果使用BIG5码,但你还是可以使用GBK码查看这两个字,最后得到的是“殊换”。显然这两个词都是合法的,如果仅仅给你这个词,那么你无论从理论还是实际上都不可能知道原文的作者究竟是想表达“逍遥”还是“殊换“。
如何在linux下查看文件编码以及修改编码?
你首先要知道file是通过什么判断的,不要纠结binary,你看前面empty,你再在你的file1里面写一个a,再file一下,再在file里面写一个汉字,再file一下。
linux查看日志文件编码格式?
编码格式一般是utf8或者gb123
linux主分区/扩展分区编号范围?
区别在于是层级关系:在linux中第一块硬盘分区为hda分区,主分区编号为hda1-4,逻辑分区从5开始。
硬盘的容量=主分区的容量+扩展分区的容量扩展分区的容量=各个逻辑分区的容量之和主分区也可成为“引导分区”,会被操作系统和主板认定为这个硬盘的第一个分区。所以C盘永远都是排在所有磁盘分区的第一的位置上。MBR(主引导记录)的分区表(主分区表)只能存放4个分区,如果要分更多的分区的话就要一个扩展分区表(EBR),扩展分区表放在一个系统ID为0x05的主分区上,这个主分区就是扩展分区,扩展分区能可以分若干个分区,每个分区都是个逻辑分区。
linux怎么设置编码格式linux编码格式设置
linux怎么看文本的编码格式?
linux下经常遇到的编码问题如果你需要在linux中操作windows下的文件,那么你可能会经常遇到文件编码转换的问题。windows中默认的文件格式是gbk(gb2312),而linux一般都是utf-8。
查看编码的方法
方法一:filefilename
方法二:在vim中可以直接查看文件编码
:setfileencoding
如果你只是想查看其它编码格式的文件或者想解决用vim查看文件乱码的问题,那么你可以在
~/.vimrc文件中添加以下内容:
setencoding=utf-8fileencodings=ucs-bom,utf-8,cp936
这样,就可以让vim自动识别文件编码(可以自动识别utf-8或者gbk编码的文件),其实就是依照fileencodings提供的编码列表尝试,如果没有找到合适的编码,就用latin-1(ascii)编码打开
文件编码转换
多平台方法:
iconv提供标准的程序和api来进行编码转换;
convert_encoding.py基于python的文本文件转换工具;
decodeh.py提供算法和模块来谈测字符的编码;
linux下文件编码转换:
方法一:
在vim中直接进行转换文件编码,比如将一个文件转换成utf-8格式
:setfileencoding=utf-8
或者
11)设置文件集合,即要对哪些文件进行操作,可以使用通配符,比如我通常是对c/c++源程序进行编码转换
:args*.h*.cpp
2)给出要在每个文件上执行的命令,这里是转换编码:
:argdosetfenc=utf-8|update
方法二:
iconv转换
5.案例:
假如说我们将windows下的一个utf-8的文件传到linux环境下,linux环境下的系统编码是gb18030,我们cat的时候就会出现乱码,这个时候就应该想到转码了,下面我们来进行试验:
我们将windows下一个名为utf-8.sh的文件传到linux系统中,其中utf-8.sh的内容如下:
我是中文编码utf-8模式~
而linux系统的系统语言设置为:
#cat/etc/sysconfig/i18n
lang=zh_cn.gb18030
sysfont="latarcyrheb-sun16"
这个时候查看一下文件的内容及编码:
#fileutf-8.sh
utf-8.sh:utf-8unicodetext,withnolineterminators
#catutf-8.sh
锘挎__?腑___镰_tf-8妯″纺~#
#
这个时候我们就需要转换编码了,记得使用iconv
#iconv-futf-8-tgb18030utf-8.sh-ogb18030.sh
#catgb18030.sh
??我是中文编码utf-8模式~#
#filegb18030.sh
gb18030.sh:non-isoextended-asciitext,withnolineterminators
#
convmv就是更改文件名编码方式的一个工具。
比如
sudoconvmv-fgbk-tutf-8-r_notest/home
就是将/home目录下原来文件名是gbk编码方式的全部改为utf-8格式的。这里-f后面为原来的编码方式,-t后面是要更改为的编码方式,-r表示这个目录下面的所有文件,_notest表示马上执行,而不是仅仅测试而已。另外这命令好像要root才能执行,因此要加上sudo。
linux下怎么改变文件的编码格式?
1、用VIM查看文件编码
在Vim中可以直接查看文件编码
:setfileencoding
即可显示文件编码格式。
2、改写~/.vimrc文件
如果你只是想查看其它编码格式的文件或者想解决用Vim查看文件乱码的问题,那么你可以在
~/.vimrc文件中添加以下内容:
setencoding=utf-8fileencodings=ucs-bom,utf-8,cp936
这样,就可以让vim自动识别文件编码(可以自动识别UTF-8或者GBK编码的文件),其实就是依照fileencodings提供的编码列表尝试,如果没有找到合适的编码,就用latin-1(ASCII)编码打开。
3、用ICONV文件编码转换
我们利用iconv工具对文件的编码进行转换。
iconv转换,iconv的命令格式如下:
iconv-fencoding-tencodinginputfile
比如将一个GBK编码的文件转换成UTF-8编码
iconv-fGBK-tUTF-8file1-ofile2
其中的参数的意义表示
-fFrom某个编码
-tTo某个编码
-o输出到文件
4、通过记事本另存为来改变文件编码;
既用Windows下的记事本打开,选择另存为,改变编码即可。
linux下怎么查看文件的编码方式?
一,查看文件编码:在Linux中查看文件编码可以通过以下几种方式:
1.在Vim中可以直接查看文件编码:setfileencoding即可显示文件编码格式。如果你只是想查看其它编码格式的文件或者想解决用Vim查看文件乱码的问题,那么你可以在~/.vimrc文件中添加以下内容:setencoding=utf-8fileencodings=ucs-bom,utf-8,cp936这样,就可以让vim自动识别文件编码(可以自动识别UTF-8或者GBK编码的文件),其实就是依照fileencodings提供的编码列表尝试,如果没有找到合适的编码,就用latin-1(ASCII)编码打开。
2.enca(如果你的系统中没有安装这个命令,可以用sudoyuminstall-yenca安装)查看文件编码$encafilenamefilename:Universaltransformationformat8bits;UTF-8CRLFlineterminators需要说明一点的是,enca对某些GBK编码的文件识别的不是很好,识别时会出现:Unrecognizedencoding
linux系统文件格式后缀详解?
bz2------bzip2的压缩文件
.gz------gzip的压缩文件
.tar------tar打包文件(是包文件不是压缩文件)
.tbz------tar打包并用bzip压缩文件
.tgz-----tar打包并用gzip压缩的文件
.au-----audio文件
.gif-----gif图象文件
.html/.htm-----HTML文件
.jpg-----JPEG图象文件
.pdf------电子文档(PDF格式的)
.png-----PNG图象文件
.ps------postscinpt文件(打印格式文件)
.txt------纯文本文件
.wav-----audio文件
.xpm-----图象文件
.conf-------配置文件
.lock-------LOCK文件(用来判断一个文件或设备是否被使用)
.rpm------REDHATPackage.Manager文件(套件包或软件包)
.c-------C源程序代码文件
.cpp------C++源程序代码文件
.h-------C或C++程序的头文件
.o------程序目标文件
.pl------perl脚本文件
.so-----类库文件
.sh-----shell脚本与windows下的bat文件相似
.bin-----binary二进制可执行文件
linux下怎么改变文件的编码格式
在Linux系统中,查看文件编码格式可以通过Vim编辑器实现,只需输入命令:set fileencoding即可查看当前文件的编码格式。若遇到乱码问题,可以调整Vim的配置文件~/.vimrc,添加如下设置:set encoding=utf-8 fileencodings=ucs-bom,utf-8,cp936。这样设置后,Vim能够自动识别文件编码,尝试从提供的编码列表中选择合适的编码格式,如果没有匹配,则使用latin-1(ASCII)编码打开文件。
对于需要转换文件编码的情况,可以使用iconv工具来处理。iconv是一个强大的文件编码转换工具,其命令格式如下:iconv-f from-encoding-t to-encoding inputfile。例如,若要将一个GBK编码的文件转换为UTF-8编码,可以使用命令:iconv-f GBK-t UTF-8 file1-o file2。这里的参数含义分别为:-f指定输入文件的编码格式,-t指定输出文件的编码格式,-o指定输出文件的保存路径。
除了使用命令行工具,还可以利用Windows系统自带的记事本程序来转换文件编码。打开文件后,选择“文件”菜单下的“另存为”,在弹出的对话框中选择合适的编码格式,然后保存即可。这种方法简单直观,适用于对命令行不熟悉的用户。
需要注意的是,不同的文件编码可能会导致文件内容显示不正常。通过上述方法,可以有效地查看和转换文件编码,确保文件在不同环境下都能正确显示。在实际操作中,根据文件的实际情况选择合适的方法进行处理,可以避免不必要的麻烦。