您现在的位置是:休闲 >>正文
linux网络公关修复中显示中文乱码的问题
休闲55人已围观
简介linux中显示中文乱码的问题我要评论2013/08/2916:08:05来源:绿色资源网编辑:www.downcc.com[大中小]评论:0点击:368次由于在windows下默认是gb编码,而我的 ...
linux中显示中文乱码的中中文问题
由于在windows下默认是gb编码,而我的显示vim默认是utf-8(gedit默认也是utf-8),所以打开会成乱码。乱码网络公关修复修改了一下配置文件,中中文使vi支持gb编码就好了。显示
$vi ~/.vimrc
let &termencoding=&encoding
set fileencodings=utf-8,gbk
$:wq
再次打开vi,乱码显示就正常了。中中文
如果你需要在linux下面用到windows下的显示文件,拷贝上去后经常发现中文显示乱码。乱码。中中文原因是显示Windows中默认的文件格式是 GBK(gb2312),而Linux一般都是乱码UTF-8。比较繁琐的中中文方法是在windows下用程序把内容转换为utf-8编码格式的,但是显示相当麻烦,而且遇到一个文件转一回。乱码下面介绍一下,在Linux中如何一劳永逸的解决这个问题,查看文件的网络公关修复编码及如何进行对文件进行编码转换。
查看文件编码
在Linux中查看文件编码可以通过以下几种方式:
1.在Vim 中可以直接查看文件编码
:set fileencoding
即可显示文件编码格式。
文件编码转换
1.如果你只是想查看其它编码格式的文件或者想解决用Vim查看文件乱码的问题,那么你可以在
~/.vimrc(在/etc目录下面) 文件中添加以下内容:
set encoding=utf-8 fileencodings=ucs-bom,utf-8,cp936
其中encoding是vim的默认显示编码格式,fileencodings是vim打开文件时检测的编码格式,存在这种类型的编码即转换为utf-8 编码。
这样,就可以让vim自动识别文件编码(可以自动识别UTF-8或者GBK编码的文件),其实就是依照fileencodings提供的编码列表尝试,如果没有找到合适的编码,就用latin-1(ASCII)编码打开。
2.在Vim中直接进行转换文件编码,比如将一个文件转换成utf-8格式(不好用)
:set fileencoding=utf-8
3.iconv 转换,iconv的命令格式如下:(未用)
iconv -f encoding -t encoding inputfile
比如将一个UTF-8 编码的文件转换成GBK编码
iconv -f GBK -t UTF-8 file1 -o file2
文件名编码转换:
从Linux 往 windows拷贝文件或者从windows往Linux拷贝文件,有时会出现中文文件名乱码的情况,出现这种问题的原因是因为,windows的文件名中文编码默认为GBK,而Linux中默认文件名编码为UTF8,由于编码不一致,所以导致了文件名乱码的问题,解决这个问题需要对文件名进行转码。
在Linux中专门提供了一种工具convmv进行文件名编码的转换,可以将文件名从GBK转换成UTF-8编码,或者从UTF-8转换到GBK。
首先看一下你的系统上是否安装了convmv,如果没安装的话用在
http://www.j3e.de/linux/convmv/convmv-1.14.tar.gz
下载,然后在windows下面解压缩用winscp上传真个目录,之后进入此目录执行make install命令,之后用convmv命令测试是否安装成功,若显示一些命令提示则表示成功了。
安装。
下面看一下convmv的具体用法:
convmv -f 源编码 -t 新编码 [选项] 文件名
常用参数:
-r 递归处理子文件夹
--notest 真正进行操作,请注意在默认情况下是不对文件进行真实操作的,而只是试验。
--list 显示所有支持的编码
--unescap 可以做一下转义,比如把%20变成空格
比如我们有一个utf8编码的文件名,转换成GBK编码,命令如下:
convmv -f UTF-8 -t GBK --notest utf8编码的文件名
这样转换以后"utf8编码的文件名"会被转换成GBK编码(只是文件名编码的转换,文件内容不会发生变化)
vim 编码方式的设置
和所有的流行文本编辑器一样,Vim 可以很好的编辑各种字符编码的文件,这当然包括UCS-2、UTF-8 等流行的 Unicode 编码方式。然而不幸的是,和很多来自 Linux 世界的软件一样,这需要你自己动手设置。
Vim 有四个跟字符编码方式有关的选项,encoding、fileencoding、fileencodings、termencoding (这些选项可能的取值请参考 Vim 在线帮助 :help encoding-names),它们的意义如下:
* encoding: Vim 内部使用的字符编码方式,包括 Vim 的 buffer (缓冲区)、菜单文本、消息文本等。默认是根据你的locale选择.用户手册上建议只在 .vimrc 中改变它的值,事实上似乎也只有在.vimrc 中改变它的值才有意义。你可以用另外一种编码来编辑和保存文件,如你的vim的encoding为utf-8,所编辑的文件采用cp936编码,vim会自动将读入的文件转成utf-8(vim的能读懂的方式),而当你写入文件时,又会自动转回成cp936(文件的保存编码).
* fileencoding: Vim 中当前编辑的文件的字符编码方式,Vim 保存文件时也会将文件保存为这种字符编码方式 (不管是否新文件都如此)。
* fileencodings: Vim自动探测fileencoding的顺序列表, 启动时会按照它所列出的字符编码方式逐一探测即将打开的文件的字符编码方式,并且将 fileencoding 设置为最终探测到的字符编码方式。因此最好将Unicode 编码方式放到这个列表的最前面,将拉丁语系编码方式 latin1 放到最后面。
* termencoding: Vim 所工作的终端 (或者 Windows 的 Console 窗口) 的字符编码方式。如果vim所在的term与vim编码相同,则无需设置。如其不然,你可以用vim的termencoding选项将自动转换成term 的编码.这个选项在 Windows 下对我们常用的 GUI 模式的 gVim 无效,而对 Console 模式的Vim 而言就是 Windows 控制台的代码页,并且通常我们不需要改变它。
好了,解释完了这一堆容易让新手犯糊涂的参数,我们来看看 Vim 的多字符编码方式支持是如何工作的。
1. Vim 启动,根据 .vimrc 中设置的 encoding 的值来设置 buffer、菜单文本、消息文的字符编码方式。
2. 读取需要编辑的文件,根据 fileencodings 中列出的字符编码方式逐一探测该文件编码方式。并设置 fileencoding 为探测到的,看起来是正确的 (注1) 字符编码方式。
3. 对比 fileencoding 和 encoding 的值,若不同则调用 iconv 将文件内容转换为encoding 所描述的字符编码方式,并且把转换后的内容放到为此文件开辟的 buffer 里,此时我们就可以开始编辑这个文件了。注意,完成这一步动作需要调用外部的 iconv.dll(注2),你需要保证这个文件存在于 $VIMRUNTIME 或者其他列在 PATH 环境变量中的目录里。
4. 编辑完成后保存文件时,再次对比 fileencoding 和 encoding 的值。若不同,再次调用 iconv 将即将保存的 buffer 中的文本转换为 fileencoding 所描述的字符编码方式,并保存到指定的文件中。同样,这需要调用 iconv.dll由于 Unicode 能够包含几乎所有的语言的字符,而且 Unicode 的 UTF-8 编码方式又是非常具有性价比的编码方式 (空间消耗比 UCS-2 小),因此建议 encoding 的值设置为utf-8。这么做的另一个理由是 encoding 设置为 utf-8 时,Vim 自动探测文件的编码方式会更准确 (或许这个理由才是主要的 ;)。我们在中文 Windows 里编辑的文件,为了兼顾与其他软件的兼容性,文件编码还是设置为 GB2312/GBK 比较合适,因此 fileencoding 建议设置为 chinese (chinese 是个别名,在 Unix 里表示 gb2312,在 Windows 里表示cp936,也就是 GBK 的代码页)。
vim中编辑不同编码的文件时需要注意的一些地方
此文讲解的是vim编辑多字节编码文档(中文)所要了解的一些基础知识,注意其没有涉及gvim,纯指字符终端下的vim。
vim编码方面的基础知识:
1,存在3个变量:
encoding—-该选项使用于缓冲的文本(你正在编辑的文件),寄存器,Vim 脚本文件等等。你可以把 ‘encoding’ 选项当作是对 Vim 内部运行机制的设定。
fileencoding—-该选项是vim写入文件时采用的编码类型。
termencoding—-该选项代表输出到客户终端(Term)采用的编码类型。
2,此3个变量的默认值:
encoding—-与系统当前locale相同,所以编辑文件的时候要考虑当前locale,否则要设置的东西就比较多了。
fileencoding—-vim打开文件时自动辨认其编码,fileencoding就为辨认的值。为空则保存文件时采用encoding的编码,如果没有修改encoding,那值就是系统当前locale了。
termencoding—-默认空值,也就是输出到终端不进行编码转换。
由此可见,编辑不同编码文件需要注意的地方不仅仅是这3个变量,还有系统当前locale和、文件本身编码以及自动编码识别、客户运行vim的终端所使用的编码类型3个关键点,这3个关键点影响着3个变量的设定。
如果有人问:为什么我用vim打开中文文档的时候出现乱码?
答案是不确定的,原因上面已经讲了,不搞清楚这3个关键点和这3个变量的设定值,出现乱码是正常的,倒是不出现乱码那反倒是凑巧的。
再来看一下常见情况下这三个关键点的值以及在这种情况下这3个变量的值:
1,locale—-目前大部分Linux系统已经将utf-8作为默认locale了,不过也有可能不是,例如有些系统使用中文locale zh_CN.GB18030。在locale为utf-8的情况下,启动vim后encoding将会设置为utf-8,这是兼容性最好的方式,因为内部 处理使用utf-8的话,无论外部存储编码为何都可以进行无缺损转换。locale决定了vim内部处理数据的编码,也就是encoding。
2,文件的编码以及自动编码识别—-这方面牵扯到各种编码的规则,就不一一细讲了。但需要明白的是,文件编码类型并不是保存在文件内的,也就是
关键词:linux,中文乱码
阅读本文后您有什么感想? 已有人给出评价!
- 1
- 1
- 1
- 1
- 1
- 1
Tags:
相关文章
外媒称中国GDP实际增速仅4.1% 发改委回应
休闲 针对“境外的一些机构和媒体称中国经济实际增长只有4.1%”的说法,国家发展改革委新闻发言人孟玮22日表示,2018年,中国经济运行保持在合理区间,实现了经济增长预 ...
【休闲】
阅读更多公益筑梦顶呱刮
休闲点击继续查看使用安卓和iPhone最新版本客户端可获得更流畅体验,下载地址:安卓用户点这里iPhone用户点这里 ...
【休闲】
阅读更多部分热门车企净利润对比 法拉利断层遥遥领先
休闲日前,乘联会秘书长崔东树对部分热门车企的2024年报进行了分析整理。从整体情况来看,当前车企的毛利率呈现出较为可观的总体表现。然而,需要注意的是,由于各企业在研发等多个方面投入的费用存在差异,再加上税 ...
【休闲】
阅读更多
热门文章
最新文章
友情链接
- 尘封60年的珍贵档案,揭开东深供水工程建造始末
- 安庆市:践行婚恋新风尚倡导婚俗新文化
- 被人看不起的朋友圈说说 落魄了别人看不起句子
- 《inZOI(云族裔)》正式上线官方模组工具“inZOI ModKit”
- 2025"欧莱雅
- 孙春兰强调 推动教育高质量发展 办好人民满意的教育
- Announcement: Call of Duty: Black Ops 6 and Call of Duty: Warzone Season 04: Full Intel Revealed!
- 微软或将全面退出主机市场?机器可能全靠第三方厂商
- 中科稀珍首席科学家闫硕博士赴澳出席“2025老年慢性疾病防治医学研讨会”
- OPPO手机如何开启简易模式
- 弱市赚钱技巧:重组股里淘金
- 《爱是什么》(李恩羽演唱)的文本歌词及LRC歌词
- 秋天的脚步到哪了?全国入秋进程图出炉,南方秋凉仍需时日
- 《问道》新服专属活动【囊中乾坤】已开启,银元宝还能翻倍领?
- 秒变UFC!森林狼活塞爆发大规模冲突 7人被驱逐
- AI能预测彩票中奖号码?100%是骗局
- 《洛奇英雄传》便利性优化今日更新 春日时装温暖上线
- 子弹帮将在RAW重组?
- 妖灵战姬兑换码大全2025
- 重庆第二轮第二批生态环境保护例行督察情况反馈
- 暖冬守护 保供同行
- 真金白银增信心稳预期 中国民生银行杭州分行为经济发展注入金融动能
- 解决厨余垃圾用垃圾处理器还是垃圾桶
- 今日辟谣(2025年3月24日)
- 环境肇庆项目环卫工人梁亚盆荣获2024年敬老爱亲“广东好人”荣誉
- 新疆霍尔果斯口岸客流爆棚!互免签证助力跨境游
- 由环境参编的两项团体标准于近期出版发行
- 布雷·怀亚特接受采访 我和送葬者一样充满了魔幻色彩
- 学骑单车 Learn to Ride the Bike
- 刘谦自曝患癌!为何有人称这种癌为“幸运癌”?专家答疑→
- 劝人调整心态的句子 开导人压力大的暖心话
- 漆彩•智绘•未来:PPG汽车涂料色彩创新工作室正式启幕
- 国际电联发布新版《无线电规则》 优化无线电频谱管理
- 天津市垃圾要分类了这些信息你必须要知道
- 移动智能核酸采样亭操作标准流程
- AJ会让美国冠军变得更加伟大?
- SD赛事即将上演 独狼vs毒蛇?
- 米切尔空砍38+5哈达威32分 活塞力克骑士取3连胜
- 汇成医美?创新运营大会:以创新实现“增长魔咒”的破局!
- 辽鲁大战前瞻!弗格+山东双小外状态成关键,双方都存X因素!