结论其实很明确:file -i最多只能做个大致判断,真要想更稳妥,还是得看enca -L zh(针对中文文件)或者直接用iconv -f XXX -t UTF-8手动试错;至于:set fileencoding,它显示的是 Vim 推测出来的编码,不是文件的真实编码,不能拿它当依据。

Linux怎么查看具体的文件编码

直接看结论:**file -i 只能粗略判断,真正靠谱的是 enca -L zh(中文文件)或 iconv -f XXX -t UTF-8 手动试错**。别信 :set fileencoding? 显示的结果——那是 Vim 猜的,不是文件真实编码。

file -i 快速看 MIME 编码,但别全信

file -i 这类判断本质上还是看 BOM 或字节特征,所以一旦遇到没有 BOM 的 GBK/GB2312 文件,基本就不太靠得住了,返回结果里经常会出现 charset=iso-8859-1,或者干脆是 charset=unknown-8bit

enca -L zh 精准识别中文文本编码

enca 是专为东亚语言设计的检测工具,对 GBK、GB2312、UTF-8 混合内容识别更稳,但需先安装:

iconv -f XXX -t UTF-8 手动验证源编码

iconv 不检测,但能“反向验证”:转换不报错 + 输出可读,基本就是对的。这是最可靠的兜底方法。

在 Vim 里用 :e ++enc=xxx 实时比对显示效果

Vim 的 :set fileencoding? 显示的是当前加载所用的编码,不是原始编码;但它支持强制重读,适合肉眼验证。

真实编码藏在字节里,不在文件名或编辑器提示里。最容易被忽略的是:**BOM 是否存在、文件是否混合编码、终端 LANG 是否匹配**——哪怕编码转对了,LANG=C 下照样显示为
本文转载于:https://www.php.cn/faq/2993204.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。