您的位置：首页 > 其它

判断一个标准文本文件的编码方式

2011-10-26 19:32 381 查看

当一个软件打开一个文本时，它要做的第一件事是决定这个文本究竟是使用哪种字符集的哪种编码保存的。

软件一般采用三种方式来决定文本的字符集和编码：

检测文件头标识，提示用户选择，根据一定的规则猜测

最标准的途径是检测文本最开头的几个字节，开头字节 Charset/encoding,如下表：

EF BB BF UTF-8
FE FF UTF-16/UCS-2, little endian
FF FE UTF-16/UCS-2, big endian
FF FE 00 00 UTF-32/UCS-4, little endian.
00 00 FE FF UTF-32/UCS-4, big-endian.
如果开头两个字节是0xFFFE，那么就是Unicode，否则是ANSI。

内容来自用户分享和网络整理，不保证内容的准确性，如有侵权内容，可联系管理员处理

标签：

相关文章推荐

[转]在C#中判断一个文本文件的编码方式
NET中判断一个文本文件的编码方式
判断一个文本文件的编码方式
文本文件的编码方式判断
一个判断文本文件编码的类.txt
判断一个文本文件的编码格式
判断一个文本文件的编码格式(转)
判断一个文本文件的编码格式
[No000040]取得一个文本文件的编码方式
判断一个文本文件的编码格式
判断一个文本文件的编码格式
判断一个文本文件的编码格式
C# 用于取得一个文本文件的编码方式
VBA 判断一个TXT编码方式,再创建一个新的文件,复制数据进去
如何判断文本文件的编码方式？
文本文件编码方式判断
取得一个文本文件流的编码方式
笔试面试7 如何判断一个系统的存储方式是大端还是小端
Android--判断文本文件编码
python ucs-2与ucs-4编码方式判断

新的分享

一次教科书级别的Redis高可用架构设计实践 - Redis
曾光：北京这次的毒株不像国内流行类型
从PRD文档到产品上线，有哪些问题需要解决？
vue3自定义指令的使用
Oracle SQL性能优化最常用的40条建议 - ORACLE
程序员翻车常见反应，你中枪了吗？ - 职场生涯
新鲜开源：基于Prometheus的企业监控平台设计与实现 - 运维
嵌入式软件开发之程序架构设计-任务调度
【Java面试】请简单说一下你对受检异常和非受检异常的理解
奇安信更新招股书：第一季亏损过5亿，齐向东持股38%
艾瑞咨询：2020年中国后智能厨房案例研究报告
艾瑞咨询：2020年中国人工智能+物流发展研究报告

章节导航

EF BB BF	UTF-8
FE FF	UTF-16/UCS-2, little endian
FF FE	UTF-16/UCS-2, big endian
FF FE 00 00	UTF-32/UCS-4, little endian.
00 00 FE FF	UTF-32/UCS-4, big-endian.