Java编译错误——编码GBK的不可映射字符等-清无-ChinaUnix博客

清无时空【ChinaUnix】韩清无

首页　| 　博文目录　| 　关于我

清无

博客访问： 411185
博文数量： 162
博客积分： 0
博客等级：民兵
技术积分： 1501
用户组：普通用户
注册时间： 2016-10-21 19:45

文章分类

全部博文（162）

编程语言及技术相（37）

Office及VBA（2）

C/C++（2）

Android（9）

Java（1）

HTML/CSS/JavaScr（3）

NodeJS（0）

Python（19）
服务器及操作系统（52）

Linux-Common（17）

Linux-常用命令（6）

Centos（7）

Fedora（11）

Nginx（1）

计算机硬件相关（1）

网络安全及其他（0）

Windows相关（8）
机器学习及科学计（20）

Tensorflow相关（2）

机器学习相关名词（5）

Python科学计算库（2）

DeepLearning（3）

Caffe学习（1）

Hadoop（3）

数据挖掘（1）
ScienceResearch（2）

专业名词术语（2）
数据库相关（13）

Redis相关（1）

MySQL（11）
常用软件及工具相（20）

SecureCRT（1）

Office办公软件相（0）

CodeBlocks（4）

Jenkins（1）

Docker（2）

VirtualBox（2）

VI(VIM)（3）

Git（7）
其他分类（18）

个人记事（7）

BD-QA相关（10）
未分配的博文（0）

文章存档

2018年（1）

2017年（101）

2016年（60）

推荐博文

相关博文

Java编译错误——编码GBK的不可映射字符等

分类： Java

2017-04-22 21:40:44

错误: 编码GBK的不可映射字符
解决方案：javac Main.java -encoding UTF-8

错误: 非法字符: '\ufeff'
将UTF-8格式文件另存为其他格式，再另存为UTF-8格式

UTF-8 与 UTF-8 BOM区别：
一个带标签，一个没有标签。
BOM是Byte Order Mark（定义字节顺序），因为在网络传输中分两种顺序：大头和小头。

由于兼容性，带BOM的utf-8在一些browser中显示为乱码。

网上搜索了关于Byte Order Mark的信息：
在UCS 编码中有一个叫做"ZERO WIDTH NO-BREAK SPACE"的字符，它的编码是FEFF。而FFFE在UCS中是不存在的字符，所以不应该出现在实际传输中。UCS规范建

议我们在传输字节流前，先传输字符"ZERO WIDTH NO-BREAK SPACE"。这样如果接收者收到FEFF，就表明这个字节流是Big-Endian的；如果收到FFFE，就表明这

个字节流是Little- Endian的。因此字符"ZERO WIDTH NO-BREAK SPACE"又被称作BOM。
UTF-8不需要BOM来表明字节顺序，但可以用BOM来表明编码方式。字符"ZERO WIDTH NO-BREAK SPACE"的UTF-8编码是EF BB BF。所以如果接收者收到以EF BB BF

开头的字节流，就知道这是UTF-8编码了。
Windows就是使用BOM来标记文本文件的编码方式的。

阅读(947) | 评论(0) | 转发(0) |

上一篇：机器学习基础——香农熵、相对熵（KL散度）与交叉熵

下一篇：Django-Using PIL with Django

给主人留下些什么吧！~~

感谢所有关心和支持过ChinaUnix的朋友们

16024965号-6