在java中,getBytes()方法如果不指定字符集,则得到的是一个操作系统默认的编码格式的字节数组;如果指定字符集,则得到的是在指定字符集下的字节数组,如:

byte[] b_gbk = "中".getBytes("gbk");
byte[] b_utf8 = "中".getBytes("utf-8");
byte[] b_iso88591 = "中".getBytes("iso-8859-1");

将返回"中"这个汉字分别在gbk、utf-8、iso-8859-1编码下的字节数组表示,此时b_gbk的长度为2,b_utf8的长度为3,b_iso88591的长度为1。

与getBytes()方法相反,可以通过new String(byte[], charsetName)方法用指定的字符集来还原这个"中"字,如:

String s_gbk = new String(b_gbk, "gbk");
String s_utf8 = new String(b_utf8, "utf-8");
String s_iso88591 = new String(b_iso88591, "iso-8859-1");

通过打印出s_gbk、s_utf8、s_iso88591可以看到,s_gbk和s_utf8都是"中",而s_iso88591是一个乱码,这是因为iso-8859-1的编码表中,根本就没有包含汉字,因此"中".getBytes("iso-8859-1")得到的是"?"的字节数组表示,再通过new String(b_iso88591, "iso-8858-1")还原得到的是"?"。

有时候,为了让中文字符适应某些特殊要求(如http header要求其内容必须是iso-8859-1编码),可能会通过将中文字符按照字节方式来编码的情况,如:

String s_iso88591 = new String("中".getBytes("utf-8"), "iso-8859-1");

这样得到的字符串s_iso88591实际上是三个在iso-8859-1中的字符,在将这些字符传送到目的地后,再通过相反的方式,即:

String s_utf8 = new String(s_iso88591.getBytes("iso-8859-1"), "utf-8");

从而得到正确的中文汉字"中",这样就既保证了遵守协议规定,也支持了中文。

注:

byte[] b = "中".getBytes("utf-8");
for(int i=0; i<b.length; i++) {
  System.out.println(b[i]);
}

输出-28 -72 -83是因为"中"的utf-8编码为三个字节,分别是E4 B8 AD,以E4为例,换成二进制即为:

1110 0100

该二进制数将以补码存储在内存中,最高位被视为符号位,因此原码是:

1110 0100(补码) -> 1001 1011(反码) -> 1001 1100(原码)

即-(16+8+4)=-28

最新文章

  1. C#整数三种强制类型转换int、Convert.ToInt32()、int.Parse()的区别
  2. 自带TabBar选中图片设置问题
  3. android开发软件
  4. Laravel 5 基础(四)- Blade 简介
  5. poj 3069 Saruman&#39;s Army (贪心)
  6. poj 2462 Period of an Infinite Binary Expansion
  7. sencha touch 2.3 结合cordova 环境搭建
  8. charset
  9. python第一步
  10. poj 1715 Hexadecimal Numbers 排列组合
  11. Property 和 Attribute 的区别(转)
  12. AssetManager asset使用
  13. 检查 TCP 80 端口是否正常工作
  14. dubbo控制器xml文件报错
  15. python的类变量与实例变量以及__dict__属性
  16. w97常用功能代码
  17. LuoguP3792 由乃与大母神原型和偶像崇拜
  18. JAVA反射机制_获取字节码文件对象
  19. 经典笔试题:用C写一个函数测试当前机器大小端模式
  20. 在Oracle中查询表的大小

热门文章

  1. MySQL中锁的类型
  2. 我的Java开发学习之旅------>二进制、八进制、十进制、十六进制之间转换
  3. Linux中的服务管理
  4. Maven学习笔记—仓库
  5. 爬虫四 selenium模块
  6. php会话技术之Session用法
  7. iOS Application Project与OS X Application Project对于plist使用的区别
  8. 前端基础之jquery练习
  9. this 机制的四种规则
  10. 基于linux的ekho(余音)安装与开发