跳到主要内容
JackSparrow414
返回

java编码和解码(二)

本文导航

展开本文导航

正文

当浏览器向服务器发送URL请求时,非ACS码值的一个字节都会被转换为%xy的形式,utf8编码是将一个汉字编为3个字节。

发送数据时,浏览器首先将url进行编码,会调用java.net下的URLEncoder下的encode方法,encode方法如下图

URLEncoder.encode 通过 Charset.forName 获取编码字符集

依旧和原来一样,调用charset类,只不过这次获得编码格式是通过charset.forName()方法,当这个方法,点击进去,你会发现,它只不过是将charset.lookup()进行了一次封装,如下图

Charset.forName 调用 lookup 查找字符集的源码

接下来的原理都一样,只不过加了一个将字节转换为16进制的表示,在浏览器端显示,放在request请求头里的referer部分,发送到服务器端,大致如下图

URLEncoder 将字节转换为百分号加十六进制字符的源码

服务器端拿到url根据自身设置的编解码格式通过URLDecoder进行解码,过程和上面所述原理一致

Request HeaderS如下图

浏览器 HTTP Request Headers 中的 Referer、Accept 与编码信息

Response Headers如下图

HTTP Response Headers 中的 Content-Type 与 Transfer-Encoding

HTTP 响应头指定 UTF-8 字符集并使用 chunked 传输编码

Transfer-Encoding: chunked  代表服务器端返回的数据可能过大,对返回的数据进行分块编码


分享本文:

继续阅读本系列

Java 编码和解码

  1. 关于java中编码和解码(一)
  2. java编码和解码(二)正在阅读

评论

欢迎提问、纠错和分享经验。发表评论需要登录 GitHub;中英文版本共享评论。

评论仅在正式网站开放。