一道经典的面试题目:
从 URL 在浏览器被被输入到页面展现的过程中发生了什么? 上面问题,或多或少可以回答出来,但是
如果继续问:收到的 HTML 如果包含几十个图片标签,这些图片是以什么方式、什么顺序、建立了多少连接、使用什么协议被下载下来的呢?
HTTP基础知识
- http1.0:单工。因为是短连接,客户端发起请求之后,服务端处理完请求并收到客户端的响应后即断开连接。
- http1.1 是半双工,建立长连接,出现多路复用,可先后发送多个http请求,不用等待回复,但是回复按顺序一个一个回复.默认开启长连接keep-alive,支持请求的流水线(pipelining)。
- http2.0是全双工,一个消息发送后不用等待接受,第二个消息可以直接发送.允许服务端主动向客户端发送数据。
- tcp是全双工的,但它的上层可能支持半双工,比如http1.x,也有可能支持全双工,比如http2.0,也有可能是单工,比如http1.0。----下一层给上一层通过接口提供服务。
五个问题
-
现代浏览器在与服务器建立了一个 TCP 连接后是否会在一个 HTTP 请求完成后断开?什么情况下会断开? -
一个 TCP 连接可以对应几个 HTTP 请求? -
一个 TCP 连接中 HTTP 请求发送可以一起发送么(比如一起发三个请求,再三个响应一起接收)? -
为什么有的时候刷新页面不需要重新建立 SSL 连接? -
浏览器对同一 Host 建立 TCP 连接到数量有没有限制?
第一个问题
根据基础知道第一条:HTTP1.0为短连接。这样每次请求都会花费很长时间,紧接着HTTP1.1半连接加入Connection:keep-alive,长连接,可以对TCP连接进行复用。 如何验证前两次HTTP使用的是同一个TCP连接? 第一次连接,必须有初始化连接和SSL的开销。 第二次连接,初始化连接和SSL开销消失了,说明使用的是同一个TCP连接。
总结:HTTP1.0会直接断开,HTTP1.1 默认情况下建立 TCP 连接不会断开,只有在请求报头中声明 Connection: close 才会在请求完成后关闭连接。
SSL的引入:起初是因为HTTP在传输数据时使用的是明文(虽然说POST提交的数据时放在报体里看不到的,但是还是可以通过抓包工具窃取到)是不安全的,为了解决这一隐患网景公司推出了SSL安全套接字协议层,SSL是基于HTTP之下TCP之上的一个协议层,是基于HTTP标准并对TCP传输数据时进行加密,所以HPPTS是HTTP+SSL/TCP的简称。
第二个问题
一个 TCP 连接可以对应几个 HTTP 请求?
根据第一个问题,如果维持连接,一个 TCP 连接是可以发送多个 HTTP 请求的。
第三个问题
一个 TCP 连接中 HTTP 请求发送可以一起发送么(比如一起发三个请求,再三个响应一起接收)?
HTTP/1.1存在一个问题:单个TCP连接在同一个时刻只能处理一个请求。意思是说:两个请求的生命周期不能重叠,任意两个 HTTP 请求从开始到结束的时间在同一个 TCP 连接里不能重叠。 虽然 HTTP/1.1 规范中规定了 Pipelining 来试图解决这个问题,但是这个功能在浏览器中默认是关闭的。
原因:由于 HTTP/1.1 是个文本协议,同时返回的内容也并不能区分对应于哪个发送的请求,所以顺序必须维持一致。比如你向服务器发送了两个请求 GET/query?q=A 和 GET/query?q=B,服务器返回了两个结果,浏览器是没有办法根据响应结果来判断响应对应于哪一个请求的。
Pipelining存在的问题:HTTP1.1默认不开启的原因
HTTP/2.0应运而生,提供了Multiplexing多路传输特性,可以在一个 TCP 连接中同时完成多个 HTTP 请求。至于 Multiplexing 具体怎么实现的就是另一个问题了。同一个Connection,并行完成。
总结:在 HTTP/1.1 存在 Pipelining 技术可以完成这个多个请求同时发送,但是由于浏览器默认关闭,所以可以认为这是不可行的。在 HTTP2 中由于 Multiplexing 特点的存在,多个 HTTP 请求可以在同一个 TCP 连接中并行进行。
那么在 HTTP/1.1 时代,浏览器是如何提高页面加载效率的呢?主要有下面两点:
-
维持和服务器已经建立的 TCP 连接,在同一连接上顺序处理多个请求。 -
和服务器建立多个 TCP 连接。
第四个问题
为什么有的时候刷新页面不需要重新建立 SSL 连接?
第一道题目,比较是否是使用同一个TCP连接已有答案。TCP 连接有的时候会被浏览器和服务端维持一段时间。TCP 不需要重新建立,SSL 自然也会用之前的
第五个问题
浏览器对同一 Host 建立 TCP 连接到数量有没有限制?
假设我们还处在 HTTP/1.1 时代,那个时候没有多路传输,当浏览器拿到一个有几十张图片的网页该怎么办呢?如果对TCP连接数量没有限制,网页有1000张图片,意味着要开1000个TCP连接,这对于自己的电脑和服务器是不允许的。如果只开一个TCP连接的话,用户的等待时间会比较长。
Chrome 最多允许对同一个 Host 建立六个 TCP 连接。不同的浏览器有一些区别。
那么回到最开始的问题,收到的 HTML 如果包含几十个图片标签,这些图片是以什么方式、什么顺序、建立了多少连接、使用什么协议被下载下来的呢?
如果图片都是 HTTPS 连接并且在同一个域名下,那么浏览器在 SSL 握手之后会和服务器商量能不能用 HTTP2,如果能的话就使用 Multiplexing 功能在这个连接上进行多路传输。不过也未必会所有挂在这个域名的资源都会使用一个 TCP 连接去获取,但是可以确定的是 Multiplexing 很可能会被用到。
如果发现用不了 HTTP2 呢?或者用不了 HTTPS(现实中的 HTTP2 都是在 HTTPS 上实现的,所以也就是只能使用 HTTP/1.1)。那浏览器就会在一个 HOST 上建立多个 TCP 连接,连接数量的最大限制取决于浏览器设置,这些连接会在空闲的时候被浏览器用来发送新的请求,如果所有的连接都正在发送请求呢?那其他的请求就只能等等了。
other
- TLS(Transport Layer Security 安全传输层协议)是SSL(Secure Socket Layer 安全套接层)的新版本3.1。
- Pipelining:一个支持持久连接的客户端可以在一个连接中发送多个请求(不需要等待任意请求的响应)。收到请求的服务器必须按照请求收到的顺序发送响应。
参考资料
- 一个 TCP 连接可以发多少个 HTTP 请求
|