HTTP应用协议本身是不能运行的,它需是需要架构在硬件和软件解决方案上,才能在万维网上提供高效的传输服务。

在这系列的文章中,我们将会了解到以下概念:

  • Web服务器
  • 代理服务器
  • 缓存
  • 网关、信道和中继器
  • 网络爬虫

这些都是我们互联网生活中不可或缺的部分,你会了解到它们每个的作用,是怎么工作的,让你更好的理解HTTP通信。

Web服务器

web服务器主要功能就是存储资源,并为接收到的请求提供服务。您可以使用 web 客户端 (又称 web 浏览器) 访问 web 服务器, 并在返回时获取所请求的资源或更改现有的状态。web 服务器也可以被自动访问, 使用网络爬虫, 我们将在文章的后面讨论。

web 服务器既有简单易用的软件也有复杂成熟的软件程序。现代 web 服务器能够执行许多不同的任务。web 服务器应该能够执行的基本任务如下:

  • 创建连接-接受或关闭客户端连接
  • 接收请求–读取 http 请求消息
  • 处理请求-解释请求消息并采取行动
  • 访问资源-访问消息中指定的资源
  • 构造响应-创建 http 响应消息
  • 发送响应-将响应发送回客户端
  • 日志事务–在日志文件中写入已完成的事务

我会对web服务器的基本处理流程分解为几个不同的阶段。用这些阶段来呈现了简化的web服务器处理流程。

阶段1:创建连接

当 web 客户端想要访问 web 服务器时, 它必须尝试打开一个新的 tcp 连接。在另一端, 服务器尝试提取客户端的 ip 地址。之后, 服务器决定打开或关闭与该客户端的 tcp 连接。

如果服务器接受连接, 它会将其添加到现有连接的列表中, 并监视该连接上的数据。

如果客户端未被授权或被列入黑名单 (恶意), 它也可以关闭连接。

服务器还可以通过使用 "反向 dns" 来确定客户端的主机名。这些信息在记录消息时会有所帮助, 但主机名查找可能需要一段时间, 从而减慢了事务的速度。

阶段2:接收请求/处理请求

分析传入请求时, web 服务器将从消息请求行、头和正文 (如果提供) 分析信息。需要注意的一点是, 连接可以随时暂停, 在这种情况下, 服务器必须暂时存储信息, 直到接收到其余的数据。

高端 web 服务器应该能够打开许多同时连接。这包括来自同一客户端的多个同时连接。典型的 web 页可以从服务器请求许多不同的资源。

阶段3:访问资源

由于 web 服务器主要是资源提供者, 因此它们有多种方式来映射和访问资源。

最简单的方法是映射资源, 即使用请求 uri 在 web 服务器的文件系统中查找该文档。通常, 资源包含在服务器上的一个特殊文件夹中, 称为 docroot。例如, windows 服务器上的 docroot 可以位于 F:\WebResources \。如果一个获取请求要访问/图像/codemazeblog 上的文件, 服务器会将其转换为 F:\WebResources\images\codemazeblog.txt, 并在响应消息中返回该文件。当 web 服务器上承载多个网站时, 每个站点都可以有其单独的 docroot。

如果 web 服务器收到对目录的请求而不是文件, 它可以用几种方法解决它。它可以返回错误信息, 返回默认索引文件而不是目录, 或者扫描目录, 并返回 html 文件的内容。

服务器还可以将请求 uri 映射到动态资源, 这是一个生成一些结果的软件应用程序。有一整类服务器称为应用服务器, 其目的是将 web 服务器连接到复杂的软件解决方案, 并提供动态内容。

阶段4:构造响应和发送响应

一旦服务器确定了它需要服务的资源, 它就会形成响应消息。响应消息包含状态代码、响应头和响应正文 (如果需要)。

如果该正文出现在响应中, 则消息通常包含描述正文大小的内容长度标头和描述返回资源的 mime 类型的内容类型标头。

生成响应后, 服务器将选择需要发送响应的客户端。对于非持久连接, 服务器需要在发送整个响应消息时关闭连接。

阶段5:记录日志

事务完成后, 服务器将所有事务信息记录到文件中。许多服务器都提供自定义日志记录。

代理服务器

代理服务器 (proxy) 是中间服务器。它们通常在 web 服务器和 web 客户端之间找到。由于其性质, 代理服务器需要表现的既像 web 客户端又像web服务器。

但是, 为什么我们需要代理服务器?为什么我们不直接在 web 客户端和 web 服务器之间进行通讯?是不是更简单和更快?

好吧, 简单的, 也许是, 但更快, 不是真的。但我们会来的

在解释哪些代理服务器被使用之前, 我需要了解反向代理的概念、正向代理和反向代理之间的区别。

正向代理服务器充当从web服务器请求资源的客户端的代理。它通过防火墙筛选请求或隐藏有关客户端的信息来保护客户端。而反向代理采用完全相反的工作方式。它通常放在防火墙后面并保护 web 服务器。所有的客户端都会认为正与真实的web服务器通信, 实际上反向代理背后的网络一无所知。

正向代理

反向代理

代理非常有用, 它们的应用非常广泛。让我们来看看代理服务器的一些使用方法。

  • 压缩–压缩内容会直接增加通信速度。简单的。
  • 监控和过滤-想拒绝小学生进入成人网站?代理是适合您的解决方案。??
  • 安全性-代理可以作为整个网络的一个入口点。它们可以检测恶意应用程序并限制应用程序级别协议。
  • 匿名--请求可以由代理修改以获得更大的匿名性。它可以从请求中剥离敏感信息, 只留下重要的内容。虽然向服务器发送较少的信息可能会降低用户体验, 但匿名有时是更重要的因素。
  • 访问控制-非常简单, 您可以集中在单个代理服务器上的许多服务器的访问控制。
  • 缓存-您可以使用代理服务器缓存热点内容, 从而大大降低加载速度。
  • 负载平衡-如果您的服务获得了大量 "峰值通信量", 则可以使用代理在更多计算资源或 web 服务器上分配工作负荷。负载平衡器路由通信, 以避免在峰值发生时重载单个服务器。
  • 代码转换–更改消息正文的内容也可以是代理的功能。

正如您所看到的, 代理可以是非常灵活的。

HTTP架构介绍(1) Web服务器和代理服务器的更多相关文章

  1. web服务器软件(Nginx,Apache,IIS,Lighttpd)介绍

    Nginx是一款轻量级的Web 服务器/反向代理服务器及电子邮件(IMAP/POP3)代理服务器,并在一个BSD-like 协议下发行.其特点是占有内存少,并发能力强,事实上nginx的并发能力确实在 ...

  2. LAMP架构介绍

    介绍一下LAMP架构 LMAP即Linux+Apache+Mysql/MariaDB+Perl/PHP/Python的首字母缩写.这是一组常用来搭建动态网站或者服务器的开源软件.它们本身都是各自独立的 ...

  3. [阿里云部署] Ubuntu+Flask+Nginx+uWSGI+Mysql搭建阿里云Web服务器

    部署地址:123.56.7.181 Ubuntu+Flask+Nginx+uWSGI+Mysql搭建阿里云Web服务器 这个标题就比之前的"ECS服务器配置Web环境的全过程及参考资料&qu ...

  4. 高性能Web服务器Nginx

    高性能Web服务器Nginx介绍 Nginx是一款轻量级的Web 服务器/反向代理服务器及电子邮件(IMAP/POP3)代理服务器,并在一个BSD-like 协议下发行.其特点是占有内存少,并发能力强 ...

  5. web服务器--nginx简介

    nginx 介绍Nginx (engine x) 是一个高性能的HTTP和反向代理web服务器,同时也提供了IMAP/POP3/SMTP服务.Nginx是一款轻量级的Web 服务器/反向代理服务器及电 ...

  6. 一篇文章带你了解轻量级Web服务器——Nginx简单入门

    一篇文章带你了解轻量级Web服务器--Nginx简单入门 Nginx是一款轻量级的Web服务器/反向代理服务器及电子邮件代理服务器 在本篇中我们会简单介绍Nginx的特点,安装,相关指令使用以及配置信 ...

  7. Nginx:轻量级高性能的Web服务器

    Nginx ("engine x") 是一个高性能的HTTP和反向代理服务器,也是一个IMAP/POP3/SMTP服务器.Nginx是由Igor Sysoev为俄罗斯访问量第二的R ...

  8. 主流Web服务器一览

    概念Web服务器是可以向发出请求的浏览器提供文档的程序. 1.服务器是一种被动程序:只有当Internet上运行在其他计算机中的浏览器发出请求时,服务器才会响应. 2.最常用的Web服务器是Apach ...

  9. JAVA编写WEB服务器

    一.超文本传输协议  1.1 HTTP请求  1.2 HTTP应答  二.Socket类  三.ServerSocket类  四.Web服务器实例  4.1 HttpServer类  4.2 Requ ...

随机推荐

  1. 怎样才能收集到所有开发人员的blog(待续…)

    第一个问题,如何找到尽可能多的博客地址? 1. 找到一个知名blog, 遍历这个博客的外链. 2. 遍历找到的外链,并以同样逻辑找到其他博客. 3. 如果遍历到的博客地址已经存在则停止遍历. 还有一种 ...

  2. C# winform中Show()和ShowDialog()的区别

    项目实际开发中需要根据不同的应用场景利用Show和ShowDialog,尤其是三级弹窗,慎用ShowDialog,否则会导致关闭第三级窗体时,自动关闭第二级,解决方案就是在第一级窗体弹出时采用Show ...

  3. CentOS Crontab(定时任务)

    安装crontab: yum install crontabs 说明: service crond start //启动服务 service crond stop //关闭服务 service cro ...

  4. Ceph神坑系列

    1. 在使用librbd的过程中,发现一个如果ceph集群异常librbd函数不返回的问题,对librbd的源码进行跟踪,发现了rados接口中的rados_mon_op_timeout(how ma ...

  5. Docker MariaDB 10.3 Galera Cluster 集群同步复制 多主 Docker Haproxy 负载均衡

    mariadb 现有动态列,支持json格式存储,类似mongodb的bson,但是操作能力较为尴尬,中间件有spider,我非常感兴趣的一个东西 关于spider 这里有一篇很好的博文,有时间一定得 ...

  6. kolla管理openstack容器

    本文以nova-api容器为例,说明kolla如何将nova-api配置文件传入容器,容器如何启动nova-api服务并读取配置文件 注:第一部分比较无趣,二三部分 会有意思一些 1. nova-ap ...

  7. golang调试工具Delve

    Devle是一个非常棒的golang 调试工具,支持多种调试方式,直接运行调试,或者attach到一个正在运行中的golang程序,进行调试. 线上golang服务出现问题时,Devle是必不少的在线 ...

  8. 新手福音︱正则表达式小工具RegExr

    由于之前在做NLP的内容,势必会接触正则表达式,但是呢,又觉得这个学不明白- 于是,这个工具还是蛮不错的,相当于在线正则速查+验证小工具,对于我这样的新手值得去玩玩. github:https://g ...

  9. linux下在用户空间访问I/O端口的ioperm和iopl函数

    1.ioperm函数      功能描述:为调用进程设置I/O端口访问权能.ioperm的使用需要具有超级用户的权限,只有低端的[0-0x3ff] I/O端口可被设置,要想指定更多端口的权能,可使用i ...

  10. 2.1 存储器域与PCI总线域

    HOST主桥的实现因处理器系统而异.PowerPC处理器和x86处理器的HOST主桥除了集成方式不同之外,其实现机制也有较大差异.但是这些HOST主桥所完成的最基本功能依然是分离存储器域与PCI总线域 ...