网址(URL,uniform resource locator)是网络上某个资源的地址。它由几部分组成,你要能说出每一部分:协议、域名(主机名)和路径。这类题出现在安全和网页主题里,也是识别假链接的基础。
这一课是网络安全与负责任使用模块的开头。
网址是怎样组成的?
以这个虚构地址为例:
https://www.learn.example.com/maths/fractions.html
| 部分 | 内容 | 作用 |
|---|---|---|
| 协议(protocol) | https | 取得网页所用的规则。HTTPS 带有加密。 |
| 主机名(host name) | www.learn.example.com | 要联系哪台服务器。 |
| 路径(path) | /maths/fractions.html | 服务器上的哪个文件夹和文件。 |
:// 把协议和主机名隔开。主机名之后的第一个单个 / 就是路径的开始。
怎样找出域名?
把主机名从右往左读。最后一个标签 .com 是结尾(TLD)。
紧挨着它的 example 是所有者注册的名字。合起来,example.com 就是注册域名。
左边的标签 learn 和 www 是子域名。
example.com 的所有者可以随意创建这些标签。在马来西亚你可能会看到 .com.my 这样的结尾。这时注册域名是 example.com.my,因为 .com.my 起到结尾的作用。
例题
找出下面网址的协议、主机名、域名和路径:
https://shop.cityfood.example.org/menu/drinks/tea.html
第 1 步,协议: :// 之前的文字是 https。
第 2 步,主机名: :// 和下一个 / 之间的文字是 shop.cityfood.example.org。
第 3 步,域名: 从右往左读。.org 是结尾,example 是注册名,所以域名是 example.org。cityfood 和 shop 是子域名。
第 4 步,路径: 主机名后第一个 / 开始的全部内容,即 /menu/drinks/tea.html。文件夹是 /menu/drinks/,文件是 tea.html。
要避开的错误
错误读法: 在
https://www.example.com.verify-login.example.net/中,域名是example.com。学生从左边读起,在第一个熟悉的词就停下来。
主机名是 www.example.com.verify-login.example.net。从右往左读,结尾是 .net,注册名是 example,所以域名是 example.net。example.com 只是 example.net 的所有者自己取的子域名标签。
先找到第一个单个 /,再从那里把主机名倒着读。
自测
1. 写出 http://www.school.example.edu/timetable/form4.pdf 的协议和路径。
显示答案
协议:http。路径:/timetable/form4.pdf。(主机名是 www.school.example.edu。)
2. https://pay.cafe.example.com/order/12 的域名是什么?
显示答案
从右往左读,结尾是 .com,注册名是 example,域名是 example.com。pay 和 cafe 是子域名。
3. 两个链接是 https://example.com/news/a.html 和 https://example.com/news/b.html。什么相同,什么不同?
显示答案
协议、域名和文件夹相同。只有路径里的文件名不同(a.html 和 b.html),所以它们是同一网站上的两个不同页面。
接下来学什么?
接着看浏览器如何使用这些部分,见浏览器与服务器的交互。同样的读法也用来识别网络钓鱼信号。
然后用综合练习检验自己。伪代码追踪训练器对本模块后面的追踪题有帮助。
如果你总是因为标签答得差一点点而丢分,这正是我们在线上一对一计算机科学补习里着手解决的问题。