沈阳理工大学学士学位论文 I 摘要 目前即使通讯软件在平时的生活中有着十分广泛的应用,但是对绝大部分的软 件来说,都必须应用在互联网上,必须在一个 INTERNET 环境下才能使用。有时候单 位内部的员工,同学,在没有互联网环境下或因其他原因希望不用 INTERNET 就可以 进行信息交互,这样开发局域网通信就有了必要性。本文提出了局域网信息交互的需 求,并详细对网络协议 TCP/IP 协议族进行了介绍和研究,如 TCP,UDP,广播等相 关技术。并对网络信息交互原理惊醒了说明,在此基础上利用 SOCKET 网络编程实现 了一种基于 WINDOWS 平台的局域网信息交互功能。 网络爬虫是一种自动搜集互联网信息的程序。通过网络爬虫不仅能够为搜索引擎采集 网络信息,而且可以作为定向信息采集器,定向采集某些网站下的特定信息,如招聘 信息,租房信息等。 本文通过 JAVA 实现了一个基于广度优先算法的多线程爬虫程序。为何要使用多 线程,以及如何实现多线程;系统实现过程中的数据存储;网页信息解析等。 通过实现这一爬虫程序,可以搜集某一站点的 URLs,并将搜集到的 URLs 存入数 据库。将解析