资源列表
[搜索引擎] longtexiao_1.0
说明:百度龙logo的特效代码2012是春节期间在百度首页logo的一个特效代码,logo图中的龙会随着鼠标脱离logo。-Baidu dragon logo effects code 2012 during the Spring Festival in a special effects Baidu Home logo code, the dragon logo figure with the mouse out of logo.<沈萧> 在 2025-01-06 上传 | 大小:80kb | 下载:0
[搜索引擎] NwebCrawler
说明: NwebCrawler是用C#写的一款多线程网络爬虫程序,它的实现原理是先输入一个或多个种子URL到队列中,然后从队列中提取URL(先进先出原则),分析此网页寻找相应标签并获得其href属性值,爬取有用的链接网页并存入网页库中,其中用爬取历史来记录爬过的网页,这样避免了重复爬取。提取URL存入队列中,进行下一轮爬取。所以NwebCrawler的搜索策略为广度优先搜索。采用广度优先策略有利于多个线程并行爬取而且抓取的封闭性很强。-Nwe<sunshine> 在 2025-01-06 上传 | 大小:14kb | 下载:0
[搜索引擎] Parser-LiveInternet
说明:Parser LiveInternet - program for parsing liveinternet<skdon_> 在 2025-01-06 上传 | 大小:262kb | 下载:0
[搜索引擎] direct_web_spider-master
说明:用ruby写的爬虫,能自定义页面解析方式等。基于配置可快速配置出自己需要的爬虫-The reptiles write with the ruby<Tim> 在 2025-01-06 上传 | 大小:63kb | 下载:0
[搜索引擎] crawler-on-news-topic-with-samples
说明:java做的抓取sohu所有的新闻;可以实现对指定站点新闻内容的获取;利用htmlparser爬虫工具抓取门户网站上新闻,代码实现了网易、搜狐、新浪网上的新闻抓取;如果不修改配置是抓取新浪科技的内容,修改配置可以抓取指定的网站;实现对指定站点新闻内容的获取-java do crawl sohu news access to the designated site news content using htmlparser repti<alan> 在 2025-01-06 上传 | 大小:6.87mb | 下载:0