日韩久久久精品,亚洲精品久久久久久久久久久,亚洲欧美一区二区三区国产精品 ,一区二区福利

crawler4j - Open Source Web Crawler for Java

系統 2785 0

crawler4j - Open Source Web Crawler for Java - Google Project Hosting

Crawler4j is an open source Java crawler which provides a simple interface for crawling the Web. You can setup a multi-threaded web crawler in 5 minutes!

NOTE: version 3.0 is deprecated and should not be used. Please use the latest 3.3 version.

Sample Usage

You need to create a crawler class that extends WebCrawler . This class decides which URLs should be crawled and handles the downloaded page. The following is a sample implementation:

      
        public
      
      
      
      
        class
      
      
      
      
        MyCrawler
      
      
      
      
        extends
      
      
      
      
        WebCrawler
      
      
      
      
        {
      
      
        

? ? ? ?
private final static Pattern FILTERS = Pattern . compile ( ".*(\\.(css|js|bmp|gif|jpe?g"
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?
+ "|png|tiff?|mid|mp2|mp3|mp4"
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?
+ "|wav|avi|mov|mpeg|ram|m4v|pdf"
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?
+ "|rm|smil|wmv|swf|wma|zip|rar|gz))$" );

? ? ? ?
/**
? ? ? ? ?* You should implement this function to specify whether
? ? ? ? ?* the given url should be crawled or not (based on your
? ? ? ? ?* crawling logic).

crawler4j - Open Source Web Crawler for Java - Google Project Hosting


更多文章、技術交流、商務合作、聯系博主

微信掃碼或搜索:z360901061

微信掃一掃加我為好友

QQ號聯系: 360901061

您的支持是博主寫作最大的動力,如果您喜歡我的文章,感覺我的文章對您有幫助,請用微信掃描下面二維碼支持博主2元、5元、10元、20元等您想捐的金額吧,狠狠點擊下面給點支持吧,站長非常感激您!手機微信長按不能支付解決辦法:請將微信支付二維碼保存到相冊,切換到微信,然后點擊微信右上角掃一掃功能,選擇支付二維碼完成支付。

【本文對您有幫助就好】

您的支持是博主寫作最大的動力,如果您喜歡我的文章,感覺我的文章對您有幫助,請用微信掃描上面二維碼支持博主2元、5元、10元、自定義金額等您想捐的金額吧,站長會非常 感謝您的哦!??!

發表我的評論
最新評論 總共0條評論
主站蜘蛛池模板: 太仓市| 达孜县| 嘉善县| 平和县| 保定市| 泸溪县| 磐石市| 扎鲁特旗| 龙游县| 云梦县| 监利县| 永川市| 溧水县| 上犹县| 河津市| 蒲城县| 蕲春县| 德令哈市| 白银市| 双牌县| 乐亭县| 抚松县| 汕头市| 旬阳县| 赣州市| 沛县| 临湘市| 石阡县| 河西区| 嘉定区| 安义县| 长岭县| 平湖市| 肃南| 沁水县| 伊通| 西畴县| 济阳县| 泊头市| 云梦县| 柏乡县|