类 Crawler
- java.lang.Object
-
- xin.jiangqiang.core.entities.Crawler
-
- 所有已实现的接口:
Serializable,HttpConfig<Crawler>
- 直接已知子类:
Page
public class Crawler extends Object implements Serializable, HttpConfig<Crawler>
- 另请参阅:
- 序列化表格
-
-
方法概要
所有方法 实例方法 具体方法 修饰符和类型 方法 说明 CrawleraddBodys(String key, String value)CrawleraddHeaders(String key, String value)CrawleraddLines(String key, String value)CrawleraddSeed(String url)创建时子类爬虫深度会自动+1voidaddSeeds(Collection<String> urls, String type)批量创建子爬虫,批量设置子类类型booleanequals(Object o)Map<String,String>getBodys()StringgetData(String key)Map<String,String>getDataMap()Map<String,String>getHeaders()Map<String,String>getLines()Map<String,String>getMetaData(String key)获取参数inthashCode()CrawlerinitDataFromCrawler(Crawler crawler)1.CrawlerinitFromGlobConfig(HttpConfig<?> config)CrawlersetData(String key, String value)快捷的从dataMap中操作数据CrawlersetDataMap(Map<String,String> dataMap)存储数据,此集合中的数据会继承父级种子,但是修改子爬虫数据不会影响父爬虫数据voidsetMetaData(String key, Map<String,String> map)设置参数-
从接口继承的方法 xin.jiangqiang.core.interfaces.HttpConfig
getHttpConfig, getUseProxy
-
-
-
-
方法详细资料
-
initDataFromCrawler
public Crawler initDataFromCrawler(Crawler crawler)
1. 从crawler构造Page对象,发送请求之后是Page对象,请求前是Crawler对象 2. 将Page中的元数据复制到Next对象- 参数:
crawler- 种子对象,后续爬虫会继承他的设置- 返回:
- 返回调用此方法的对象
-
addSeeds
public void addSeeds(Collection<String> urls, String type)
批量创建子爬虫,批量设置子类类型- 参数:
urls- url列表type- 类型
-
initFromGlobConfig
public Crawler initFromGlobConfig(HttpConfig<?> config)
-
getHeaders
public Map<String,String> getHeaders()
- 指定者:
getHeaders在接口中HttpConfig<Crawler>
-
addHeaders
public Crawler addHeaders(String key, String value)
- 指定者:
addHeaders在接口中HttpConfig<Crawler>
-
setDataMap
public Crawler setDataMap(Map<String,String> dataMap)
存储数据,此集合中的数据会继承父级种子,但是修改子爬虫数据不会影响父爬虫数据- 参数:
dataMap-- 返回:
-
-