你们能采集什么样的数据?_网站数据采集

任何你能在浏览器中看到的数据都可以被抓取,只是难度会有所不同。以下几点因素会使得采集工作变得困难,从而费用也将更高。

■ 限制单个IP的访问数量或访问频率。

■ 不一致的页面结构。

■ 数据被加密(或混淆)了,需要解析。

■ 数据被JavaScript动态加载。

■ 数据在Flash中展现。

■ 海量的数据(例如,数百万甚至上千万的页面)。

网站数据采集