chenying99/ScrapingSpider
业余时间开发的,支持多线程,支持关键字过滤,支持正文内容智能识别的爬虫,核心部分留给公司用。
A java crawler for infomation collection.
This repository is cataloged as part of our automated global GitHub synchronization. Full telemetry, velocity snapshots, and code summaries are scheduled for continuous enrichment.
业余时间开发的,支持多线程,支持关键字过滤,支持正文内容智能识别的爬虫,核心部分留给公司用。
Html网页正文提取
Spring Data - Solr integration
Public repository.