awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descoperă cele mai bune repository-uri open source cu căutare AI.

ExploreazăCăutări recomandateAlternative open-sourceSoftware self-hostedBlogHartă site
ProiectDespreCum realizăm clasamentulPresăServer MCP
LegalConfidențialitateTermeni
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
pkwenda avatar

pkwenda/webBee

0
View on GitHub↗
193 stele·37 fork-uri·Java·MIT·3 vizualizări

WebBee

🐝 Web vertical crawler framework for fun

Features

  • Java Crawling Frameworks - DFS-based web spider.

Istoric stele

Graficul istoricului de stele pentru pkwenda/webbeeGraficul istoricului de stele pentru pkwenda/webbee

Căutare AI

Explorează mai multe repository-uri excelente

Descrie ce ai nevoie în limbaj simplu — AI-ul sortează mii de proiecte open source selectate în funcție de relevanță.

Start searching with AI

Alternative open-source pentru WebBee

Proiecte open-source similare, clasificate după numărul de funcționalități comune cu WebBee.
  • crawlscript/webcollectorAvatar CrawlScript

    CrawlScript/WebCollector

    3,091Vezi pe GitHub↗

    WebCollector is an open source web crawler framework based on Java.It provides some simple interfaces for crawling the Web,you can setup a multi-threaded web crawler in less than 5 minutes.

    Java
    Vezi pe GitHub↗3,091
  • digitalpebble/storm-crawlerAvatar DigitalPebble

    DigitalPebble/storm-crawler

    980Vezi pe GitHub↗

    A scalable, mature and versatile web crawler based on Apache Storm

    Java
    Vezi pe GitHub↗980
  • internetarchive/heritrix3Avatar internetarchive

    internetarchive/heritrix3

    3,246Vezi pe GitHub↗

    Heritrix is the Internet Archive's open-source, extensible, web-scale, archival-quality web crawler project. Heritrix (sometimes spelled heretrix, or misspelled or missaid as heratrix/heritix/heretix/heratix) is an archaic word for heiress (woman who inherits). Since our crawler seeks to collect…

    Java
    Vezi pe GitHub↗3,246
  • code4craft/webmagicAvatar code4craft

    code4craft/webmagic

    11,680Vezi pe GitHub↗

    Webmagic is a Java web crawling framework designed for building scalable automated crawlers to download and process large volumes of web pages. It functions as a distributed web crawler and dynamic content crawler, utilizing an XPath HTML parser to locate and extract specific data points from page structures. The framework distinguishes itself through its ability to handle dynamic content by rendering JavaScript and executing asynchronous requests to extract data from non-static pages. It also allows users to define and execute crawler logic via scripting languages, enabling the update of col

    Javacrawlerframeworkjava
    Vezi pe GitHub↗11,680
Vezi toate cele 12 alternative pentru WebBee→

Întrebări frecvente

Ce face pkwenda/webbee?

🐝 Web vertical crawler framework for fun

Care sunt principalele funcționalități ale pkwenda/webbee?

Principalele funcționalități ale pkwenda/webbee sunt: Java Crawling Frameworks.

Care sunt câteva alternative open-source pentru pkwenda/webbee?

Alternativele open-source pentru pkwenda/webbee includ: code4craft/webmagic — Webmagic is a Java web crawling framework designed for building scalable automated crawlers to download and process… crawlscript/webcollector — WebCollector is an open source web crawler framework based on Java.It provides some simple interfaces for crawling the… digitalpebble/storm-crawler — A scalable, mature and versatile web crawler based on Apache Storm. internetarchive/heritrix3 — Heritrix is the Internet Archive's open-source, extensible, web-scale, archival-quality web crawler project. Heritrix… norconex/collector-http — Norconex HTTP Collector. ssssssss-team/spider-flow — Spider-flow is a Java-based web crawling and data extraction platform that provides a centralized environment for…