A full-stack Search Engine built for a Big Data course project. It scrapes over 200K articles, stores them in HDFS, and builds an inverted index using MapReduce. Designed to demonstrate scalable data processing, distributed storage, and basic information retrieval over large datasets.
typescriptdatabasepagerankhdfsinverted-indexentityframeworkwebscrapingtailwindcssmapreduce-algorithm
-
Updated
May 10, 2025 - Python