A full-stack Search Engine built for a Big Data course project. It scrapes over 200K articles, stores them in HDFS, and builds an inverted index using MapReduce. Designed to demonstrate scalable data processing, distributed storage, and basic information retrieval over large datasets.
typescript database pagerank hdfs inverted-index entityframework webscraping tailwindcss mapreduce-algorithm
-
Updated
May 10, 2025 - Python