devj/flumebase
Continuous Streaming SQL Queries for Flume
Cascading is a feature rich API for defining and executing complex and fault tolerant data processing workflows on a Hadoop cluster.
This repository is cataloged as part of our automated global GitHub synchronization. Full telemetry, velocity snapshots, and code summaries are scheduled for continuous enrichment.
Continuous Streaming SQL Queries for Flume
Log processing system using Flume and Cassandra
Tool to help users migrate large relational databases into Hadoop clusters.
Document clustering based on Latent Semantic Analysis