Distributed, masterless, high performance, fault tolerant data processing. Written entirely in Clojure.
Directory
Search results
Published directory entries matching your search.
Bring multiple data streams into one dashboard.
Cleansing, pre-processing, feature engineering, exploratory data analysis and easy ML with PySpark backend.
Pachyderm is a version control system for data.
Analyzes structured data and helps produce queries, insights or visualizations.
A Techie Tech Blog on Master Data Management And Every Buzz Surrounding It.
Materials and IPython notebooks for "Python for Data Analysis" by Wes McKinney, published by O'Reilly Media.
Tm and are the main packages for managing, analyzing, and visualizing textual data.
A self-organizing data hub with S3 support.
Open source GPU accelerated data science libraries.
Julia package for loading many of the data sets available in R.
A javascript library containing a collection of least squares fitting methods for finding a trend in a set of data.
Analyzes structured data and helps produce queries, insights or visualizations.
Analyzes structured data and helps produce queries, insights or visualizations.
High performance distributed data processing in NodeJS.
Analyzes structured data and helps produce queries, insights or visualizations.
A system for quickly generating training data with weak supervision.
Self Organizing Map written in Python (Uses neural networks for data analysis).
Spark is a fast and general engine for large-scale data processing.
Analyzes structured data and helps produce queries, insights or visualizations.
A blog with resources for data science learners.
A data exploration platform designed to be visual, intuitive, and interactive.
Analyzes structured data and helps produce queries, insights or visualizations.
Analyzes structured data and helps produce queries, insights or visualizations.