Template repository for data science lifecycle project.
Directory
Search results
Published directory entries matching your search.
Data Version Control - Git for Data & Models - ML Experiments Management.
A lightweight set of tools for loading and sharing data in data science projects.
Open-source project that applies AI to data analysis, extraction, visualization, or business intelligence.
Pandas API on Apache Spark. Makes data scientists more productive when interacting with big data.
Fast and easy data exploration by automating the visualization and data analysis process.
MeTA: ModErn Text Analysis is a C++ Data Sciences Toolkit that facilitates mining big text data.
CLI tool that allows you to build data profiles and write assertion tests for easily evaluating and tracking your data's reliability over time.
Open-source project that applies AI to data analysis, extraction, visualization, or business intelligence.
Open-source project that applies AI to data analysis, extraction, visualization, or business intelligence.
Open-source project that applies AI to data analysis, extraction, visualization, or business intelligence.
Analyzes structured data and helps produce queries, insights or visualizations.
Open-source project that applies AI to data analysis, extraction, visualization, or business intelligence.
Open-source project that applies AI to data analysis, extraction, visualization, or business intelligence.
Analyzes structured data and helps produce queries, insights or visualizations.
CPU and GPU-accelerated matrix library intended to support large-scale exploratory data analysis.
NumPy and Pandas interface to Big Data.
Lightweight, extensible data validation library for Python.
Open-source project that applies AI to data analysis, extraction, visualization, or business intelligence.
Open-source project that applies AI to data analysis, extraction, visualization, or business intelligence.
Read files from Stata, SAS, and SPSS.
A library to compare Pandas, Polars, and Spark data frames. It provides stats and lets users adjust for match accuracy.
Reproducible data setup for reproducible science.
Library for working with tabular data in Julia.