66 repos across 4 sub-areas
Relational and analytical database systems, query engines, and data warehouse tools spanning multiple languages and deployment models. This cluster covers in-process databases (H2, DuckDB), distributed analytics platforms (Snowflake connectors), columnar storage systems, and SQL query processing infrastructure. Developers exploring this space will find both traditional SQL databases and modern OLAP engines, with a focus on data processing, analytics workloads, and SQL compatibility across different execution contexts.
Embedded and Distributed SQL Databases
31 repos
Libraries and systems for building high-performance SQL databases, with emphasis on embedded implementations (like better-sqlite3 and DuckDB) and distributed query processing. The cluster spans multiple languages (Python, Go, Rust) and covers both OLAP analytics engines and traditional relational databases, including specialized tools like sqllogictest for database testing and memory-caching layers. This represents the intersection of modern database architecture, in-process data systems, and analytical SQL workloads.
SQL Database Connectors and Drivers
13 repos
Libraries and drivers for connecting applications to SQL and columnar databases across multiple programming languages. The cluster spans JDBC drivers for Java (Snowflake, Presto/Trino, ClickHouse), ADO.NET connectors for .NET, and Ruby/Python clients, enabling data querying and integration with data warehouses and analytics platforms. This represents the connector layer that abstracts database protocol details and provides idiomatic APIs for different runtime environments.
SQL databases and analytics engines
12 repos
Open-source relational databases and query engines optimized for analytical workloads, with a focus on in-process and distributed SQL execution. The cluster centers on systems like DuckDB and CockroachDB, alongside benchmarking tools (TPC-DS Kit, Join Order Benchmark) and time-series databases like TimescaleDB. Most repos are written in C++ or C and emphasize SQL compatibility, query optimization, and cloud-native deployment patterns.
SQL databases and query engines
10 repos
Relational databases, SQL query engines, and distributed data systems built primarily in Java. This cluster encompasses both embedded databases like H2 and distributed query processors like Phoenix and Hive, along with SQL abstraction layers like Slick and query rewriting frameworks. The repositories reflect a focus on SQL compilation, query optimization, JDBC connectivity, and scaling SQL workloads across large datasets.