# apache/cassandra-spark-connector

Apache Spark to Apache Cassandra connector

Repository: https://github.com/apache/cassandra-spark-connector
Canonical: https://ross.abutalabs.com/products/cassandra-spark-connector
Homepage: https://apache.github.io/cassandra-spark-connector/
Language: Scala
License: Apache-2.0
License Family: permissive
Topics: cassandra, scala, spark
Last push: 2025-04-29T09:28:59+00:00

## Health v2 (maintenance only)
Score: 31/100 (v2, computed 2026-09-02T17:46:02.011165+00:00)
- activity 19, release rhythm 8, longevity 100
- inputs: {"age_days": 4450, "days_push": 491, "days_rel": null, "gap_med": null, "n_releases_24m": 0}
- flags: none
- formula: round(0.45*activity + 0.35*rhythm + 0.20*longevity); archived -> min(score, 10)

## Adoption (not part of the score)
Stars 1954, forks 930 (observed 2026-08-28T04:05:58.901154+00:00)

## What it is
The official Apache Spark connector for Apache Cassandra, letting Spark applications read Cassandra tables as RDDs and DataFrames, write them back, and run arbitrary CQL queries. It supports Cassandra 2.1+, Spark 1.0-3.5, and recent versions add vector type support for AI/RAG workloads.

## Use cases
- read cassandra tables as spark dataframes
- write spark rdds to cassandra
- run cql queries from spark applications
- join spark data with cassandra data
- process cassandra vector data for RAG pipelines
- partition spark rdds by cassandra replica

## When to choose
- your Spark job needs to read or write Cassandra at scale
- you want server-side filtering via CQL WHERE clauses in Spark
- you need Cassandra vector type support for AI workloads

## When to avoid
- you use a database other than Cassandra
- you need a pure OLTP client without Spark
- your Spark or Cassandra versions fall outside the compatibility matrix

## Facets
- artifact type: library
- maturity: active
- function: database-driver, etl, streaming
- domain: databases, big-data, microservices
- platform: jvm, python
- tags: spark, cassandra, rdd, dataframe, cql, vector-search, data-engineering

## Member repositories
- apache/cassandra-spark-connector (main) score 31

## Provenance
- Observed fields: from GitHub, fetched 2026-08-28T04:05:58.901154+00:00.
- Health v2: computed from the inputs above; adoption is never an input.
- Inferred fields (summary, facets, guidance): AI-extracted, prompt v1, taxonomy v1, on 2026-08-30T03:06:32.225944+00:00, confidence not recorded.
  - readme: https://github.com/apache/cassandra-spark-connector (fetched 2026-08-28T04:05:58.901154+00:00, sha d7a4d6c8a4a9)
  - homepage: https://apache.github.io/cassandra-spark-connector/ (fetched 2026-08-29T10:46:06.071339+00:00, sha f1dafa89d9c9)
- Data as of 2026-08-30T08:39:29.467469+00:00.
