Skip to content

AWS Athena Data Pipeline with Skippr

YAML for this destination lives on the connector page. There is no separate warehouses: block.

Athena runs SQL over data in S3 using the AWS Glue Data Catalog—ideal for lake-centric analytics. Skippr materializes cleaned tables and models so Athena queries stay fast and consistent.

What Skippr does here

  • Extract from 12+ sources directly into Athena
  • Deterministic schema discovery and evolution
  • Automatic data cleansing with dead letter handling
  • AI business modeling — dimensions, facts, and metrics delivered as dbt
  • Serverless SQL over S3 with Glue catalog alignment

Sample skippr.yml

yaml
data_sinks:
  warehouse:
    Athena:
      s3_bucket: my-bucket
      glue_database_name: my_database
      athena_workgroup_name: primary
      athena_results_s3_bucket: my-bucket
      region: us-east-1
      catalog: AwsDataCatalog

Full connector reference: athena.

Install: Install.