#etl

15 tools curated in this category — including Supernova, Miller, HFlow

tech

Find on mySelectas all sites and tools related to etl. This selection of 15 resources is reviewed and maintained by the community. The most popular include Supernova, Miller, HFlow. Each tool comes with a review, tags, comparisons and alternatives to help you make the best choice.

15 tools
SupernovaNew
Data & Analytics🌐 EN

Syncs Stripe, HubSpot, Postgres, and 40+ other business tools into one encrypted data lake you can query directly from Claude or Codex, without waiting on engineers or building a BI stack.

#data-warehouse#analytics#etl#business-intelligence
supernova.ai
📄 Full details →
👥 Target audience

Startups et scale-ups sans équipe data dédiée, équipes produit voulant interroger leurs données via Claude/Codex

🌍 Target countries

International

🗣️ Available languages
EN
🔄 Alternatives
Snowflake + LookerBigQuery + MetabaseConsultant data indépendant
🔗 Visit Supernova
MillerNew
Data & Analytics🌐 EN

A command-line tool that does to CSV, TSV and JSON what awk and sed do to plain text — filter, reshape and transform tabular data without spinning up a Python script.

#free#etl#cli#open-source#data-engineering
github.com
📄 Full details →
👥 Target audience

Ingénieurs DevOps, ingénieurs et scientifiques data, développeurs faisant de l'ETL, du traitement de logs ou du post-traitement de bases de données

🌍 Target countries

International (projet open source)

🗣️ Available languages
EN
🔄 Alternatives
awkpandasjqR
🔗 Visit Miller
HFlowNew
AI & Machine Learning🌐 EN

An open-source SDK for building robotics data pipelines, managing the collection-to-delivery lifecycle of multimodal sensor data with quality checks and full provenance tracking, backed by Y Combinator.

#machine-learning#open-source#data-engineering#orchestration#etl
github.com
📄 Full details →
👥 Target audience

Équipes robotique, labs de modèles fondation Physical AI, ingénieurs ML construisant des pipelines de données à grande échelle

🌍 Target countries

Worldwide

🗣️ Available languages
EN
🔄 Alternatives
Apache AirflowDVCPachydermPrefectKubeflow
🔗 Visit HFlow
Decode GA4New
Data & Analytics🌐 EN

Decode GA4 automatically flattens Google Analytics 4's nested BigQuery export data into clean, ready-to-query tables, with usage-based pricing and no subscription.

#data-engineering#etl#analytics#web-analytics
decodedata.io
📄 Full details →
👥 Target audience

Data engineers, analytics engineers et analystes travaillant avec les données GA4 dans BigQuery

🌍 Target countries

Mondial

🗣️ Available languages
EN
🔄 Alternatives
dbt (modèles SQL maison)FivetranRequêtes BigQuery manuelles (UNNEST)
🔗 Visit Decode GA4
Datatera.ai
Data & Analytics🌐 EN

Feed it a messy pile of PDFs, invoices or web pages and Datatera.ai turns them into clean, structured spreadsheet or CRM records — with an audit trail so a finance or legal team can trust where each number came from.

#etl#web-scraping#web-app#data-engineering#ai
datatera.ai
📄 Full details →
👥 Target audience

Équipes finance, juridique et opérations qui traitent un volume significatif de documents non structurés et ont besoin d'une piste d'audit sur les données extraites

🌍 Target countries

Marché anglophone/international, entreprise basée à Barcelone et San Francisco

🗣️ Available languages
EN
🔄 Alternatives
Import.ioOctoparseApify
🔗 Visit Datatera.ai
Quix
Data & Analytics🌐 EN

A streaming data platform, built by the people behind McLaren's Formula 1 data systems, that connects sensor data from R&D, testing, and production into one live feed instead of three disconnected systems.

#analytics#open-source#data-engineering#etl#python
quix.io
📄 Full details →
👥 Target audience

Équipes d'ingénierie automobile, aéronautique, énergie et manufacture testant du matériel physique avec des données capteurs haute fréquence

🌍 Target countries

International

🗣️ Available languages
EN
🔄 Alternatives
Apache Kafka auto-géréConfluentAWS IoT Analytics
🔗 Visit Quix
Inkspan
Web Development & Frameworks🌐 EN

A single API that handles the whole messy world of PDFs for you — generating them, merging or splitting them, pulling structured data out of them, even translating them — so you don't have to stitch together five different libraries to do document work.

#api#backend-as-a-service#ai#etl#llm
inkspan.dev
📄 Full details →
👥 Target audience

Développeurs et équipes produit ayant besoin de génération, manipulation, extraction ou traduction de documents via API

🌍 Target countries

International

🗣️ Available languages
EN
🔄 Alternatives
PDF.coDocSpringNutrient (ex-PSPDFKit)Combinaison de librairies open-source (pdf-lib, Tesseract, DeepL API)
🔗 Visit Inkspan
Definite
Data & Analytics🌐 EN

An all-in-one data platform that replaces a Fivetran + Snowflake + dbt + Looker stack with a single tool for ingesting, storing, and querying business data, plus an AI analyst that answers questions in plain English.

#data-warehouse#saas#etl#business-intelligence#data-engineering
definite.app
📄 Full details →
👥 Target audience

Startups, PME et équipes financières/RevOps sans data engineer dédié

🌍 Target countries

International

🗣️ Available languages
EN
🔄 Alternatives
Fivetran + Snowflake + dbt + Looker (stack séparée)HexMetabase
🔗 Visit Definite
Tower
Data & Analytics🌐 EN

A Python-native orchestration platform for running data pipelines, dbt workflows, and AI agents on either serverless or self-hosted infrastructure.

#python#data-engineering#devops#etl#ai-agents
tower.dev
📄 Full details →
👥 Target audience

Équipes data, services IA, industries manufacturières, e-commerce, cabinets de conseil data construisant des plateformes data internes.

🌍 Target countries

Worldwide

🗣️ Available languages
EN
🔄 Alternatives
AirbyteFivetrandbt CloudPrefectDagster
🔗 Visit Tower
Polytomic
Data & Analytics🌐 EN

Data-syncing platform that moves data both ways between a company's warehouse and the everyday tools (Salesforce, Google Sheets, Stripe) that teams actually work in.

#data-warehouse#etl#integrations#data-engineering#self-hostable
polytomic.com
📄 Full details →
👥 Target audience

Data teams | RevOps and marketing teams | Support teams at high-growth companies and enterprises needing two-way data sync

🌍 Target countries

Worldwide

🗣️ Available languages
EN
🔄 Alternatives
HightouchFivetranCensus
🔗 Visit Polytomic
Kleene.ai
Data & Analytics🌐 EN

A data platform that pulls data from 200+ sources into a warehouse and lets you query it in plain English via an AI assistant.

#etl#ai#data-warehouse#llm#analytics
kleene.ai
📄 Full details →
👥 Target audience

SMBs and enterprises with lean data teams (finance, marketing, ops) needing pipelines without a dedicated data engineer

🌍 Target countries

Worldwide

🗣️ Available languages
EN
🔄 Alternatives
FivetranAirbyteStitchdbt plus a BI tool
🔗 Visit Kleene.ai
Tonic.ai
Data & Analytics🌐 EN

Generates realistic fake versions of your production data — same shape and statistics, no real customer information — so developers can test against data that looks real without ever touching actual user records.

#database#enterprise#api#etl#data-engineering
tonic.ai
📄 Full details →
👥 Target audience

Équipes d'ingénierie et data ayant besoin de données de test réalistes sans exposer de données réelles

🌍 Target countries

Monde

🗣️ Available languages
EN
🔄 Alternatives
Gretel (racheté par NVIDIA)K2viewManual data masking scripts
🔗 Visit Tonic.ai
Artie
Data & Analytics🌐 EN

Fully-managed change-data-capture platform that streams database changes into data warehouses in real time, without building Kafka/Debezium pipelines yourself.

#data-warehouse#etl#integrations#database#data-engineering
artie.com
📄 Full details →
👥 Target audience

Data engineering and platform teams needing real-time database-to-warehouse replication | Analytics and AI teams that need fresh data without building CDC infrastructure

🌍 Target countries

Worldwide

🗣️ Available languages
EN
🔄 Alternatives
FivetranAirbyteDebezium (self-hosted)AWS DMSConfluent
🔗 Visit Artie