← Vue d’ensemble

Connecteurs

Branchez toutes vos sources, sans exposer un identifiant

graal se connecte à vos bases, à vos fichiers, à vos API et à votre patrimoine Hadoop depuis votre propre infrastructure. L’identifiant est un secret chiffré, que la connexion référence : il ne s’écrit ni dans le code, ni dans les journaux, ni dans ce que vous exportez.

Illustration de l’interface

Capacités clés

Une connexion déclarée une fois, utilisée partout

Bases relationnelles

PostgreSQL, Oracle, SQL Server, MySQL et MariaDB, en lecture comme en écriture. Les pilotes sont livrés dans les images d’exécution : rien à installer sur un poste.

Fichiers et stockage objet

CSV, Parquet, JSON, Excel et Avro, sur tout stockage compatible S3 ou sur un serveur SFTP.

API REST

Le connecteur gère la pagination et l’authentification par secret. Un run n’appelle que les hôtes que vous avez autorisés.

Hadoop et Hive

HDFS et le métastore Hive, y compris sous Kerberos : la keytab est un secret du projet. Vos tables Hive passent en Iceberg à votre rythme.

Fichiers SAS

Les tables .sas7bdat se lisent directement dans un pipeline, sans licence SAS.

Capture des changements

Insertions, mises à jour et suppressions de vos bases sont suivies en continu (CDC) et versées dans vos tables Iceberg.

Comment ça marche

De la source au jeu de données

  1. Étape 01

    Déclarer

    Vous choisissez le type de source, l’hôte et le secret à utiliser. Le secret est chiffré au repos et partagé au niveau du projet.

  2. Étape 02

    Tester

    graal ouvre la connexion depuis votre cluster, détecte le schéma et affiche un aperçu des premières lignes.

  3. Étape 03

    Utiliser

    La même connexion sert aux pipelines, aux jobs, aux notebooks et au SQL, sous les droits du projet.

Un identifiant ne voyage jamais en clair

Quand un pipeline lit une base, le code qu’il produit ne contient pas le mot de passe : il contient une référence au secret. graal résout cette référence au moment du run, dans le conteneur d’exécution, et la valeur ne s’inscrit ni dans la définition du conteneur ni dans ses journaux. Le code que vous exportez reste ainsi partageable, relisible et versionnable.

Le trafic part de chez vous

Les connexions s’ouvrent depuis votre cluster vers vos sources. Aucun service intermédiaire ne relaie vos données, et chaque run ne joint que les destinations autorisées pour lui : une base, un bucket, l’hôte d’une API. Le reste du réseau lui est fermé.

Standards et intégrations

Des protocoles standard, rien de propriétaire

  • JDBC
  • PostgreSQL
  • Oracle
  • SQL Server
  • MySQL
  • MariaDB
  • S3
  • SFTP
  • REST
  • HDFS
  • Hive
  • Kerberos
  • CSV
  • Parquet
  • JSON
  • Avro
  • SAS7BDAT

Gouvernance

Des secrets qui restent à leur place

  • Secrets chiffrés au repos (AES-GCM), jamais réaffichés en clair après leur création
  • Une connexion appartient à un projet et en suit les droits
  • Chaque création, modification et utilisation d’une connexion figure au journal d’audit

Questions fréquentes

Faut-il ouvrir des flux vers l’extérieur ?

Non. graal se connecte depuis votre infrastructure vers vos sources. Pour une API externe, vous autorisez explicitement son hôte, et seul ce flux s’ouvre.

Le mot de passe apparaît-il dans le code généré ?

Non. Le code d’un pipeline contient une référence au secret, résolue au moment du run. Le code exporté se partage donc sans risque.

Pouvons-nous garder notre cluster Hadoop ?

Oui. graal lit HDFS et Hive, Kerberos compris, et vous migrez vers Iceberg table par table, sans date butoir.

Nos programmes SAS sont-ils repris ?

Les tables .sas7bdat se lisent directement. Les programmes SAS s’exécutent comme des jobs, décrits sur la page Orchestration.

Branchez votre première source

Une base, un bucket, un aperçu des données : c’est la première étape de la démonstration.