Création de jeux de données à partir d'un projet de pipeline | Aide Qlik Cloud
Accéder au contenu principal

Création de jeux de données à partir d'un projet de pipeline

Last updated: 01/09/2026
Note InformationsVous avez besoin de l'un des abonnements suivants :
  • Qlik Talend Cloud Enterprise
  • Qlik Talend Cloud Premium
  • Qlik Cloud Analytics - Premium
  • Qlik Cloud Analytics Enterprise
  • Qlik Sense Enterprise SaaS

Pour le moment, les types supportés pour le calcul de la qualité sont CSV, TXT, Parquet, QVD, XLS et XLSX, dans les limites suivantes :

  • CSV/TXT jusqu'à 1 Go
  • Parquet jusqu'à 1 Go
  • QVD jusqu'à 1 Go
  • XLS/XLSX jusqu'à 100 Mo

Pour les fichiers Parquet, la qualité des données est supportée uniquement pour les schémas plats. Les champs imbriqués (LIST, MAP, STRUCT) ne sont pas supportés.

La qualité des données n'est pas supportée pour les jeux de données basés sur des fichiers qui dépassent ces limites. Si votre fichier Excel contient plusieurs feuilles, le calcul de la qualité sera effectué uniquement sur la première feuille.

  1. Dans Qlik Talend Data Integration > Connexions, cliquez sur Créer une connexion.

  2. Configurez votre accès à la base de données via les informations d'identification d'un utilisateur disposant d'autorisations suffisantes et accédez aux tables à importer.

  3. Dans Qlik Cloud Analytics, cliquez sur Créer, puis sur Connexion de données.

  4. Configurez votre accès à la même base de données que précédemment via les informations d'identification du même utilisateur, dans l'idéal, ou d'un utilisateur qui dispose au moins des autorisations READ (Accès en lecture) sur les tables.

  5. (Pour Snowflake uniquement) Dans le champ Rôle, vous devez saisir un rôle correspondant à un rôle existant créé dans la base de données Snowflake et qui a les privilèges suivants sur ces objets.

    • USAGE sur WAREHOUSE

    • USAGE sur DATABASE

    • USAGE sur SCHEMA

    • CREATE TABLE sur SCHEMA

    • CREATE FUNCTION sur SCHEMA

    • CREATE VIEW sur SCHEMA

    • SELECT sur TABLE

  6. (pour Databricks uniquement) Dans Databricks, vous devez définir les privilèges suivants sur la base de données :

    • CREATE TABLE

    • CREATE VOLUME

    • MODIFY

    • READ VOLUME

    • SELECT

    • USE SCHEMA

    • WRITE VOLUME

  7. De retour sur la page d'accueil Qlik Talend Data Integration, cliquez sur Créer, puis sur Projet de pipeline.

  8. Utilisez votre connexion de l'étape 2 comme source pour votre projet et commencez à créer votre pipeline. Consultez Création et gestion de projets de pipeline de données pour plus d'informations.

  9. À tout moment dans votre pipeline, sélectionnez une tâche de données, accédez à Paramètres, puis à l'onglet Catalogue dans lequel vous pouvez cocher la case Publier dans le Catalogue.

    Cela signifie que cette version du jeu de données sera publiée dans le Catalogue une fois le projet de pipeline préparé et exécuté. Il est également possible de cocher cette option au niveau du projet.

  10. Exécutez votre projet de données.

Après l'exécution de votre projet de pipeline, le nouveau jeu de données est ajouté au Catalogue et vous pourrez accéder aux indicateurs de qualité et à davantage de détails sur son contenu. Cette configuration permet aussi d'utiliser les jeux de données comme source pour des applications analytiques.

Vous pouvez ajouter autant de jeux de données que nécessaire avant de créer votre produit de données. Étant donné que le Catalogue est accessible depuis le hub Qlik Talend Data Integration et depuis le hub Qlik Cloud Analytics Services, vous pouvez ouvrir vos jeux de données à l'emplacement de votre choix et la bonne connexion sera utilisée suivant le contexte.

Cette page vous a-t-elle aidé ?

Si vous rencontrez des problèmes sur cette page ou dans son contenu – une faute de frappe, une étape manquante ou une erreur technique – faites-le-nous savoir.