Fonctionnement d'un Job Spark Talend
Dernière mise à jour : 07/08/2026
Un Job Spark Talend génère le code du moteur Spark Batch ou Spark Streaming, suivant le type de Job sélectionné.
Un Job Spark Talend peut être exécuté dans l'un des modes et distributions suivants :
- Cloudera Data Engineering
- Cloudera Private Cloud
- Cloudera Public Cloud
- Databricks
- Databricks Serverless
- Dataproc
- EMR
- EMR Serverless
- HDInsight
- Kubernetes
- Livy Knox
- local
- Spark-submit scripts (Scripts Spark-submit)
- Standalone
- Synapse
- YARN cluster
Pour des détails sur la configuration de chaque distribution, consultez Définir les détails de connexion Spark Configuration (Configuration de Spark).
Note InformationsRemarque : Un Job Talend Spark n'est pas équivalent à un Job Spark tel que défini dans la documentation Apache Spark ; un seul Job peut générer un ou plusieurs Jobs Spark suivant la manière dont vous le concevez. Pour plus d'informations, consultez Glossaire Apache Spark (uniquement en anglais) (en anglais).
Lorsque vous exécutez le Job, des statistiques sont affichées dans l'espace de modélisation graphique pour indiquer la progression des calculs Spark.
Les informations d'exécution d'un Job Talend Spark sont enregistrées par le service HistoryServer du cluster utilisé. Pour afficher ces informations, ouvrez la console de services Web. Le nom du Job dans la console est automatiquement construit pour suivre la structure suivante : ProjectName_JobName_JobVersion, par exemple, LOCALPROJECT_wordcount_0.1.