Les deux colonnes ajoutées au schéma, MyFeatures et MyLabels sont référencées ici. La formule est une syntaxe standard utilisée dans le langage de programmation R, utilisé pour le calcul de statistiques et les graphiques avancés. Pour plus d'informations, consultez The R Project (uniquement en anglais) (en anglais).
Dans l'échantillonnage de données, il y a neuf attributs et une cible. Dans la formule R ci-dessus, la cible à prédire est la conversion et se situe à gauche du tilde. Toutes les colonnes à droite du caractère tilde sont les attributs. Les deux composants restant, featuresCol et labelCol, sont des valeurs factices pour les tuples et les libellés des attributs.