Apache Spark BatchのtExtractXMLFieldプロパティ
これらのプロパティは、Spark Batchジョブのフレームワークで実行されているtExtractXMLFieldを設定するために使われます。
Spark BatchのtExtractXMLFieldコンポーネントは、XMLファミリーに属しています。
このフレームワークのコンポーネントは、すべてのサブスクリプションベースのビッグデータ対応のTalend製品およびTalend Data Fabricで利用できます。
基本設定
| プロパティ | 説明 | 
|---|---|
| [Property type] (プロパティタイプ) | 
 | 
| [Schema type] (スキーマのタイプ)および[Edit schema] (スキーマを編集) | 
 | 
| XMLフィールド | 処理されるXMLフィールドの名前。 | 
| ループXPathクエリー | クエリーが基礎となっているXMLツリーのノード。 | 
| [Mapping] (マッピング) | [Column] (カラム): スキーマタイプフィールドで定義されているスキーマを反映します。 [XPath Query] (XPathクエリー): ストラクチャー化入力から抽出する項目を入力します。 [Get Nodes] (ノードを取得): このチェックボックスをオンにすると、[Xpath query] (Xpathクエリー)リストで指定されたすべての現在のノードのXMLコンテンツが回復します。また、特定のXMLノードの横にあるチェックボックスをオンにすると、選択したノードのコンテンツのみが回復します。 | 
| [Die on error] (エラー発生時に強制終了) | このチェックボックスをオンにすると、エラー発生時にジョブの実行が停止されます。 | 
詳細設定
| プロパティ | 説明 | 
|---|---|
| [Ignore the namespaces] (ネームスペースを無視) | このチェックボックスをオンにすると、XMLデータの読み取りと抽出時にネームスペースが無視されます。 | 
使用方法
| 使用方法のガイダンス | 説明 | 
|---|---|
| 使用ルール | このコンポーネントは中間ステップとして使用されます。 このコンポーネントは、所属するSpark Batchのコンポーネントのパレットと共に、Spark Batchジョブを作成している場合にだけ表示されます。 特に明記していない限り、このドキュメンテーションのシナリオでは、標準ジョブ、つまり従来の Talend Data Integrationジョブだけを扱います。 | 
| [Spark Connection] (Spark接続) |              [Run] (実行)ビューの[Spark configuration] (Spark設定)タブで、ジョブ全体でのSparkクラスターへの接続を定義します。また、ジョブでは、依存jarファイルを実行することを想定しているため、Sparkがこれらのjarファイルにアクセスできるように、これらのファイルの転送先にするファイルシステム内のディレクトリーを指定する必要があります。              
 この接続は、ジョブごとに有効になります。 |