tExtractDelimitedFields 標準プロパティ
これらのプロパティは、標準ジョブのフレームワークで実行されているtExtractDelimitedFieldsを設定するために使われます。
標準のtExtractDelimitedFieldsコンポーネントは、変換処理ファミリーに属しています。
このフレームワーク内のコンポーネントは、すべてのTalend製品で利用できます。
基本設定
[Field to split] (分割するフィールド) |
[Field to split] (分割するフィールド)リストから分割する受信フィールドを選択します。 |
[Ignore NULL as the source data] (ソースデータとしてNULLを無視する) |
ソースデータのNull値を無視するには、このチェックボックスをオンにします。 ソースデータのNull値に対応するNullレコードを生成するには、このチェックボックスをオフにします。 |
[Field separator] (フィールド区切り) |
転送されたデータのフィールドを区切る場合は、文字、文字列、正規表現のいずれかを入力します。 情報メモ注:
このコンポーネントは、正規表現を使用してファイルを分割し、正規表現の構文では特殊文字を演算子として使用するため、フィールドの区切り文字として使用する正規表現演算子の前に二重バックスラッシュを付けてください。たとえば、「|」ではなく「\\ |」を使用する必要があります。 |
[Die on error] (エラー発生時に強制終了) |
エラーの発生した行をスキップし、エラーが発生していない行の処理を完了するには、このチェックボックスをオフにします。エラーをスキップしたら、[Row] (行)> [Reject] (リジェクト)リンクを使用してエラーの発生した行を収集できます。 |
[Schema] (スキーマ)と[Edit Schema] (スキーマを編集) |
スキーマとは行の説明のことです。処理して次のコンポーネントに渡すフィールド(カラム)数を定義します。Sparkジョブを作成する場合、フィールドの命名時は予約語のlineを避けます。 スキーマを変更するには[Edit schema] (スキーマを編集)をクリックします。現在のスキーマがリポジトリータイプの場合は、3つのオプションを利用できます。
ジョブで接続している先行コンポーネントからスキーマを取得するためには、[Sync columns] (カラムを同期)をクリックします。 |
|
[Built-in] (組み込み): そのコンポーネントに対してのみスキーマを作成し、ローカルに保管します。 |
|
[Repository] (リポジトリー): スキーマは作成済みで、リポジトリーに保管されています。さまざまなプロジェクトやジョブデザインで再利用できます。 |
詳細設定
[Advanced separator (for number)] (高度な区切り文字:数値) |
数値に使用する区切りを変更する場合は、このチェックボックスを選択します。デフォルトでは、桁区切りはコンマ(,)で、小数点区切りはピリオド(.)です。 |
[Trim column] (カラムをトリミング) |
このチェックボックスをオンにすると、先行ホワイトスペースおよび後続ホワイトスペースがすべてのカラムから削除されます。 |
[Check each row structure against schema] (スキーマに対して各行ストラクチャーをチェック) |
このチェックボックスを選択すると、各行のカラム総数がスキーマと一致するかどうかチェックされます。一致しない場合、コンソール上にエラーメッセージが表示されます。 |
[Validate date] (データの検証) |
このチェックボックスを選択すると、日付形式が入力スキーマに対して厳密にチェックされます。 |
[tStatCatcher Statistics] (tStatCatcher統計) |
このチェックボックスを選択すると、ジョブレベルおよび各コンポーネントレベルで処理メタデータが収集されます。 |
グローバル変数
グローバル変数 |
ERROR_MESSAGE: エラーが発生した時にコンポーネントによって生成されるエラーメッセージ。これはAfter変数で、文字列を返します。この変数はコンポーネントにこのチェックボックスが存在し、[Die on error] (エラー発生時に強制終了)がオフになっている場合のみ機能します。 NB_LINE: 入力コンポーネントによって読み取られた行の数、または出力コンポーネントに転送された行の数。これはAfter変数で、整数を返します。 Flow変数はのコンポーネントの実行中に機能し、After変数はコンポーネントの実行後に機能します。 フィールドまたは式に変数を入れるには、Ctrl + スペースを押して変数リストにアクセスし、リストから使用する変数を選択します。 変数の詳細は、Talend Studioユーザーガイドをご覧ください。 |
使用方法
使用ルール |
このコンポーネントは、データの流れを処理するため、入力および出力コンポーネントが必要です。これにより、Row > Mainリンクを使用して区切り付きフィールドからデータを抽出ができ、また、定義済みタイプと一致しないタイプの拒否フローフィルタリングデータを作成できます。 |