Apache Spark BatchのtHBaseDeleteRowsプロパティ
これらのプロパティは、Spark Batchジョブのフレームワークで実行されているtHBaseDeleteRowsを設定するために使われます。
Spark BatchのtHBaseDeleteRowsコンポーネントは、データベースファミリーに属しています。
このフレームワークのコンポーネントは、すべてのサブスクリプションベースのビッグデータ対応のTalend製品およびTalend Data Fabricで使用できます。
基本設定
[Storage Configuration] (ストレージ設定) |
使用するSparkシステムにHBaseに接続するための設定情報を読み取らせるtHBaseConfigurationコンポーネントを選択します。 |
[Property type] (プロパティタイプ) |
[Built-in] (組み込み)と[Repository] (リポジトリー)のいずれかです。 [Built-In] (組み込み): 一元的に保存されるプロパティデータはありません。 [Repository] (リポジトリー): プロパティが保存されているリポジトリーファイルを選択します。 |
[Table name] (テーブル名) |
行を削除するHBaseテーブルの名前を入力します。このテーブルは既に存在するものでなければなりません。 |
[Row key column] (行のキーカラム) |
ドロップダウンリストでカラムを選択します。このカラムはHBaseテーブルの行のキーカラムとして使われます。 |
[Custom Row Key] (カスタム行キー) |
カスタマイズ行キーを使用する場合は、このチェックボックスを選択します。オンにすると、対応するフィールドが表示されます。作成するHBaseテーブルの行をインデックス化するためのユーザー定義の行キーを入力します。 たとえば、"France"+Numeric.sequence("s1",1,1)と入力して一連の行キーを生成します: France1、France2、France3など。 |
[Die on Hbase errors] (HBaseエラー発生時に強制終了) | このオプションを選択すると、HBaseエラー発生時にジョブの実行を停止できます。 |
グローバル変数
グローバル変数 |
ERROR_MESSAGE: エラーが発生した時にコンポーネントによって生成されるエラーメッセージ。これはAfter変数で、文字列を返します。この変数はコンポーネントにこのチェックボックスが存在し、[Die on error] (エラー発生時に強制終了)がオフになっている場合のみ機能します。 Flow変数はのコンポーネントの実行中に機能し、After変数はコンポーネントの実行後に機能します。 フィールドまたは式に変数を入力する場合は、Ctrl + スペースを押して変数リストにアクセスし、使用する変数を選択します。 変数の詳細は、コンテキストと変数を使用をご覧ください。 |
使用方法
使用ルール |
このコンポーネントはスタンドアロンコンポーネントとして使用できます。 |
[Spark Connection] (Spark接続) |
[Run] (実行)ビューの[Spark configuration] (Spark設定)タブで、ジョブ全体でのSparkクラスターへの接続を定義します。また、ジョブでは、依存jarファイルを実行することを想定しているため、Sparkがこれらのjarファイルにアクセスできるように、これらのファイルの転送先にするファイルシステム内のディレクトリーを指定する必要があります。
この接続は、ジョブごとに有効になります。 |