tFileInputParquetの標準プロパティ - 7.3

Parquet

Version
7.3
Language
日本語
Product
Talend Big Data
Talend Big Data Platform
Talend Data Fabric
Talend Real-Time Big Data Platform
Module
Talend Studio
Content
ジョブデザインと開発 > サードパーティーシステム > ファイルコンポーネント > Parquet
データガバナンス > サードパーティーシステム > ファイルコンポーネント > Parquet
データクオリティとプレパレーション > サードパーティーシステム > ファイルコンポーネント > Parquet
Last publication date
2024-02-22

これらのプロパティは、標準ジョブのフレームワークで実行されているtFileInputParquetを設定するために使われます。

標準tFileInputParquetコンポーネントは、ファイルファミリーに属しています。

注: Windowsプラットフォームの場合は、このコンポーネントを使用する前に、Hadoop WinutilsMicrosoft Visual C++ 2010 Service Pack 1再頒布可能パッケージMFCのセキュリティアップデートプログラムがインストールされていることを確認してください。この2つのリンクにはインストール情報も記載されています。

このフレームワーク内のコンポーネントは、すべてのTalend製品で利用できます。

注: このコンポーネントは、TalendのR2021-08以降のStudioマンスリーアップデートをインストール済みである場合のみ利用できます。詳細は管理者にお問い合わせください。

基本設定

[Schema] (スキーマ)[Edit schema] (スキーマを編集)

スキーマとは行の説明のことです。処理して次のコンポーネントに渡すフィールド(カラム)数を定義します。Sparkジョブを作成する場合、フィールドの命名時は予約語のlineを避けます。

  • [Built-in] (組み込み): そのコンポーネントに対してのみスキーマを作成し、ローカルに保管します。

  • [Repository] (リポジトリー): スキーマは作成済みで、リポジトリーに保管されています。さまざまなプロジェクトやジョブデザインで再利用できます。

スキーマを変更するには[Edit schema] (スキーマを編集)をクリックします。
注: 変更を加えると、スキーマは自動的に組み込みになります。
  • [View schema] (スキーマを表示): スキーマのみを表示する場合は、このオプションを選択します。

  • [Change to built-in property] (組み込みのプロパティに変更): ローカルで変更を行うためにスキーマを組み込みに変更する場合は、このオプションを選択します。

  • [Update repository connection] (リポジトリー接続をアップデート): リポジトリーに保存されているスキーマに変更を加え、変更後にそのコンテンツをすべてのジョブにプロパゲートするかどうかを決める場合は、このオプションを選択します。変更を現在のジョブにのみ反映する場合は、変更後、[No] (いいえ)を選択し、[Repository Content] (リポジトリーコンテンツ)ウィンドウで再びこのスキーマのメタデータを選択します。

このコンポーネントは、ダイナミックスキーマ機能の利点を備えているので、ソースファイルから不明なカラムを取得したり、各カラムを個別にマッピングしなくてもソースからカラムを一括してコピーしたりできます。ダイナミックスキーマの詳細は、Talend Studioユーザーガイドをご覧ください。

このダイナミックスキーマ機能は、テーブルの不明なカラムを取得する目的で設計されており、この目的に限り使用をお勧めします。テーブルの作成で使用することは勧められていません。

[File name] (ファイル名)

入力ファイルや使用する変数の名前またはパス。

ジョブで変数を定義して使用する方法は、 Talend Studio ユーザーガイドをご覧ください。

警告: エラーを避けるために、このフィールドには(相対パスの代わりに)絶対パスを使用します。

[Use external Hadoop dependencies] (Hadoopの外部依存項目を使用)

このチェックボックスをオンにするとHadoopの外部依存項目が使われます。"file:///path/input.parquet"という形式に従って、[File name] (ファイル名)フィールドにパスを入力します。

詳細設定

[tStatCatcher Statistics] (tStatCatcher統計)

このチェックボックスをオンにすると、ジョブレベルやコンポーネントレベルでジョブ処理メタデータが収集されます。

グローバル変数

グローバル変数

NB_LINE: 入力コンポーネントによって読み取られた行の数、または出力コンポーネントに転送された行の数。これはAfter変数で、整数を返します。

ERROR_MESSAGE: エラーが発生した時にコンポーネントによって生成されるエラーメッセージ。これはAfter変数で、文字列を返します。この変数はコンポーネントにこのチェックボックスが存在し、[Die on error] (エラー発生時に強制終了)がオフになっている場合のみ機能します。

FILE_PATH: Boxで処理されているフォルダーまたはファイルを参照するパス。これはFlow変数で、文字列を返します。

Flow変数はのコンポーネントの実行中に機能し、After変数はコンポーネントの実行後に機能します。

フィールドまたは式に変数を入れるには、Ctrl + スペースを押して変数リストにアクセスし、リストから使用する変数を選択します。

変数の詳細は、Talend Studioユーザーガイドをご覧ください。

使用方法

使用ルール

このコンポーネントを使って、Parquetファイルからデータを取得します。また、このコンポーネントは、取得されたデータを後続のコンポーネントに渡します。