Hadoop接続の一元化
このタスクについて
特定のHadoopディストリビューションへの接続を[Repository] (リポジトリー)でセットアップすると、同じHadoopディストリビューションを使用するたびに接続を設定する必要がなくなります。
[Hadoop cluster] (Hadoopクラスター)ノードからHDFS、HiveなどHadoopの個々のエレメントへの接続を作成する前に、Hadoopの接続を定義する必要があります。
-
Studio Talendがインストールされているクライアントマシンが、使用するHadoopクラスターのノードのホスト名を認識できることを確認する必要があります。そのためには、そのHadoopクラスターのサービスに使用するIPアドレス/ホスト名のマッピングエントリーをクライアントマシンのhostsファイルに追加します。
たとえば、Hadoopネームノードサーバーのホスト名がtalend-cdh550.weave.localで、IPアドレスが192.168.x.xの場合、マッピングエントリーは192.168.x.x talend-cdh550.weave.localとなります。
-
使用するHadoopクラスターが正しく構成され、実行されています。
-
Integrationパースペクティブがアクティブであること。
-
StudioからMapRに接続する場合は、Studioと同じマシンにMapRクライアントがインストールされており、MapRクライアントのライブラリーがそのマシンのPATH変数に追加されていることを確認します。MapRのドキュメンテーションによると、各OSバージョンに対応するMapRクライアントのライブラリーは、MAPR_INSTALL\/hadoop\hadoop-VERSION/lib/nativeにあるとされています。たとえば、Windows版のライブラリーは、\lib\native\MapRClient.dllにあるMapRクライアントのjarファイルにあります。詳細は、MapRのドキュメンテーション (英語のみ)をご覧ください。
[Repository] (リポジトリー)でHadoop接続を作成するには、以下のようにします:
手順
このページは役に立ちましたか?
このページまたはコンテンツに、タイポ、ステップの省略、技術的エラーなどの問題が見つかった場合は、お知らせください。改善に役立たせていただきます。