---
title: クラウドデータソースの管理
description: この記事では、クラウドデータソースを管理する方法について説明します。
url: https://docs.tealium.com/ja/server-side/data-sources/cloud-data/manage/
---
## サポートされているベンダー

クラウドデータソースの構成は、ほとんどのベンダーで同じです。ベンダー固有の構成の詳細については、以下を参照してください：

* [Amazon Redshift](https://docs.tealium.com/amazon-redshift-cloud-data-source/)
* [Databricks](https://docs.tealium.com/databricks-cloud-data-source/)
* [Google BigQuery](https://docs.tealium.com/google-bigquery-cloud-data-source/)
* [Snowflake](https://docs.tealium.com/about-snowflake-cloud-data-source/)

## クラウドデータソースの作成

クラウドデータソースを作成するには、以下の手順を使用します：

1. **Connect > Data Sources** に移動します。
1. **+ Add Data Source** をクリックします。
1. **Categories** の下で **Data Warehouse** をクリックし、ベンダーを選択します。
1. **Name** フィールドに、使用事例に関連するデータソースの一意の名前を入力します。
1. **Continue** をクリックします。

## 接続の確立

データのインポートを構成する前に、クラウドデータソースへの接続を確立する必要があります。接続は、Tealiumをクラウドデータソースに接続するための再利用可能なベンダー認証情報の構成です。

1. **Connection Configuration** 画面で、データソースの名前を確認し、リストから既存の接続を選択するか、**+** アイコンをクリックして接続を作成します。
1. 新しい接続の場合、接続情報を入力し、**Save** をクリックして **Connection Configuration** 画面に戻ります。
1. **Establish Connection** をクリックします。

ベンダーへの接続についての詳細は、以下を参照してください：

* [Amazon Redshift](https://docs.tealium.com/amazon-redshift-cloud-data-source/#create-a-connection)
* [Databricks](https://docs.tealium.com/databricks-cloud-data-source/#create-a-connection)
* [Google BigQuery](https://docs.tealium.com/google-bigquery-cloud-data-source/#create-a-connection)
* [Snowflake](https://docs.tealium.com/snowflake-cloud-data-source/#create-a-connection)

## 処理の構成

### 処理の有効化

**Enable Processing** をオンにして、変更を保存して公開した直後にデータのインポートを開始します。構成を完了する間、この構成をオフにして後で処理を有効にすることもできます。

### クエリ頻度

Tealiumがデータを取得する頻度を構成します。処理のための以下のオプションから選択します：

* ニアリアルタイム  
プロセスは2秒ごとに実行されます。
* 毎時  
プロセスは毎時開始時に実行されます。
* 毎日  
プロセスは指定した時間に1日1回実行されます。
* 毎週  
プロセスは指定した日と時間に1週間に1回実行されます。

### バッチサイズ

以下のバッチオプションから選択します：

* **Default**: バッチあたり1,000レコード。
* **Custom**: 1,000レコードを超えるカスタムバッチを作成します。
* **No limit**: 利用可能なすべてのデータを処理するための制限なしのバッチを作成します。

## クエリの構成

**Query Configuration** 画面で、BasicまたはAdvancedの構成モードから選択します。

* Basicモード：データソース構成で指定されたデフォルトスキーマを使用してデータがインポートされます。1つのテーブルまたはビューからのみデータを処理できます。
* Advancedモード：高度なSQLエディタを使用して、複数のスキーマからの1つ以上のテーブルを結合することができます。

### 1. クエリの構築

#### Basicモード

Basicモードでは、クエリに含めるテーブルと列を選択します。インクリメント、タイムスタンプ、またはインクリメントとタイムスタンプの列が選択に含まれている必要があります。

オプションで、カスタム条件に一致するレコードのみをインポートするためにSQL `WHERE` 句を含めることができます。SQL `WHERE` 句はネストされた `SELECT` ステートメントをサポートしていません。複数のテーブルを結合するには、Advancedモードを使用してください。

#### Advancedモード

Advancedモードでは、SQLエディタを使用して有効な読み取り専用のSQLクエリを入力し、1つ以上のテーブルまたはスキーマに接続します。SQLエディタは `CAST` や `JOIN` などの高度なSQLコマンドをサポートしています。インクリメント、タイムスタンプ、またはインクリメントとタイムスタンプの列が選択に含まれている必要があります。

#### SQLクエリのベストプラクティス

* **計算フィールド**  
Advanced SQLクエリは計算（派生）フィールドをサポートしています。計算値は各バッチフェッチで再評価され、ベンダーによっては異なる動作をする場合があります。クエリモードの列（タイムスタンプ、インクリメント、またはタイムスタンプとインクリメント）で計算フィールドを使用すると、データのインポートにエラーが発生する可能性があります（たとえば、行のスキップや取り込みのループ）。クエリモードの列で計算フィールドを使用することはお勧めしません。
* **LIMIT句**  
Tealiumデータソースのストリーミング性質のため、LIMIT句はインポートされるデータの総量を減らしません。テストのために処理したいレコード数を変更するには、WHERE句を使用するか、エンドツーエンドテストを使用してください。詳細については、[Test configuration](https://docs.tealium.com/manage-cloud-data-source/#test-configuration)を参照してください。
* **読み取り専用**  
読み取り専用のSQLクエリのみがサポートされています。クエリがスキーマやデータを変更しないことを確認してください（たとえば、`DELETE`、`UPDATE`、`INSERT`、`DROP`、`ALTER`を使用する場合）。

完了したら、**Continue to Query Mode** をクリックします。

### 2. クエリモードの構成

クエリモードは、新しい行、変更された行、またはその両方をインポートするための選択方法を決定します。

* **Timestamp + Incrementing**（推奨）を選択した場合、タイムスタンプ列と厳密にインクリメントする列の2つの列を選択する必要があります。
* **Timestamp** または **Incrementing** を選択した場合、新しい行と変更された行、または新しい行のみを検出するために使用する列を選択する必要があります。

詳細については、を参照してください。

完了したら、**Test Query** をクリックして結果をプレビューします。

### 3. テストクエリのプレビュー

テストクエリのプレビューを使用して、クエリの結果を検証します。

### ソーステーブルの列の変更

データソースを構成した後にソーステーブルの列が変更された場合、必要なアクションは変更のタイプによって異なります：

* **列の名前が変更された場合**：クエリビルダーで使用されている列がソーステーブルで名前が変更された場合、データソースを複製する必要があります：
  1. **Data Sources** 画面のデータソースアクションメニューから **Duplicate** オプションを選択します。
  1. 複製されたデータソースで、クエリビルダーを更新して新しい列名を使用します。
  1. 新しいデータソースの取り込み開始点を構成するために **Set Processing Start** を使用します。詳細については、[Set Processing Start]()を参照してください。
* **列が追加された場合**：
  * ソーステーブルに新しい列が追加され、それを取り込む必要がない場合、何もする必要はありません。
  * 列がタイムスタンプまたはインクリメント列の場合、名前が変更された列と同様にデータソースを複製します。
  * その他の新しい列タイプの場合：
    1. データソース処理を **Off** に切り替えて保存して公開します。
    1. クエリビルダーで列を追加し、列マッピングを追加するためにデータソースを編集します。
    1. 処理トグルを **On** に構成します。
    1. 再度保存して公開します。

## 列のマッピング

列マッピングテーブルを使用して、事前に構成された列ラベルをイベント属性にマッピングするか、手動で列ラベルを入力します。イベント属性にマッピングされていない列は無視されます。

各列ラベルに対して、リストから対応するイベント属性を選択します。

## 訪問IDのマッピング

AudienceStreamでクラウドデータソースを使用するには、列を訪問ID属性にマッピングします。訪問IDを表す列を選択し、対応する訪問ID属性にマッピングします。


<blockquote>
**AudienceStreamでの訪問IDマッピング**はデフォルトで有効になっています。訪問IDマッピングを無効にすると、訪問のスティッチングにエラーが発生する可能性があります。詳細については、[Visitor Identification using Tealium Data Sources]()を参照してください。
</blockquote>

## 概要

この最終ステップでは、要約を確認し、必要な修正を行った後、プロファイルを保存して公開します。構成を編集するには、**前へ** をクリックして変更を加えたいステップに戻ります。

1. イベント属性と訪問IDのマッピングを表示します。
1. **完了** をクリックしてデータソースを作成し、構成画面を終了します。新しいデータソースは **データソース** ダッシュボードにリストされます。
1. **保存/公開** をクリックして変更を保存し公開します。

## 処理済み行とエラー

インポート活動を見るには、**データソース** に移動し、データソースを展開します。

![](https://docs.tealium.com/images/server-side/data-sources/cloud-data-source-status-line.png)

## ステータス

クラウドデータソースを構成した後、以下のステータスのいずれかが表示されることがあります：

| **ステータス**       | **説明** |
|------------------|-----------------|
| **失敗**       | 接続エラーが発生しました。例えば認証失敗などで、エラーが解決されるまでインポートは停止されます。インポート中の行レベルのエラーはこのステータスを引き起こさず、データソースは **実行中** のままでログに記録されます。 |
| **非アクティブ**     | データソースは作成されましたが、オンにされたことがなく、他のステータスに移行することもありません。 |
| **初期化中** | コネクタが初めて起動するか、**停止** 状態から再開するときです。これは **実行中** または **スケジュール済み** に移行する前の一時的な状態です。 |
| **実行中**      | コネクタは積極的にクエリを実行しデータをインポートしています。 |
| **スケジュール済み**    | 次のインポートがスケジュールされています。この状態は **初期化中** または **実行中** の後に続くことがあります。 |
| **停止**      | データソースは以前に有効化されましたが、現在はオフになっています。有効化されるまでデータのインポートは行われません。 |
| **未割り当て**     | タスクはクラウドワーカーへの割り当てを待っています。 |

## テスト構成

データソース、セグメント、またはアクティベーションを有効にする前に、データソースとクエリをテストすることをお勧めします。ただし、テストを実行するとセグメントがアクティブ化され、有効なアクションがトリガーされ、下流システムに影響を与える可能性があります。予期しない結果を防ぐために、コネクタと機能を無効にし、テストレコードを制限し、受信者と調整してください。

データソース構成をテストするには、次の手順を使用します：

![](https://docs.tealium.com/images/early-access/cloudstream/cloudstream_test_configuration.png)

1. **データソース** 画面でデータソースを見つけ、編集アイコンをクリックします。
1. データソースウィンドウの右上隅にあるアクションボタンをクリックし、**エンドツーエンドテスト** をクリックします。
1. 出力を受け取りたい方法を選択します：
    * **新しいトレースセッション**：出力は最大10レコードの新しいトレースセッションで表示されます。このオプションはエンドツーエンドの検証とログの詳細を確認するのに最適です。
    * **既存のトレースセッション**：出力はすでに開始しているトレースセッションで表示されます。**トレースID** を入力して **トレースに参加** をクリックします。
    * **ダイレクト出力**：出力の生の結果が画面に表示されます。データレコードにトレースIDは追加されず、トレースは利用できません。このオプションはクエリと属性マッピングをすばやく確認するのに最適です。
1. テストのために処理する行数を選択します。最大行数は10です。
1. **テストクエリ** の下で、テストに含めるテーブルのカラムを選択します。リストからカラムを削除するには、カラムの **X** をクリックします。少なくとも1つのカラムを選択する必要があります。
1. **From Table** の下で、クエリを実行するテーブルを選択します。**Select Columns** ボックスはテーブルのカラムで更新されます。
1. **Where** の下で、テーブルに対して実行するSQLクエリを入力します。
1. **Check Query** をクリックしてSQLを検証し、必要なフィールドが構成されていることを確認します。
1. 結果は **Query Result Preview** タブの下のテーブルに表示されます：![](https://docs.tealium.com/images/early-access/cloudstream/cloudstream_test_check_query.png)
1. **Start Test** をクリックして構成テストを開始します。

右サイドバーにはテストの完了までの時間を推定するプログレスバーと、テストがエラーに遭遇した場合のステータスメッセージが表示されます。

![](https://docs.tealium.com/images/early-access/cloudstream/cloudstream_test_output.png)

テストが完了すると、結果が表示されます。

![](https://docs.tealium.com/images/early-access/cloudstream/cloudstream_test_results.png)

* テストの実行をトレースで見たい場合は、**トレースに参加** をクリックします。
* テストが失敗した場合、次のことができます：
     * **テスト構成の編集** をクリックして構成を変更します。
     * **テストの再試行** をクリックして現在の構成を再度実行します。

## 処理開始の構成

データソースは、クエリが開始される日付または増分値の位置を追跡します。この位置をリセットまたは手動で構成することで、ビューまたはテーブルのどこからクエリを開始するかを制御できます。

たとえば、最近のメーリングリストのアクティベーションにエラーが含まれており、100レコードが処理され、現在の増分位置が342であるとします。メールアクティベーションを修正した後、これらのレコードを再処理するには、開始点を242に構成します。データソースを再起動すると、その位置からレコードのクエリが開始され、修正されたメールが送信されます。

次の条件が真の場合にのみ、開始点を管理できます：

* 現在のプロファイルが公開されています。
* クエリモードは **タイムスタンプ + 増分 (推奨)**、**タイムスタンプ**、または **増分** です。**完全な再同期** クエリモードでは開始点を管理できません。
* データソースが停止しています。
    * データソースのステータスが実行中、スケジュール済み、または失敗している場合、開始点を編集することはできません。現在の開始点に関する情報のみが利用可能です。
    * ステータスが初期化中、非アクティブ、または接続エラーがある場合、開始点は利用できません。

データソースの開始点を管理するには、次の手順を使用します：

![](https://docs.tealium.com/images/early-access/cloudstream/manage_offset.png)

1. **データソース** 画面でデータソースを見つけ、編集アイコンをクリックします。
1. データソースの詳細ウィンドウの右上隅にあるアクションボタンをクリックし、**処理開始の構成** をクリックします。
1. 利用可能な開始点の方法は **処理開始タイムスタンプ** と **増分開始点** です。クエリモードによって利用可能な開始点が決まります。
1. **タイムスタンプカラム** の下で、タイムスタンプを表すテーブルのカラムを選択します。
1. **新しいタイムスタンプ** の下で、データのインポート時に使用する開始位置として日付と時間を選択します。
    * 新しいタイムスタンプは過去の日時でなければなりません。未来の日時は使用できません。
    * 現在のタイムスタンプフィールドは現在使用されている開始位置を表示します。
1. **増分カラム** の下で、テーブルに追加される各行の増分値を表すカラムを選択します。
1. **新しい増分** の下で、データのインポート時に使用する開始点としての数値を入力します。
    * 新しい開始点は正の整数でなければなりません。
    * 現在の開始点フィールドは現在使用されている開始位置を表示します。

**処理開始の変更を検証** をクリックして、新しい開始点からインポートされるデータのプレビューを表示します。テーブルはサンプル行を表示し、開始点を調整した後に処理される行数の見積もりも提供します。

![](https://docs.tealium.com/images/early-access/cloudstream/validate_offset.png)

**完了** をクリックして新しい開始点の構成を確認します。**キャンセル** をクリックして変更を破棄します。
開始点を変更した後、データソースを再起動します。