計算フィールドを介したデータベースのブレンドについてお伺いしたいことがございます。
データベースXとデータベースYのそれぞれに住所が含まれているフィールド「full_address」があり、
「○○県○○市○○町」まで抜粋した「address」のようなフィールドを作成しています。
また、Xは他にフィールド「alpha」を、Yは「beta」を持っています。
1.Xのあるレコードを選択したときに、Xの「address」が「A県B市C町」であることを利用して、
Yの「address」が「A県B市C町」であるレコードを取得
2.1.取得したYの「beta」 / 選択したXの「alpha」 の平均値を算出
(Yのbeta(複数)をXのalpha(一つ)で正規化し、平均値を算出する形です)
2.2.取得したYの「beta」 / 選択したXの「alpha」 のヒストグラムのプロット
を行いたいと考えております。
「address」を通じてデータベースをブレンドするところまではできたのですが、
その後の計算をどのようにすればよいかわからず困っております。
アドバイス等いただけますと幸いです。
よろしくお願い致します。
tanakaさん
限られたサンプルなので、完全に要望を満たしているかどうか分からない(あるいはデータが加工可能かどうかも不明)のですが、
ひとまず、
記述からは、Y は 同一アドレス内にデータが複数、Xは同一アドレス内にひとつのみ なので、
プライマリがY セカンダリが X となります。
ブレンドの制約下では、BINは作れないので、計算式でグルーピングします。
ブレンドって、イヤだよね~って話は、こちらもご参照ください。
第2回 Tableau Ambassador 座談会 - Togetter
それと、他の加工の可能性を考慮すると、どちらのデータにも、ユニークID があった方が良いです。
今回も、もし、全く同じ数字の Betaあるいはalpha が存在する場合、別々のデータと認識できないことがあります。
Shin