初めて投稿させて頂きます。よろしくお願いいたします。
100人の人に対して、「職業」 と 「好きなもの」 を一つずつ聞きました。
職業ごとに好きなものにばらつきがあるのか分析するため、添付ファイルのように user_id で結合して以下の表を作りました。
※ user_power という値は、回答対象となる母集団の構成比と、回答者の構成比に差があったため、補正するため設定しています。
その上で、全体の傾向と比べたときに、職業ごとの好きなものの割合の傾向があるのかを視覚的にわかりやすくするため、
合計 (職業) の割合と比較したいと思っているのですが、どのように実現できますでしょうか。
※ 添付のエクセル (下記の表) のようなことがやりたいです
表計算の関数をいくつか使ってみて、列ごとの合計値 (例: さくらんぼの列の 31 )は取れても、
合計でみたときの割合 (例: さくらんぼの列の 16.1%) を求めることができず、、やり方をご教示頂けますと大変助かります。
情報が不足しておりまりましたら、お手数ですが、お知らせください。
どうそよろしくお願いいたします。
4 respuestas

こんにちは。
対応策ですが、以下のようなことをやってみました。
計算の仕方はその他にもやりようがありますが、最終的なアウトプットとか、その他組もうとする計算式との組み合わせで良し悪しがあるので
とりあえず出来るだけ簡易かな?と思う方法(LOD表現を最小限にして使える部分は表計算を使う)でやってみました。
①得票数(職業回答無視)のメジャーをLOD表現を使って作成します。こんな結果が出ます。(比較しやすいように元々の得票数と併記)
②得票数と得票数(職業回答無視)それぞれの構成比を出します。
※実際には式を0から書かなくても各メジャーについて簡易表計算で結果を出して、それをドラッグ&ドロップで式に保存すると楽ですよ。 結果です。
③②で作成したメジャーの差を求めるメジャーを作成します。
結果です。Excelのレイアウト風のアウトプットも並べますね。
④オマケですが、視覚的にって話なので例えばこんな感じのアウトプットがいいでしょうか。
と、最初↑を貼り付けてましたが、これだと職業ごとの回答具合は分かりにくいので縦軸と横軸を入れ替えて、こっちの方がいいかな。 色々試行錯誤したくなるところですが、サンプルデータなんでこの辺でやめておきます。
~~~ 以上となります。ご確認くださいませ。