当たる性格診断とは?信頼できるテストの見分け方
「当たってる」と思えるかどうかは、結果を読むまでわかりません。テストを見分ける手がかりの多くは、その手前の質問と説明ページにあります。

占いと同じ「当たる」
「当たる 性格診断」と検索するときの「当たる」は、占いや天気予報に使うのと同じ言葉です。言われたことが、現実と合っていた。性格テストの場合、照らし合わせる相手は、自分がもともと持っている自分像です。結果の文章がそこに重なったとき、当たった、と感じます。
1949年、心理学者のバートラム・フォアラーは、授業で学生たちに性格テストを受けさせ、一人ひとりの回答をもとにしたという人物評を渡しました。実際には全員が同じ文章を受け取っていて、そのほとんどは市販の星占いの本から集めた文でした。それでも学生たちは、自分にどれだけ合っているかを0〜5点でつけ、クラスの平均は4点を超えました。フォアラーが論文で取り上げたのは、本人が納得したことを、テストが正しい証拠とみなしてしまう誤りです。いまはバーナム効果という名前のほうが通っています。
当たったと思った一文を、そのまま友だちにLINEで送ってみてください。「それ、私も」と返ってきたら、その文を読んでも、テストがあなたの回答から何を読み取ったのかはわかりません。テストが実際に何を測ったのかは、別の2か所を見ることになります。あなたが答えた質問と、運営元が公開している説明です。
答えに詰まった1問
テストの途中で「飲み会では盛り上げ役になり、二次会にも行くほうだ」という文が出てきたとします。一次会ではよくしゃべるのに、二次会には行かずに帰る人なら、どの選択肢を押しても、言いたかったことは半分しか残りません。
選びたくなる答えが透けて見える質問もあります。「頼まれた仕事は、期限より前に終わらせる」に「そう思わない」と答えるのは、少し気が引けるでしょう。米国の3つの学会(AERA・APA・NCME)がまとめた『教育・心理測定の基準』は、不安を測るテストで自分の不安を少なめに答えてしまう傾向を例に挙げています。測りたい特性とは関係のないものが、スコアを動かしてしまう。そうしたずれも、スコアの読み方をゆがめる要因のひとつに数えられています。
質問が多いと、何が変わるか
質問の数を気にするのは、的外れではありません。『基準』には、テストの長さは所要時間とスコアの精度のつり合いで決めるもので、一般に長いテストほどスコアの精度は上がる、と書かれています。
ただ、質問がいくら多くても、聞いている場面が狭ければ、スコアの意味もそのぶん狭くなります。不安を幅広く測るはずのテストが体の反応ばかりを聞き、気持ちや考え方、置かれた状況の面を聞いていなければ、スコアに表れるのは不安の一面だけです。1つの特性について、職場での場面と実家での場面のように、違う場面の質問が混ざっているかどうかは、答えながらでも気づけます。
受け直して揃うか、何に使えるか
結果を読んだときの手応えは、2つのことを教えてくれません。受け直しても同じような数字が出るか。その数字を何に使ってよいか。前者を信頼性、後者を妥当性と呼びます。
『基準』は信頼性を、測定の手続きを繰り返したときにスコアがどれだけ一貫しているか、と定義しています。受ける側から言えば、生活に大きな変化のない数週間後にもう一度受けて、前回に近い数字が出るかどうかです。これを調べた運営元なら、結果を示せます。Myers & Briggs Foundationは、世界各地の成人1,721人がMBTIのStep Iを6〜15週間あけて2回受け、4つの尺度で再テスト信頼性係数が0.81〜0.86だったと公表しています。係数の相場を知らなくても、何を、誰が、どれだけ間をあけて受け、何を計算したかが書いてあるので、確かめようのある主張です。
妥当性は、そのスコアをある目的に使ってよいか、という問いです。『基準』によれば、検討されるのはテストそのものではなく、特定の用途に向けたスコアの読み方で、用途を言わずに「このテストの妥当性」と言うのは誤りだとされています。サイトに「科学的に検証済み」とあったら、何に使うことについての検証なのかを探してみてください。来週の段取りを見直すきっかけにするのと、採用の合否のように取り消しのきかない判断に使うのとでは、求められる根拠の重さがまるで違います。
その数字は、何と比べた数字か
0〜100の連続したスコアなら、片側に少し寄っているのか、大きく寄っているのかの違いが残ります。区分に分けると見えなくなる違いです。ただ、それも読み方がわかってこその話で、「外向性:80」は、比べる集団の80%より外向的だったという意味かもしれませんし、誰とも比べず、自分の回答だけから出した尺度上の位置かもしれません。
集団との比較なら、知りたいのは、どんな人たちのデータをいつ集めたかです。それが書かれていなければ、80%という数字は読みようがありません。尺度上の位置なら、どちらの端が何を表し、真ん中あたりが日常でどんな姿になるのかが説明されているかを見ます。
運営元が書いておくべきこと
ここまで挙げたことの多くは、運営元が書いてさえいれば、1問目に答える前に確かめられます。『基準』はテストの作り手に、テストの根拠、勧める使い方とそれを支える証拠、スコアを読むための情報を文書にし、予想できる誤用には注意を添えるよう求めています。作り手に向けた基準ですが、読む側にとっては、運営元の説明ページを読むときの項目表として使えます。
説明図
テストを選ぶ前に見る6つのこと
1問に1つのこと
「盛り上げ役で、二次会にも行く」のように、2つのことを1問で聞いていないか。
「正解」の見えない選択肢
どの答えを選んでも、自分がよく見えたり悪く見えたりしないか。
受け直しの記録
誰が、どれだけ間をあけて受け、何を計算したかが書かれているか。
スコアの用途
何に使うためのスコアか。使ってほしくない場面も書かれているか。
数字の基準
集団との比較か、尺度上の位置か。どちらの端が何を表すか。
結果の文の出どころ
その一文がどのスコアから来たのか、たどれるか。
Traitiumの50問と14のスコア
Traitiumは全50問です。1問ずつ文章を読み、7段階のうち自分に近いところを選びます。結果は14の次元それぞれについて0〜100の連続したスコアで、ほかの人との比較ではなく、回答がその次元のどちらの端にどれだけ寄っているかを表す位置です。どちらの端が何を指し、中ほどが日常でどう表れるかは、次元ごとのページに書いています。何のためのスコアかは、スコアの算出方法を説明したページにあります。Traitiumは自分を知るための情報提供ツールで、スコアは医療・精神科・診断のための評価ではありません。
同じ回答なら、日本語で受けても英語や繁体字中国語で受けても、同じ計算を通るので同じスコアになります。この一致も、50問という数や0〜100の連続したスコアも、設計の特徴です。受け直したときに数字が揃うかという信頼性や、何に使ってよいかという妥当性を、それだけで示すものではありません。
スコアから読み取った洞察には、「この洞察を取り上げた理由」として、もとになったスコアを添えています。当たったと思った一文があったら、その欄の数字と並べて読んでみてください。
参考資料と注記
- [1]AERA・APA・NCME『教育・心理測定の基準』(2014年)
第1章(妥当性の定義、測りたいものの取りこぼし、無関係な要因によるスコアのゆがみ)、第2章(信頼性と精度)、第4章(テストの長さと精度)、基準7.1(作り手が文書に書くべきこと)を参照しました。
- [2]Myers & Briggs Foundation:信頼性と妥当性
信頼性を、時間がたっても結果が一貫していることと説明し、本文で紹介したMBTI Step Iの再テストの数値(成人1,721人、6〜15週間の間隔、係数0.81〜0.86)を載せています。
- [3]B. R. Forer「The fallacy of personal validation」(1949年)
授業での実演を報告した原論文。Journal of Abnormal and Social Psychology、44巻1号、118〜123ページ。

