Super Forecasting_philip tetlock_dan gardner ニューヨーク・タイムズ ベストセラー スーパーフォーキャスティング ダン・ガードナー スーパーフォーキャスティングへの称賛 「『スーパーフォーキャスティング』は、あなたをより賢く、より賢明にしてくれる稀有な本です。行動科学の巨人が、未来を予測する能力を向上させる方法を明らかにしています。」 — アダム・グラント、ニューヨーク・タイムズ ベストセラー著者『与えることと受け取ること』 「良い判断力と良い予測は稀ですが、教えられるスキルであることが分かりました。予測者を競わせることで、テトロックはそのスキルが何であるか、そしてどのように機能するかを発見しました。この本は、興味のある読者にその能力を教えてくれます。」 — スチュワート・ブランド、ロングナウ財団会長 「フィリップ・テトロックは、ほとんどの専門家が選挙、戦争、経済崩壊、その他の出来事を予測する際に『ダーツを投げる猿』と同じくらいの精度しか持っていないことを示したことで知られています。彼の素晴らしい新著では、再び自身の画期的な研究に基づいて、より希望に満ちたメッセージを提供しています。特定の人々は、偶然よりもはるかに高い精度で出来事を予測できることを示しており、私たちも『スーパーフォーキャスター』たちの批判的思考を模倣すれば、同じことができるかもしれません。この自己啓発ジャンルは、これ以上賢く、洗練されたものはありません。」 — ジョン・ホーガン、スティーブンス工科大学科学ライティングセンター所長 「『スーパーフォーキャスティング』は、学術的でありながら魅力的な稀有な本です。教訓は科学的で説得力があり、非常に実用的です。予測の仕事に関わっている人は誰でも—それは私たち全員です—今すぐ手を止めて読むべきです。」 — マイケル・J・モーボッシン、クレディ・スイス グローバル金融戦略責任者 「フィル・テトロックほど尊敬する社会科学者はいません。」 — ティム・ハーフォード、『隠れた経済学者』の著者 「デルフォイの神託から中世の占星術師、現代の過信した専門家まで、予測者は常に誤解を招くか、詐欺的でした。『スーパーフォーキャスティング』は、未来について正直で信頼できる、効果的で有用な判断を下す秘密を初めて明らかにします。」 — アーロン・ブラウン、AQRキャピタルマネジメント最高リスク責任者、『ウォール街のポーカーフェイス』の著者 「ソクラテスは『自分を知れ』という洞察を持ち、カーネマンは『ファスト&スロー』で科学を提供し、今、テトロックは『スーパーフォーキャスティング』で私たち全員が応用できるものを示しています。」 — フアン・ルイス・ペレス、UBSグループリサーチ グローバル責任者 スーパーフォーキャスティング 予測の技術と科学 フィリップ・E・テトロック ダン・ガードナー 目次 表紙 タイトルページ 著作権 献辞 1. 楽観的懐疑主義者 2. 知識の幻想 3. スコアをつける 4. スーパーフォーキャスター 5. スーパースマート? 6. スーパークワント? 7. スーパーニュースジャンキー? 8. 永遠のベータ 9. スーパーチーム 10. リーダーのジレンマ 11. 彼らは本当にスーパーフォーキャスターなのか? 12. 次は何か? エピローグ 招待状 付録: スーパーフォーキャスターを目指すための十戒 謝辞 注釈 著者について 楽観的懐疑主義者 私たちは皆、予測者です。私たちが... 仕事を変えたり、結婚したり、家を買ったり、投資をしたり、製品を立ち上げたり、退職したりすることを考えるとき、私たちは未来がどのように展開するかの期待に基づいて決定を下します。これらの期待は予測です。多くの場合、私たちは自分自身で予測を行います。しかし、大きな出来事が起こると—市場が崩壊したり、戦争の兆しが見えたり、指導者たちが揺らいだりすると—私たちは専門家、つまり知識を持つ人々に頼ります。トム・フリードマンのような人々に目を向けます。もしあなたがホワイトハウスのスタッフであれば、彼がアメリカ合衆国の大統領と一緒にオーバルオフィスで中東について話しているのを見かけるかもしれません。フォーチュン500のCEOであれば、ダボスでヘッジファンドの億万長者やサウジアラビアの王子たちとラウンジでおしゃべりしている彼を見つけるかもしれません。そして、ホワイトハウスや高級なスイスのホテルに通わない人でも、彼のニューヨーク・タイムズのコラムやベストセラーの本を読むことで、今何が起こっているのか、なぜそうなのか、次に何が来るのかを知ることができます。何百万もの人々がそうしています。トム・フリードマンのように、ビル・フラックも世界の出来事を予測しています。しかし、彼の洞察に対する需要ははるかに少ないのです。ビルは長年、アリゾナ州のアメリカ合衆国農務省で働いていました—「一部は手作業、一部はスプレッドシート」と彼は表現します—が、今はネブラスカ州キアーニーに住んでいます。ビルはコーンハスカーの出身です。彼はネブラスカ州マディソンという農村で育ち、両親が地元のスポーツや郡のフェアに関する多くの話題を扱った新聞「マディソン・スター・メール」を所有し、出版していました。彼は高校では優秀な生徒で、ネブラスカ大学で理学士号を取得しました。その後、アリゾナ大学に進学しました。彼は数学の博士号を目指していましたが、自分の能力を超えていることに気づき—「自分の限界を思い知らされた」と彼は表現します—中退しました。しかし、それは無駄な時間ではありませんでした。鳥類学の授業がビルを熱心なバードウォッチャーにし、アリゾナは鳥を見るのに最適な場所であるため、彼は科学者のためにパートタイムでフィールドワークを行い、その後農務省での仕事を得てしばらく働きました。ビルは55歳で退職していますが、誰かが仕事を提案すれば考慮するとも言っています。彼には自由な時間があります。そして、その一部を予測に費やしています。ビルは「ロシアは今後3ヶ月以内に追加のウクライナ領土を正式に併合するか?」や「来年、どの国がユーロ圏から撤退するか?」といった約300の質問に答えてきました。これらは重要な質問です。そして、難しい質問でもあります。企業、銀行、大使館、情報機関は、こうした質問に常に答えるのに苦労しています。「北朝鮮は今年中に核爆弾を detonするか?」、「今後8ヶ月でエボラウイルスの症例を報告する国は何か?」、「インドまたはブラジルは今後2年以内に国連安全保障理事会の常任理事国になるか?」中には、私たちの多くにとっては非常に難解な質問もあります。「NATOは今後9ヶ月以内に新しい国をメンバーシップアクションプラン(MAP)に招待するか?」、「クルディスタン地域政府は国の独立に関する住民投票を行うか?」 「もし非中国の通信会社が今後2年間に上海自由貿易区でインターネットサービスを提供する契約を勝ち取った場合、中国市民はFacebookやTwitterにアクセスできるようになるのか?」という質問を最初に見たとき、ビルはどう答えればいいのか全く分からないかもしれません。「上海自由貿易区って一体何だ?」と思うかもしれません。しかし、彼は調査を行い、事実を集め、対立する意見を整理し、最終的に答えを出します。ビル・フラックの予測に基づいて決定を下す人はいませんし、CNNで彼の考えを共有するように求められることもありません。彼はトム・フリードマンと一緒にダボスでパネルに招待されたこともありません。それは残念なことです。なぜなら、ビル・フラックは素晴らしい予測者だからです。彼の予測はすべて日付が付けられ、記録され、独立した科学的観察者によって正確性が評価されています。彼の実績は素晴らしいのです。 ビルは一人ではありません。同じ質問に答えている他の数千人がいます。全員がボランティアであり、ほとんどはビルほど優れてはいませんが、約2%は彼と同じくらい優れています。彼らにはエンジニアや弁護士、アーティストや科学者、ウォール街の人々やメインストリートの人々、教授や学生が含まれます。私たちは彼らの中の多くに出会うことになるでしょう。数学者、映画製作者、そして自分の才能を活かすことに意欲的な退職者たちも含まれます。私は彼らを「スーパーフォアキャスター」と呼びます。なぜなら、彼らはその名にふさわしいからです。信頼できる証拠がそれを証明しています。彼らがなぜそんなに優れているのか、そして他の人々が彼らのように学ぶことができる方法を説明することが、この本の目的です。 私たちの目立たないスーパーフォアキャスターたちが、トム・フリードマンのような知的なセレブリティとどのように比較されるのかは興味深い質問ですが、その答えはありません。なぜなら、フリードマンの予測の正確性は厳密にテストされたことがないからです。もちろん、フリードマンのファンや批評家は「彼はアラブの春を的中させた」や「彼は2003年のイラク侵攻で失敗した」または「彼はNATOの拡大について先見の明があった」といった意見を持っています。しかし、トム・フリードマンの実績に関する確固たる事実はなく、意見が無限に存在するだけです。そして、それが通常のビジネスのあり方です。毎日、ニュースメディアは予測を提供しますが、その予測を行った予測者が本当にどれほど優れているのかを報告したり、尋ねたりすることはありません。毎日、企業や政府は先見の明があるか無価値な予測、あるいはその中間の予測に対してお金を支払っています。そして毎日、私たち全員—国のリーダー、企業の幹部、投資家、有権者—が、その質が不明な予測に基づいて重要な決定を下しています。野球の監督は、選手を雇うためにチェックブックを取り出す前に、パフォーマンス統計を確認することを夢にも思わないでしょう。ファンでさえ、スコアボードやテレビ画面で選手の統計を見ることを期待しています。それなのに、私たちが野球の試合よりもはるかに重要な決定を下す手助けをしてくれる予測者に関しては、無知でいることに満足しています。 この観点から見ると、ビル・フラックの予測に頼ることは非常に合理的に思えます。実際、この本の多くの読者の予測に頼ることも合理的であることが分かります。なぜなら、予測は「持っているか持っていないか」という才能ではないからです。 それは育むことができるスキルです。この本では、その方法をお教えします。 チンパンジーの話 ジョークをネタバレしてしまいますが、オチをお伝えします。平均的な専門家の予測精度は、ダーツを投げるチンパンジーとほぼ同じだったのです。おそらく、あなたもこの話を聞いたことがあるでしょう。これは有名であり、一部の人々の間では悪名高いものでもあります。ニューヨーク・タイムズ、ウォール・ストリート・ジャーナル、フィナンシャル・タイムズ、エコノミストなど、世界中のさまざまなメディアで取り上げられています。話の内容はこうです:ある研究者が、経済、株式、選挙、戦争、その他の時事問題について数千の予測を行うために、学者や評論家などの大勢の専門家を集めました。時間が経過し、研究者が予測の正確性を確認したところ、平均的な専門家の予測はランダムな推測とほぼ同じ結果だったのです。ただし、「ランダムな推測」というのは面白くないので、オチはダーツを投げるチンパンジーに関するものです。なぜなら、チンパンジーは面白いからです。 私はその研究者であり、しばらくの間はこのジョークを気にしていませんでした。私の研究は、科学文献における専門家の判断に関する最も包括的な評価でした。1984年から2004年までの約20年にわたる長い道のりで、結果はオチが示唆するよりもはるかに豊かで建設的なものでした。しかし、私はこのジョークを気にしなかったのです。なぜなら、それが私の研究への関心を高めてくれたからです(そう、科学者も自分の15分の名声を楽しむものです)。私自身も「ダーツを投げるチンパンジー」という比喩を使ったことがあるので、あまり大声で文句を言うこともできませんでした。 また、私はこのジョークが有効なポイントを指摘しているとも思っていました。新聞を開けば、テレビのニュースを見れば、未来を予測する専門家がいることがわかります。中には慎重な人もいますが、より多くの人は大胆で自信に満ちています。中には数十年先を見通すオリンピック級のビジョナリーを自称する人もいます。例外はあるものの、彼らがカメラの前に立つ理由は、予測に関する実績があるからではありません。正確性についてはほとんど言及されることもありません。古い予測は古いニュースのようにすぐに忘れ去られ、評論家たちは自分の発言と実際に起こったことを照らし合わせるよう求められることはほとんどありません。 確かな才能を持つ人々は、未検証の価値を持つ予測を企業の幹部や政府関係者、そして未知の効能や安全性の薬を飲むことなど考えない一般の人々に売り込んで富を得ていますが、彼らは疑わしいエリクサーを荷台から売るような予測に対してお金を払うことが日常的です。これらの人々とその顧客には、肘で軽くつつく必要があります。私は自分の研究がそれを実現するために使われるのを見て嬉しかったのです。 しかし、私の研究が広まるにつれて、その表面的な意味が変わっていることに気づきました。私の研究が示したのは、平均的な専門家が私が提起した多くの政治的および経済的な質問に対して、推測よりもほんの少し良い程度の結果しか出していなかったということです。「多くの」は「すべて」ではありません。 最も簡単に運を打ち負かせるのは、1年先を見越すだけで済む短期的な質問であり、専門家が予測を試みるにつれてその精度は低下し、3年から5年先になるとダーツを投げるチンパンジーのレベルに近づくという結果が得られました。これは重要な発見です。複雑な世界における専門知識の限界、さらには超予測者でさえ達成可能なことの限界について何かを教えてくれます。しかし、子供の遊び「電話」のように、あるフレーズが一人の子供にささやかれ、それが次の子供に伝わり、最後にはどれほど変わってしまったかにみんなが驚くように、実際のメッセージは繰り返しの中で歪められ、微妙なニュアンスは完全に失われてしまいました。メッセージは「すべての専門家の予測は無意味だ」というものになり、これはナンセンスです。中には「専門家はチンパンジーと同じくらい無知だ」というような、さらに粗雑なバリエーションもありました。私の研究は、未来を本質的に予測不可能だと見るニヒリストや、「専門家」という言葉の前に「いわゆる」を付ける無知なポピュリストのためのバックストップ的な参考資料になってしまいました。 そのため、私はこのジョークに疲れました。私の研究は、これらのより極端な結論を支持するものではなく、またそれに対して親近感を抱くこともありませんでした。今日、これはさらに真実です。専門家とその予測を擁護する人々との間には、合理的な立場を主張する余地がたくさんあります。一方で、デバンカー(専門家の予測を否定する人々)は一理あります。予測市場には疑わしい洞察を売り込む怪しい商人が存在します。また、克服できないかもしれない先見の明の限界もあります。未来に手を伸ばしたいという私たちの欲望は、常に私たちの理解を超えるものです。しかし、デバンカーはすべての予測を愚かな試みだと一蹴する際に行き過ぎています。私は、少なくともいくつかの状況において、ある程度未来を見通すことが可能であり、知的でオープンマインドで勤勉な人なら誰でも必要なスキルを育むことができると信じています。私を「楽観的な懐疑論者」と呼んでください。 その「懐疑論者」の側面を理解するために、チュニジアのシディ・ブジッドという町で、果物や野菜を載せた木製の手押し車を押しながら市場に向かう若いチュニジア人男性を考えてみてください。彼が3歳のとき、父親が亡くなりました。彼は、手押し車を満たすためにお金を借りて家族を支え、売上で借金を返済し、少しでも残ることを期待しています。毎日同じような日々が続きます。しかし今朝、警察が彼に近づき、規則に違反したとして彼のはかりを取り上げると言います。彼はそれが嘘であることを知っています。彼らは彼を脅しているのです。しかし、彼にはお金がありません。女性警官が彼を叩き、亡くなった父親を侮辱します。彼らは彼のはかりと手押し車を奪います。彼は町の役所に不満を訴えに行きますが、担当者は会議中だと言われます。屈辱を感じ、怒り、無力感に苛まれた彼はその場を去ります。彼は燃料を持って戻り、町の役所の外で自分に火をつけます。この物語の結末だけが異常です。チュニジアやアラブ世界には、数え切れないほどの貧しい路上販売者がいます。 警察の腐敗は蔓延しており、この男性に対する屈辱的な扱いは日常的に行われています。それは警察やその被害者以外の誰にも関心を持たれていません。しかし、2010年12月17日に起きたこの特定の屈辱は、26歳のモハメド・ブアジジを自ら火に包ませるきっかけとなり、彼の自殺は抗議運動を引き起こしました。警察はいつものように残虐な対応をしました。抗議は広がり、チュニジアの独裁者、ゼイン・エル・アビディン・ベン・アリ大統領は、国民の不満を和らげるためにブアジジを病院で見舞いました。ブアジジは2011年1月4日に亡くなりました。騒乱は拡大し、1月14日にはベン・アリがサウジアラビアに逃亡し、23年間の腐敗政治に終止符を打ちました。アラブ世界は驚愕の目でその様子を見守りました。そして、エジプト、リビア、シリア、ヨルダン、クウェート、バーレーンで抗議が勃発しました。30年間権力を握っていたエジプトの独裁者ホスニ・ムバラクは、政権を追われました。他の国々でも抗議が反乱に、反乱が内戦に発展しました。これがアラブの春であり、無数の他の人々と同じように警察に嫌がらせを受けた一人の貧しい男から始まりました。過去を振り返り、モハメド・ブアジジと彼の孤独な抗議から生じたすべての出来事を結びつける物語の流れを描くのは簡単です。トム・フリードマンのような多くのエリート評論家は、そのような再構築が得意であり、特に彼がレバノンでニューヨーク・タイムズの特派員として名を馳せた中東については非常に詳しいです。しかし、もしトム・フリードマンがその運命の朝に現場にいたとしても、彼は未来を見通し、自らの火を放つ行為、騒乱、チュニジアの独裁者の転覆、そしてその後のすべてを予見することができたでしょうか?もちろん、できません。誰もできませんでした。もしかしたら、フリードマンが地域について知識を持っていたため、貧困と失業が高く、絶望的な若者の数が増え、腐敗が蔓延し、抑圧が容赦なく続いていることから、チュニジアや他のアラブ諸国はいつ爆発してもおかしくない火薬庫であると考えたかもしれません。しかし、観察者は前年にも全く同じ結論を導き出すことができたでしょう。そしてその前年にも。実際、数十年にわたり、チュニジア、エジプト、その他の国々についても同じことが言えたでしょう。それらは火薬庫であったかもしれませんが、決して爆発することはありませんでした—2010年12月17日、警察がその一人の貧しい男を追い詰めるまでは。1972年、アメリカの気象学者エドワード・ローレンツは、注目を集めるタイトルの論文を発表しました。「予測可能性:ブラジルの蝶の羽ばたきがテキサスで竜巻を引き起こすのか?」10年前、ローレンツは偶然にも、気象パターンのコンピュータシミュレーションにおける微小なデータ入力の変動—例えば、0.506127を0.506に置き換えること—が、劇的に異なる長期予測を生み出すことを発見しました。この洞察は「カオス理論」を生み出すきっかけとなりました:非線形システムである大気のように、初期条件の小さな変化が巨大な影響を及ぼすことがあるのです。 原則として、ブラジルの一匹の蝶が羽ばたくことでテキサスで竜巻を引き起こす可能性がある。しかし、他のブラジルの蝶たちが一生懸命に羽ばたいても、数マイル先で目に見える風を起こすことは決してないかもしれない。もちろん、ローレンツは蝶が竜巻を「引き起こす」と言ったわけではない。私がハンマーでワイングラスを叩いて割るのと同じ意味ではない。彼が言いたかったのは、その特定の蝶がその瞬間に羽ばたかなかった場合、計り知れないほど複雑な大気の作用と反応のネットワークが異なる動きをし、竜巻が形成されなかったかもしれないということだ。これは、2010年のその朝、警察がモハメド・ブアジジに果物や野菜を売らせていたら、アラブの春が起こらなかったかもしれないのと同じことだ。エドワード・ローレンツは、予測可能性には厳しい限界があるという見解に科学界の意見をシフトさせた。これは深く哲学的な問題である。 何世紀にもわたり、科学者たちは、知識が増えることで予測可能性が高まるはずだと考えてきた。現実は時計のようなものであり、非常に大きく複雑な時計ではあるが、やはり時計である。科学者たちがその内部構造、歯車の動き、重りやバネの機能について学べば学ぶほど、その動作を決定論的な方程式で捉え、未来の動きを予測できるようになると信じていた。1814年、フランスの数学者で天文学者のピエール=シモン・ラプラスは、この夢を論理的に極限まで推し進めた。 「私たちは宇宙の現在の状態を、その過去の結果であり、未来の原因と見なすことができる。もしある瞬間に自然を動かすすべての力と、自然が構成されるすべての要素の位置を知っている知性が存在し、その知性がこれらのデータを分析にかけるほど広大であれば、宇宙の最も大きな天体の動きも、最も小さな原子の動きも、単一の公式で表すことができるだろう。そのような知性にとっては、何も不確かではなく、未来は過去と同様に目の前に存在することになる。」ラプラスはこの想像上の存在を「悪魔」と呼んだ。彼は、もしその悪魔が現在のすべてを知っていれば、未来のすべてを予測できると考えた。それは全知の存在である。 ローレンツはその夢に冷水を浴びせた。もし時計が完璧なラプラス的予測可能性を象徴するなら、その対極にあるのがローレンツの雲である。高校の科学では、雲は水蒸気が塵の粒子の周りで凝縮することで形成されると教えられている。これは簡単に聞こえるが、特定の雲がどのように発展するか、その形状は水滴間の複雑なフィードバック相互作用に依存している。これらの相互作用を捉えるためには、コンピューターモデラーはデータ収集における微小なバタフライ効果の誤差に非常に敏感な方程式が必要である。したがって、雲の形成に関する知識をすべて学んだとしても、特定の雲がどのような形になるかを予測することはできない。私たちはただ待って見るしかない。 歴史の大きな皮肉の一つとして、今日の科学者たちは100年前の同僚たちよりもはるかに多くの知識を持ち、膨大なデータ処理能力を備えているにもかかわらず、完全な予測可能性の見通しに対してはずっと自信を失っています。これが私の「楽観的懐疑主義者」という立場の「懐疑的」な部分の大きな理由です。私たちは、ほとんど無力な一人の人間の行動が世界中に波及効果をもたらすような世界に生きています。その波紋は、私たち全員にさまざまな程度で影響を与えます。カンザスシティの郊外に住む女性は、チュニジアが別の惑星のように思えるかもしれませんし、自分の生活とは無関係だと考えるかもしれません。しかし、もし彼女が近くのホワイトマン空軍基地から飛び立つ空軍の航法士と結婚していたら、ある無名のチュニジア人の行動が抗議を引き起こし、それが暴動につながり、独裁者の崩壊をもたらし、リビアでの抗議に発展し、内戦を引き起こし、2012年のNATO介入につながり、最終的に彼女の夫がトリポリ上空で対空砲火を避けることになったことを知って驚くかもしれません。このようなつながりは簡単に追跡できます。しばしば、つながりを見つけるのは難しいですが、それらは私たちの周りに存在し、ガソリンスタンドでの価格や近所の解雇などに影響を与えています。ブラジルの蝶がテキサスのただの晴れた日と町を襲う竜巻の違いを生むような世界では、誰もが未来を遠くまで見通せると思うのは誤りです。 楽観主義者 しかし、予測可能性の限界を認識することと、すべての予測を無駄な試みとして退けることは全く別のことです。カンザスシティの郊外に住むその女性の日常を顕微鏡で覗いてみましょう。朝6時30分、彼女は書類をブリーフケースに入れ、車に乗り込み、いつもの通勤ルートを運転してダウンタウンに駐車します。彼女は毎週の平日朝と同様に、ライオンの像を通り過ぎ、カンザスシティ生命保険会社のギリシャ風のオフィスビルに入ります。デスクに着くと、しばらくスプレッドシートに取り組み、10時30分に電話会議に参加し、数分間アマゾンのウェブサイトを閲覧し、11時50分までメールに返信します。その後、彼女は妹と一緒にランチをするために小さなイタリアンレストランに向かいます。この女性の生活は、彼女の財布に入った宝くじのチケットから、アラブの春によって夫がリビアで任務を遂行することになったこと、さらには彼女が聞いたこともない国でクーデターが起きたためにガソリンの価格が1ガロンあたり5セント上がったことまで、さまざまな予測不可能な要因に影響されています。しかし、予測可能な要因も同じくらい、あるいはそれ以上に存在します。彼女が6時30分に家を出たのはなぜでしょうか?彼女はラッシュアワーに巻き込まれたくなかったからです。別の言い方をすれば、彼女は後の時間帯に交通量がはるかに多くなると予測しており、ラッシュアワーは非常に予測可能なので、ほぼ確実にその予測は正しかったのです。運転中、彼女は他のドライバーの行動を常に予測していました。信号が赤のときには交差点で止まるだろうし、車線を守り、曲がる前にはウインカーを出すだろうと。 彼女は、10時30分の電話会議に参加すると言った人々が実際に参加することを期待しており、その通りになった。彼女は、レストランの掲示された営業時間がその時間に開店すると示していたため、正午に妹とレストランで会うことを手配した。掲示された営業時間は信頼できる指標だ。私たちはこのような平凡な予測を日常的に行っているが、他の人々も同様に、私たちの生活を形作る予測を行っている。女性がコンピュータを起動したとき、彼女はカンザスシティの電力消費をわずかに増加させた。これはその朝、他のすべての働き蜂も同じことをしており、彼らは集団で需要の急増を引き起こした。これは、毎年の祝日以外の平日朝に起こることだ。しかし、これが問題を引き起こすことはなく、電力生産者はこれらの急増を予測し、それに応じて出力を調整している。女性がアマゾンにアクセスすると、ウェブサイトは彼女が気に入ると思われる特定の製品を強調表示した。これは彼女の過去の購入履歴や閲覧履歴、さらには他の何百万もの人々のデータに基づいた予測だ。私たちはインターネット上でこのような予測的な操作に常に出くわしている。たとえば、グーグルは検索結果を個人化し、最も興味を持つと思われる情報を上位に表示するが、それは非常にスムーズに行われるため、私たちはほとんど気づかない。 そして、女性の職場についても触れよう。カンザスシティ生命保険会社は、障害や死亡を予測するビジネスを行っており、その仕事は非常に良くできている。彼らが私がいつ死ぬかを正確に知っているわけではないが、私の年齢や性別、収入、ライフスタイルといったプロフィールに基づいて、どれくらい生きる可能性があるかはよく理解している。カンザスシティ生命は1895年に設立された。もし彼らのアクチュアリーが良い予測者でなければ、ずっと前に破産していただろう。私たちの現実の多くはこのように予測可能であり、さらに言えば、もっと予測可能だ。私は今、カンザスシティ、ミズーリ州の明日の日の出と日の入りの時刻をグーグルで調べ、分単位で知ることができた。これらの予測は信頼できるもので、明日や明後日、あるいは50年後でも同様だ。潮の満ち引き、日食、月の位相についても同じことが言える。これらはすべて、時計のような科学的法則から予測でき、ラプラスの予測デーモンを満足させるほどの精度を持っている。 もちろん、これらの予測可能な領域は突然破られることもある。良いレストランは、開店する予定の時間に開く可能性が非常に高いが、マネージャーが寝坊したり、火事、破産、パンデミック、核戦争、あるいは物理実験が偶然にブラックホールを作り出して太陽系を飲み込むといった理由で、開かないこともある。他のすべての事柄についても同じことが言える。たとえ50年先の日の出と日の入りの予測であっても、次の50年の間に巨大な隕石が地球を太陽の軌道から外すようなことがあれば、予測が外れる可能性がある。人生には確実なものはない—死や税金でさえ、私たちの脳の内容をクラウドコンピューティングネットワークにアップロードする技術の発明や、公共心にあふれた繁栄した未来社会の出現に非ゼロの確率を割り当てるならば、確実ではない。では、現実は時計のようなものなのか、それとも雲のようなものなのか? 未来は予測可能なのか、それともそうではないのか?これは多くの誤った二項対立の一つであり、私たちがこれから直面する多くの例の最初のものです。私たちは時計や雲、そしてその他の多くの比喩が入り混じった世界に生きています。予測不可能性と予測可能性は、私たちの身体、社会、宇宙を構成する複雑に絡み合ったシステムの中で、不安定に共存しています。何かがどれほど予測可能であるかは、状況によります。 天気予報は、通常、数日先を見越した場合にはかなり信頼性がありますが、3日、4日、5日と日数が経つにつれて、正確性は徐々に低下します。一週間を超えると、ダーツを投げるチンパンジーに相談した方が良いかもしれません。したがって、天気が予測可能かどうかを一概に言うことはできず、特定の状況下である程度予測可能であると言えるに過ぎません—そして、私たちはそれ以上に正確になろうとする際には非常に注意が必要です。 時間と予測可能性の関係のように、一見単純に思えるものでも、一般的には未来を見越すほど見通しが難しくなるというのが真実です。しかし、このルールには長期的な例外が存在することもあります。株式市場の長期的な上昇を予測することは、何年も利益をもたらすことがありますが、突然それがあなたの破滅を招くこともあります。また、恐竜が食物連鎖の頂点に君臨し続けると予測することは、数千万年にわたって安全な賭けでしたが、小惑星が引き起こした大災害によって、最終的には未来を予測しようとする小さな哺乳類の生態的ニッチが開かれることになりました。 物理法則を別にすれば、普遍的な定数は存在しないため、予測可能なものと予測不可能なものを分けることは難しい作業です。これを避ける方法はありません。気象学者は誰よりもそれをよく知っています。彼らは大量の予報を行い、その正確性を定期的に確認します—そのため、1日および2日先の予報が通常かなり正確である一方、8日先の予報はそうではないことが分かっています。これらの分析を通じて、気象学者は天気の仕組みをより深く理解し、モデルを調整します。そして再び試みます。予測、測定、修正。繰り返し。これは、天気予報が良好であり、徐々に改善されている理由を説明する、終わりのない漸進的な改善のプロセスです。しかし、天気は非線形性の教科書的な例であるため、こうした改善には限界があるかもしれません。予報士が未来を見越そうとするほど、カオスが蝶の羽ばたきをして期待を吹き飛ばす機会が増えます。計算能力の大幅な向上や予測モデルの継続的な洗練は、限界を少し未来に押し広げるかもしれませんが、その進展は徐々に難しくなり、リターンはゼロに近づいていきます。どれほど良くなることができるのか?誰にも分かりません。しかし、現在の限界を知ること自体が成功です。他の多くの高リスクの取り組みにおいて、予測者たちは暗闇の中で手探りしています。彼らは短期、中期、長期にわたって自分たちの予測がどれほど良いのか、またどれほど良くなる可能性があるのか全く分かりません。せいぜい、漠然とした直感を持っているだけです。 それは、予測・測定・修正の手続きが、高度な予測技術の限られた範囲内でのみ機能するからです。具体的には、中央銀行のマクロ経済学者や、大企業のマーケティング・金融専門家、あるいはネイト・シルバーのような世論調査の分析者の仕事が該当します。実際には、予測が行われた後に何も起こらないことが多いのです。予測の正確性が事後に評価されることは稀であり、十分な規則性や厳密さを持って結論を導き出すことはほとんどありません。その理由は主に需要側の問題です。予測の消費者である政府や企業、一般市民は、正確性の証拠を求めないのです。したがって、測定が行われず、修正も行われません。修正がなければ、改善もありません。 想像してみてください。人々が走ることを愛している世界を。しかし、平均的な人がどれくらいの速さで走るのか、最高のランナーがどれくらいの速さで走れるのか、全く分からないのです。なぜなら、ランナーたちが基本的なルール—トラックの上を走る、銃声が鳴ったらレースを始める、指定された距離を走り終える—に合意したことがないからです。また、独立したレースの審判や計時係もいないため、結果を測定することもありません。このような世界で、走る速さが向上する可能性はどれほどあるでしょうか?あまり期待できません。最高のランナーたちは、人間が物理的に可能な速さで走っているのでしょうか?おそらく、そうではないでしょう。 「進歩を促すために何が必要かを考えると、予測においてそれがどれほど稀にしか行われないかに驚かされます。」たとえその単純な第一歩—明確な目標を設定すること—さえも踏み出されていないのです。予測の目標は未来を正確に予見することだと思うかもしれませんが、実際にはそれが唯一の目標ではないことが多いのです。時には、予測は娯楽のために行われます。CNBCのジム・クレイマーの「ブーヤ!」というパフォーマンスや、ジョン・マクローリンが「ゼロから十のスケールで、ゼロは可能性ゼロ、十は完全な形而上的確実性を表す」と叫びながらパネリストにイベントの可能性を予測させる場面を思い浮かべてください。時には、予測は政治的なアジェンダを進めたり、行動を促すために使われます。活動家たちが、私たちの行動を変えなければ迫り来る恐怖を警告する際にそうするのです。また、印象を与えるための予測もあります。これは、銀行が著名な専門家に依頼して、富裕層のクライアントに2050年の世界経済について語らせる際に行われるものです。そして、ある予測は人々を安心させるために行われます。聴衆に自分たちの信念が正しいことを保証し、未来が期待通りに展開することを伝えるためです。支持者たちはこうした予測を好みます。これは、温かいお風呂に浸かるような心地よさをもたらします。このような目標の混乱はほとんど認識されておらず、測定や進歩に向けて取り組むことが難しくなっています。状況は混沌としており、改善の兆しも見えません。それでも、この停滞こそが私が楽観的な懐疑主義者である大きな理由です。私たちは、政治、経済、金融、ビジネス、技術、日常生活など、多くの予測したい事柄において、ある程度の予測可能性が存在することを知っています。しかし、私たちが知らないことはまだたくさんあります。 科学者にとって、知らないことは刺激的です。それは発見の機会であり、未知のものが多ければ多いほど、その機会は大きくなります。多くの予測分野における驚くべきほどの厳密さの欠如のおかげで、この機会は非常に大きいのです。そして、この機会をつかむために必要なことは、明確な目標を設定すること—それは「正確性」です—そして、測定に真剣に取り組むことです。私はキャリアの大半をそのように過ごしてきました。ダートを投げるチンパンジーの結果を生み出した研究は第一段階でした。第二段階は2011年の夏に始まりました。私の研究(そして人生)のパートナーであるバーバラ・メラーズと私は「グッドジャッジメントプロジェクト」を立ち上げ、ボランティアに参加して未来を予測するよう呼びかけました。ビル・フラックが応じてくれました。その年の最初の年には他にも数千人が参加し、その後の4年間でさらに何千人もの人々が参加しました。合計で2万人以上の知的好奇心を持つ一般の人々が、ロシアでの抗議活動が広がるか、金の価格が急落するか、日経平均が9,500を超えるか、朝鮮半島で戦争が勃発するか、そしてその他の複雑で挑戦的なグローバルな問題に関する多くの質問を解決しようとしました。実験条件を変えることで、どの要因が予測力を向上させるのか、その程度や時間枠、そしてベストプラクティスを重ねることで予測がどれほど良くなるかを測定することができました。こうして並べると簡単に聞こえますが、実際にはそうではありませんでした。これは、カリフォルニア大学バークレー校とペンシルベニア大学に拠点を置く多分野にわたるチームの才能と努力を必要とする厳しいプログラムでした。グッドジャッジメントプロジェクト(GJP)は大規模なものでしたが、実際にはインテリジェンス先進研究プロジェクト活動(IARPA)が支援するはるかに大きな研究努力の一部に過ぎません。名前は地味ですが、IARPAは国家情報局長官に報告する情報コミュニティ内の機関であり、アメリカの情報活動をより良くすることを約束する大胆な研究を支援することが仕事です。アメリカの情報活動の大部分は、世界の政治的および経済的トレンドを予測することです。おおよその推定によれば、アメリカには2万人の情報分析官がいて、細かな問題から、イスラエルのイラン核施設への奇襲攻撃の可能性や、ギリシャのユーロ圏離脱といった重大な出来事まで、さまざまな事柄を評価しています。この予測はどれほど良いのでしょうか?これは簡単には答えられません。なぜなら、情報コミュニティは、他の多くの予測の主要な生産者と同様に、それを明らかにするためにお金を使うことにあまり熱心ではないからです。そのための躊躇にはさまざまな理由があり、いくつかはより尊敬に値するものですが、それについては後で触れます。重要なのは、この予測が国家安全保障にとって重要であるにもかかわらず、その質について自信を持って語れることはほとんどないということです。果たして、2万人の人員を抱える数十億ドルの事業に見合うほど良いのかどうかもわかりません。それを変えるために、IARPAは予測トーナメントを創設しました。 五つの科学チームが、各分野のトップ研究者によって率いられ、情報分析官が日々直面する難しい質問に対して正確な予測を生成するために競い合いました。その中の一つが「グッド・ジャッジメント・プロジェクト(GJP)」でした。各チームは実質的に独自の研究プロジェクトとして自由に方法を考案できましたが、2011年9月から2015年6月までの間、毎日午前9時(東部標準時)に予測を提出することが求められました。同じ質問を同時に予測することで、トーナメントは公平な競争の場を作り、何が効果的で、どれくらいの精度で、いつそれが実現するのかに関する豊富なデータを提供しました。4年間で、IARPAは世界情勢に関する約500の質問を提示しました。時間枠は私の以前の研究よりも短く、予測の大多数は1ヶ月以上、1年未満のものでした。最終的に、私たちは未来に関する100万以上の個別の判断を集めました。1年目には、GJPは公式の対照グループを60%上回りました。2年目には、対照グループに対して78%の差をつけました。GJPは、ミシガン大学やMITなどの大学関連の競争相手にも30%から70%の大差で勝り、機密データにアクセスできるプロの情報分析官をも上回りました。2年後、GJPは学術的な競争相手よりも遥かに優れていたため、IARPAは他のチームを撤退させました。 詳細については後で掘り下げますが、この研究から浮かび上がる二つの重要な結論を挙げておきましょう。一つ目は、予知能力は実在するということです。ビル・フラックのような人々は、その能力を持っています。彼らは数十年先を見通す力を持つグルや神託者ではありませんが、3ヶ月、6ヶ月、1年、あるいは1年半先に高リスクの出来事がどのように展開するかを判断するための、実際に測定可能なスキルを持っています。二つ目の結論は、これらのスーパー予測者がなぜ優れているのかということです。それは彼らが誰であるかではなく、彼らが何をするかにあります。予知能力は生まれつき与えられる神秘的な贈り物ではなく、特定の思考方法、情報収集の仕方、更新の仕方の産物です。これは、知的で思慮深く、決意のある誰でも学び、育むことができるものです。始めるのはそれほど難しくないかもしれません。特に私を驚かせた結果の一つは、この本で探求する基本的な概念をカバーするチュートリアルの効果でした。これには約60分しかかからず、トーナメント全体を通じて精度を約10%向上させました。確かに10%は控えめに聞こえるかもしれませんが、それは非常に少ないコストで達成されたものです。そして、時間をかけて維持される控えめな予知能力の改善は、積み重なっていくことを忘れないでください。私は、著者であり、ウォール街のベテランで、1000億ドル以上の資産を持つヘッジファンドAQRキャピタルマネジメントの最高リスク管理者であるアーロン・ブラウンとこのことについて話しました。 「それはとても見えにくい。なぜなら、ドラマチックではないからだ」と彼は言った。しかし、それが持続するなら、「それは、安定した勝者として生計を立てている人と、いつも破産している人との違いだ」と続けた。これから紹介する世界的なポーカープレイヤーも、まったく同意見だ。彼女によれば、重鎮とアマチュアの違いは、重鎮が0.1%の賭けと1%の賭けの違いを理解していることだという。それにもかかわらず、もし測定によって先見の明を向上させることが可能であり、その結果が大きな報酬をもたらすのなら、なぜ測定が標準的な実践になっていないのだろうか?その答えの大部分は、私たちが実際には知らないことを知っていると信じ込ませる心理にある。たとえば、トム・フリードマンが正確な予測者かどうかなどだ。この心理については第2章で探求する。何世紀にもわたり、これは医学の進歩を妨げてきた。医師たちがようやく、自分たちの経験や認識が治療法の効果を判断する信頼できる手段ではないことを受け入れたとき、彼らは科学的なテストに目を向け、医学はようやく急速に進歩し始めた。同じ革命が予測の分野でも必要だ。それは簡単ではない。第3章では、予測を現代医学が治療法をテストするのと同じくらい厳密にテストするために必要なことを考察する。それは見た目以上に大きな挑戦だ。1980年代後半、私は方法論を考案し、当時最大の専門家による政治予測の精度テストを実施した。その結果の一つは、何年も後に明らかになったもので、今では私を居心地悪くさせる punch line だ。しかし、その研究でのもう一つの発見は、はるかに重要でありながら、ほとんど注目されなかった。ある専門家グループは控えめだが確かな先見の明を持っていた。先見の明を持つ専門家と、平均をダーツを投げるチンパンジーのレベルまで引き下げるほど絶望的な専門家との違いは何だったのか?それは神秘的な才能や他の人が持っていない情報へのアクセスではなかった。また、特定の信念のセットでもなかった。実際、かなり幅広い見解の中で、彼らが考えていたことは重要ではなかった。重要だったのは、彼らがどのように考えていたかだ。その洞察に部分的に触発されて、IARPAは前例のない予測トーナメントを創設した。第4章では、その経緯とスーパーフォーキャスターの発見について語る。彼らはなぜそんなに優れているのか?その問いは第5章から第9章にかけて続く。彼らに出会うと、その知性に驚かされるので、知性が全ての違いを生むのだと疑うかもしれない。しかし、それは違う。彼らはまた、驚くほど数的な能力に優れている。ビル・フラックのように、多くは数学や科学の高等学位を持っている。それでは、秘密は難解な数学なのか?いいえ。スーパーフォーキャスターでさえ、数学者の資格を持っている人はほとんどいないし、あまり数学を使わない。彼らはまた、最新の動向を常に追いかけ、定期的に予測を更新するニュース中毒者であるため、彼らの成功を仕事に無限の時間を費やすことに帰する誘惑に駆られるかもしれない。しかし、それもまた間違いだ。 スーパーフォーキャスティングには、最低限の知性、数的能力、そして世界に関する知識が必要ですが、心理学の研究に関する真剣な本を読む人なら、これらの前提条件を満たしているでしょう。それでは、予測をスーパーフォーキャスティングに引き上げる要素は何でしょうか。私の以前の研究で実際に先見の明を持っていた専門家たちと同様に、最も重要なのは予測者の思考方法です。この点について詳しく説明しますが、広く言えば、スーパーフォーキャスティングには特定の思考スタイルが求められます。 最終章では、良い判断と効果的なリーダーシップの要求の間に見える矛盾を解決し、私の研究に対する最も強い二つの挑戦に応じ、予測に関する本にふさわしく、次に何が来るのかを考察して締めくくります。予測に関する予測ですが、もしかすると、これらはすべて時代遅れだと思うかもしれません。結局、私たちは驚くほど強力なコンピュータ、理解しがたいアルゴリズム、そしてビッグデータの時代に生きています。私が研究している予測は、主観的な判断が中心です。それは、人々が考え、決定することに他なりません。そんな曖昧な推測の時代は終わりを迎えつつあるのではないでしょうか? 1954年、優れた心理学者ポール・ミールは、小さな本を出版し、大きな反響を呼びました。この本では、大学での成功や仮釈放者が再び刑務所に送られるかどうかを予測する際に、十分な情報を持った専門家たちの予測が、能力テストのスコアや過去の行動記録などの客観的指標を単純に足し合わせたアルゴリズムよりも正確ではないことを示す20の研究をレビューしました。ミールの主張は多くの専門家を動揺させましたが、その後の研究(現在では200以上の研究)が示すところによれば、ほとんどの場合、統計的アルゴリズムは主観的判断を上回り、アルゴリズムが劣る数少ない研究でも、通常は同点になります。アルゴリズムは迅速で安価であるため、主観的判断とは異なり、同点であればアルゴリズムを使用することが支持されます。この点はもはや疑いの余地がありません。よく検証された統計的アルゴリズムがある場合は、それを使うべきです。この洞察は、主観的判断の支配を脅かすものではありませんでした。なぜなら、私たちが直面する問題に対して、よく検証されたアルゴリズムを持つことは非常に稀だからです。1954年当時も、そして今日でも、数学が単純な思考に取って代わるのは実用的ではありませんでした。しかし、情報技術の驚異的な進歩は、人類と機械との関係において歴史的な断絶が近づいていることを示唆しています。 1997年、IBMのディープブルーがチェスチャンピオンのガリー・カスパロフを打ち負かしました。現在では、市販されているチェスプログラムはどんな人間にも勝てます。2011年には、IBMのワトソンが「ジェパディ!」のチャンピオン、ケン・ジェニングスとブラッド・ラッターを打ち負かしました。これは非常に難しい計算の挑戦でしたが、ワトソンのエンジニアたちはそれを成し遂げました。今日、スーパーコンピュータがスーパーフォーキャスターやスーパーパンダイトを打ち負かす予測競技を想像することはもはや不可能ではありません。その後、依然として人間の予測者は存在しますが、彼らは人間の「ジェパディ!」の出場者のように、私たちはただ楽しむために見るだけになるでしょう。そこで、私はワトソンの主任エンジニア、デビッド・フェルッチに話をしました。 私は、ワトソンが「過去10年間に仕事を交換したロシアの指導者は誰か?」といった現在または過去に関する質問に簡単に答えられると確信していました。しかし、ワトソンやそのデジタルの子孫が「今後10年間で2人のロシアの指導者が仕事を交換するだろうか?」という質問に答えるにはどれくらいの時間がかかるのか、その見解が気になりました。1965年、博学者のハーバート・サイモンは、機械が「人間ができるあらゆる仕事をこなせる世界」まであと20年だと考えていましたが、これは当時の人々が言っていた単純に楽観的な見解の一つであり、フェルッチが30年間人工知能に携わってきたため、今日ではより慎重になっている理由の一つです。 フェルッチは、コンピュータが驚異的な進歩を遂げていることを指摘しました。パターンを見つける能力は劇的に向上しています。そして、機械学習は、人間と機械の相互作用が学習プロセスを促進することで、さらに根本的な進展を約束しています。「今はその指数関数的な曲線の底にいるようなものです」とフェルッチは言いました。しかし、「どの2人のロシアの指導者が仕事を交換したか?」と「今後2人のロシアの指導者が再び仕事を交換するだろうか?」には大きな違いがあります。前者は歴史的事実であり、コンピュータはそれを調べることができます。後者は、コンピュータがウラジーミル・プーチンの意図やドミトリー・メドベージェフの性格、ロシア政治の因果関係について情報を基に推測し、その情報を判断に統合する必要があります。人間はそのようなことを常に行っていますが、それが簡単だというわけではありません。これは人間の脳が驚異的であることを意味します—なぜなら、その作業は非常に難しいからです。コンピュータが急速に進歩しているにもかかわらず、スーパーフォアキャスターが行うような予測はまだ遠い未来の話です。そして、フェルッチは、スミソニアン博物館に「主観的判断」と書かれたサインを持つ人間が展示されることはないだろうと考えています。 機械は「人間の意味を模倣する」能力が向上し、それによって人間の行動を予測する能力も向上するかもしれませんが、「意味を模倣することと反映すること、そして意味を創造することには違いがあります」とフェルッチは言いました。その領域は常に人間の判断が占めることになるでしょう。予測の分野でも他の分野と同様に、人間の判断が置き換えられていく様子が見られるでしょう—これはホワイトカラーの労働者にとっては憂慮すべきことですが—同時に「フリースタイルチェス」のような人間とコンピュータがチームとして競い合う合成も増えていくでしょう。人間はコンピュータの明白な強みを活用しつつ、時にはコンピュータを上回ることもあります。その結果、時には人間と機械の両方を打ち負かすことができる組み合わせが生まれます。人間対機械の二項対立を再定義すると、ガリー・カスパロフとディープブルーの組み合わせが、純粋な人間や純粋な機械のアプローチよりも強力であることが証明されるかもしれません。 フェルッチが時代遅れになると考えているのは、多くの政策論争を幼稚なものにしている「グルモデル」だ。「あなたのポール・クルーグマンの論調に対して、私のナイアル・ファーガソンの反論を持ち出し、あなたのトム・フリードマンのオピニオン記事には私のブレット・スティーブンスのブログで反論する」といった具合だ。フェルッチは、この長い暗いトンネルの先に光が見えていると感じている。「専門家の意見が主観的な判断に基づいているだけでは、ますます奇妙なことになると思います。」人間の思考は心理的な落とし穴に悩まされており、この事実はここ10年か20年で広く認識されるようになった。「だから、私が求めているのは、人間の専門家とコンピュータを組み合わせて、人間の認知的限界やバイアスを克服することです。」 もしフェルッチが正しいなら—私は彼が正しいと思っています—私たちは将来的にコンピュータベースの予測と主観的な判断を融合させる必要があるでしょう。だから、そろそろ真剣に取り組む時期です。 知識の幻想 皮膚科医が患者の手の甲に斑点を見つけたとき、彼は疑いを抱き、少し皮膚を取り除きました。病理学者がそれを基底細胞癌であると確認しました。患者はパニックになりませんでした。彼もまた医師だったからです。この種類の癌はめったに転移しないことを彼は知っていました。癌は取り除かれ、予防策として患者は有名な専門医に診てもらうことにしました。専門医は患者の右脇の下にしこりを見つけました。それはどのくらい前からあったのか?患者はわかりませんでした。専門医はそれを取り除くべきだと言いました。患者は同意しました。結局、専門医は著名な人物だったのです。「取り除け」と言われれば、誰が反対するでしょうか。手術が予約されました。麻酔が切れ、患者が目を覚ますと、彼は自分の胸全体が包帯で巻かれていることに驚きました。専門医が到着しました。彼の表情は厳しかった。「真実をお伝えしなければなりません」と彼は言い始めました。「あなたの脇の下は癌組織でいっぱいです。私は最善を尽くして切除しましたが、あなたの小胸筋を取り除いてしまったので、あなたの命を救えたかどうかはわかりません。」その最後の言葉は、衝撃を和らげるための控えめな試みでした。専門医があまりにも明確に示したように、患者は長くは生きられないということでした。「一瞬、世界が終わったように感じました」と患者は後に書いています。「驚きとショックの短い後、私はできる限り横向きになり、恥ずかしげもなく泣きました。その日の残りのことはあまり覚えていません。」翌朝、冷静な気持ちで「残りの時間をどう過ごすかの簡単な計画を立てました....計画を完成させたとき、奇妙な平和の感覚が私を包み込み、私は眠りに落ちました。」その後の日々、訪問者たちが患者にできる限りの慰めを提供しに来ましたが、彼はそれを少し気まずく感じました。「彼らの方が私よりも恥ずかしがっていることはすぐに明らかでした」と彼は書いています。彼は死にかけていました。それは事実でした。冷静さを保ち、やるべきことをしなければなりませんでした。泣いても仕方がありません。この悲しい瞬間は1956年に起こりましたが、患者であるアーチー・コクランは死なず、幸運なことに彼は医学界で尊敬される人物となりました。専門医は間違っていました。コクランは末期癌ではなかったのです。 彼は全く癌ではなかった。病理学者が手術中に摘出された組織を調べたときに明らかになったことだ。コクランは、自分が死刑を宣告されたことに驚くのと同じくらい、助かったことにも驚いた。「病理学者がまだ報告をしていないと聞かされていたが、外科医の言葉を疑うことはなかった」と彼は何年も後に書いている。これが問題なのだ。コクランは専門家を疑わず、専門家も自分の判断を疑わなかった。そのため、二人とも診断が間違っている可能性を考えず、コクランの人生の幕を下ろす前に病理学者の報告を待つことが賢明だとは思わなかった。しかし、彼らをあまり厳しく非難すべきではない。これは人間の本性だ。私たちは皆、決断を下すのが早すぎて、変更するのが遅すぎることがある。そして、私たちがどのようにしてこれらの間違いを犯すのかを考えなければ、同じ過ちを繰り返してしまうだろう。この停滞は何年も続くことがある。あるいは一生涯。時には数世代にわたることもある。医学の長い悲惨な歴史がそれを示している。 盲目の人々が議論する 「長い」という部分は明らかだ。人々は病気を治そうとする試みを、病気が存在する限り続けてきた。しかし「悲惨」とは何か?これは、医学の歴史に詳しい読者にとっても明らかではない。なぜなら、「ほとんどの医学の歴史は驚くほど奇妙だから」とイギリスの医師で作家のドゥリン・バークは指摘している。「彼らは人々が自分たちが何をしていると信じていたのかを明確に説明するが、彼らが正しかったかどうかについてはほとんど何も語らない。」古代エジプトの医師が施したダチョウの卵の湿布は実際に頭の骨折を治したのだろうか?古代メソポタミアでは、王室の直腸の管理者の治療が本当に王室の直腸を健康に保ったのだろうか?瀉血についてはどうだろう?古代ギリシャ人からジョージ・ワシントンの医師まで、皆がそれが素晴らしい回復効果を持つと誓ったが、本当に効果があったのだろうか?標準的な歴史書はこれらの点については通常沈黙しているが、現代の科学を用いて歴史的な治療法の有効性を判断すると、ほとんどの介入が無駄かそれ以上であったことが悲しいほど明らかになる。歴史的な観点から見ても、病人が医師がいない方が良い場合が多かったのは珍しいことではなかった。病気を自然に進行させる方が、医師が施す治療よりも危険が少なかったからだ。そして、治療法は時間が経っても改善されることはほとんどなかった。1799年にジョージ・ワシントンが病気になったとき、彼の尊敬される医師たちは彼を容赦なく瀉血し、水銀を投与して下痢を引き起こし、嘔吐を誘発し、熱いカップを肌に当てて血で満たされた水ぶくれを作った。アリストテレスのアテネ、ネロのローマ、中世のパリ、エリザベス朝のロンドンの医師も、その恐ろしい治療法に頷いたであろう。ワシントンは亡くなった。こうした結果が医師たちに自らの方法を疑問視させるだろうと考えるかもしれないが、公平を期すために言えば、ワシントンが亡くなったことは、彼の死を防ぐことができなかったということ以上のことを証明するものではない。 治療が役立った可能性はあるが、ワシントンの命を奪った病気を克服するには不十分だったのか、全く役に立たなかったのか、あるいは治療がワシントンの死を早めたのかは分からない。単に一つの結果を観察するだけでは、どの結論が真実であるかを知ることは不可能だ。多くの観察があっても、真実を見極めるのは難しいか、あるいは不可能である。関与する要因が多すぎ、説明の可能性も多すぎ、未知のことも多すぎるからだ。そして、医師たちがすでに治療が効果的だと考える傾向がある場合(実際、そうでなければ処方しないだろう)、そのあいまいさは、治療が本当に効果的であるという楽観的な結論に有利に解釈される可能性が高い。先入観を覆すには、強力な証拠と、単に「患者を血を抜いてみて、良くなるかどうかを見る」というような実験よりも厳密な実験が必要だ。しかし、それは決して行われなかった。 古代ローマの皇帝たちに仕えた2世紀の医師ガレノスを考えてみよう。彼ほど多くの世代の医師に影響を与えた人物はいない。ガレノスの著作は、千年以上にわたって医学の権威の疑いようのない源であった。「医学の真の道を示したのは、私だけである」と、ガレノスはいつもの謙虚さで書いた。しかし、ガレノスは現代的な実験に類似したことを一度も行わなかった。なぜ彼がそれをする必要があったのだろう?実験は、真実が何であるか確信が持てないときに人々が行うものだ。そして、ガレノスは疑念に悩まされることはなかった。どんなに証拠が曖昧に見えようとも、彼の結果はすべて彼が正しいことを確認するものであった。「この治療を受けた者は皆、短期間で回復する。ただし、助からない者は全員が死ぬ」と彼は書いた。「したがって、これは治らないケースにのみ失敗することは明らかである。」 ガレノスは極端な例だが、彼のような人物は医学の歴史の中で繰り返し現れる。彼らは強い信念を持ち、自らの判断に深い信頼を寄せる男性(常に男性である)。彼らは治療を受け入れ、なぜそれが効果的であるかについて大胆な理論を展開し、ライバルを詐欺師やチャラ男と非難し、自らの洞察を熱心に広める。古代ギリシャからガレノス、パラケルスス、ドイツのサミュエル・ハーネマン、アメリカのベンジャミン・ラッシュに至るまで、そうした流れが続いた。19世紀には、アメリカの医学界で正統派医師と、トムソニアン主義のような奇妙な新理論を持つカリスマ的な人物たちとの間で激しい戦いが繰り広げられた。トムソニアン主義は、ほとんどの病気は体内の寒さの過剰によるものだと主張したり、エドウィン・ハートリー・プラットのオリフィシャル手術は、ある批評家が少し誇張して言ったように、「直腸は存在の焦点であり、生命の本質を含み、心臓や脳に通常帰属される機能を果たす」といった根本的な洞察を持っていた。周辺的なものから主流のものまで、ほとんどすべてが間違っており、提供される治療は軽薄なものから危険なものまで様々だった。一部の医師はそれを恐れていたが、大半はいつも通りの業務を続けた。無知と自信は、医学の定義的な特徴であり続けた。 外科医であり歴史家のアイラ・ラトコウが指摘したように、さまざまな治療法や理論の利点について激論を交わす医師たちは「色盲の人々が虹の色について議論しているようなもの」でした。この確信の plague(疫病)に対する治療法は、1747年にイギリスの船の医師ジェームズ・リンドが壊血病に苦しむ12人の水夫をペアに分け、それぞれのペアに異なる治療法(酢、サイダー、硫酸、海水、樹皮のペースト、柑橘類)を与えたことで、発見に近づきました。これは絶望から生まれた実験でした。壊血病は長距離航海をする水夫にとって致命的な脅威であり、医師たちの自信さえも彼らの治療法の無力さを隠すことはできませんでした。リンドは6つの暗闇の中の試みを行い、そのうちの1つが成功しました。柑橘類を与えられた2人の水夫はすぐに回復しました。しかし、一般的な信念とは裏腹に、これは現代の実験時代を迎える「ユリカ」的瞬間ではありませんでした。「リンドは現代的な方法で行動しているように見えましたが、自分が何をしているのかを完全には理解していませんでした」とドゥルイン・バークは指摘しました。「彼は自分の実験を理解することに完全に失敗し、レモンやライムの特別な効果についてさえも自信を持てませんでした。」その後数年間、水夫たちは壊血病にかかり続け、医師たちは無価値な薬を処方し続けました。20世紀になるまで、無作為試験のアイデア、慎重な測定、統計的な力が浸透することはありませんでした。「医学の対象に数値的方法を適用することは、些細で時間を浪費する独創性に過ぎないのか、それとも我々の技術の発展において重要な段階であるのか」と『ランセット』は1921年に問いかけました。イギリスの統計学者オースティン・ブラッドフォード・ヒルは、後者であると力強く応え、現代医療調査のためのテンプレートを示しました。もし全く同じ患者を2つのグループに分け、異なる治療を施せば、結果に違いが生じた場合、その治療が原因であることが分かると彼は書きました。これは一見単純ですが、実際には不可能です。なぜなら、2人の人間は全く同じではなく、たとえ一卵性双生児であってもそうだからです。そのため、実験は被験者間の違いによって混乱してしまいます。解決策は統計にありました。人々を無作為に一方のグループまたは他方のグループに割り当てることで、参加者が十分に多ければ、彼らの間にある違いは相殺されるはずです。そうすれば、観察された結果の違いが治療によって引き起こされたものであると自信を持って結論付けることができます。完璧ではありません。我々の混沌とした世界には完璧は存在しません。しかし、賢者たちが顎を撫でるよりはましです。今日ではこれが驚くほど明白に思えます。無作為化比較試験は今や日常的なものです。しかし、これは革命的でした。なぜなら、医学はこれまで科学的でなかったからです。確かに、時折、病原体理論やX線のように科学の成果を享受することはありました。そして、科学のように装っていました。ケーススタディを行い、報告する印象的な肩書きを持つ教育を受けた男性たちがいました。 ラテン語に満ちた講義が権威ある大学で行われていましたが、それは科学的ではありませんでした。それは「カーゴ・カルト・サイエンス」と呼ばれるもので、物理学者リチャード・ファインマンが後に皮肉を込めて名付けた言葉です。これは、第二次世界大戦後にアメリカの空軍基地が南太平洋の孤島から撤退し、島民たちの外界との唯一の接触が途絶えた後に起こった現象を説明しています。飛行機は驚くべき物品を運んできました。島民たちはもっと欲しがりました。そこで彼らは「滑走路のようなものを作り、滑走路の両側に火を焚き、木製の小屋を作って中に人を座らせ、頭にヘッドフォンのような木の部品を乗せ、竹の棒をアンテナのように突き出させる—彼がコントローラーで、彼らは飛行機が着陸するのを待っている」といったことをしました。しかし、飛行機は決して戻ってきませんでした。カーゴ・カルト・サイエンスは科学の外見を持っていますが、真の科学を成すものが欠けています。医学に欠けていたのは疑念でした。ファインマンは「疑念は恐ろしいものではなく、非常に価値のあるものだ」と観察しました。それは科学を前進させる原動力です。科学者が「答えがわからない」と言ったとき、彼は無知な人です。「どうなるかの直感がある」と言ったとき、彼はそれについて不確かです。「こうなるだろう、賭けてもいい」と言ったとき、彼はまだ何らかの疑念を抱いています。そして、進展を遂げるためには、この無知と疑念を認識することが極めて重要です。疑念があるからこそ、新しいアイデアを探るために新しい方向を提案するのです。科学の発展の速度は、単に観察を行う速度ではなく、むしろ新しいものを創造してテストする速度に大きく依存しています。 医学が非科学的であり、長い間停滞していたのは、疑念と科学的厳密さの欠如によるものでした。 医学を試す 残念ながら、この話は医師たちが突然自分たちの信念を実験的に試すことに目覚めるという形では終わりませんでした。無作為化比較試験のアイデアは、浸透するのに非常に時間がかかり、真剣な試験が試みられたのは第二次世界大戦後のことでした。それらは素晴らしい結果をもたらしました。しかし、医学の近代化を推進した医師や科学者たちは、医療の確立が彼らの努力に興味を示さないか、さらには敵対的であることを日常的に発見しました。「健康管理の名のもとに行われている多くのことは、科学的な検証が欠けている」とアーチー・コクランは1950年代と1960年代の医学について不満を述べ、イギリスの国民保健サービスは「効果的なものを証明し、推進することに対して非常に興味が薄かった」と指摘しました。医師たちと彼らが支配する機関は、自分たちの判断だけが真実を明らかにするという考えを手放したくなかったため、常にそうしてきた方法を続けました—そして彼らは尊敬される権威に支えられていました。彼らは科学的な検証を必要としませんでした。彼らはただ「知っている」と思っていました。コクランはこの態度を軽蔑していました。 彼はそれを「神の複合体」と呼んだ。病院が心臓発作から回復する患者を治療するために心臓ケアユニットを設立したとき、コクランは新しいユニットが従来の治療法、つまり患者を自宅に帰して監視と安静を促す方法よりも良い結果をもたらすかどうかを判断するための無作為試験を提案した。医師たちは反発した。心臓ケアユニットが優れているのは明らかだと言い、患者に最良のケアを提供しないことは非倫理的だと主張した。しかし、コクランは引き下がるような男ではなかった。第二次世界大戦中、捕虜の医師として同じ捕虜たちを治療していた彼は、しばしば権威に立ち向かっていた。時には、銃を乱射するドイツの警備員を大声で叱責することもあった。こうしてコクランは試験を実施することになった。無作為に選ばれた患者の一部は心臓ケアユニットに送られ、他の患者は自宅での監視と安静に送られた。試験の途中で、コクランは彼の実験を止めようとした心臓専門医のグループと会った。彼は予備結果があると伝えた。二つの治療法の結果の違いは統計的に有意ではなかったが、心臓ケアユニットの方がわずかに患者の状態が良いように見えると強調した。「彼らは激しく非難した。『アーチー、私たちはいつもあなたが非倫理的だと思っていた。すぐに試験を中止しなければならない。』」しかし、コクランは少しトリックを仕掛けていた。彼は結果を逆転させていたのだ:自宅ケアの方が心臓ユニットよりもわずかに良い結果を出していた。「その場は静まり返り、私は少し気分が悪くなった。なぜなら、彼らは結局私の医療仲間だったからだ。」囚人の間で異常に高い心臓病の発生率がコクランの注意を司法制度に向けさせ、そこで彼は刑務所の看守や裁判官、内務省の官僚たちの間にも同じような態度を見出した。人々が理解していなかったのは、実際の洞察をもたらす制御された実験の唯一の代替手段は、単に洞察の幻想を生み出す制御されていない実験であるということだった。コクランは、サッチャー政権の「短く、鋭い、衝撃的」なアプローチを引用した。これは、厳格なルールに従った質素な刑務所での短期間の収監を求めるものであった。それは効果があったのか?政府はそれを司法制度全体に実施したため、答えることは不可能だった。もし政策が導入され、犯罪が減少したなら、それは政策が効果を発揮したことを意味するかもしれないし、あるいは犯罪が減少したのは他の百の理由のせいかもしれない。もし犯罪が増加したなら、それは政策が無駄であるか、あるいは有害であることを示すかもしれないし、逆に政策の有益な効果のおかげで犯罪がさらに増加することを防いだのかもしれない。もちろん、政治家たちはそうは言わないだろう。権力を持つ者はそれが効果的だったと言い、反対派は失敗したと言う。しかし、誰も本当のところは分からない。政治家たちは虹の色について議論する盲目の人々のようだった。「もし政府がその政策を無作為化比較試験にかけていたなら、今頃はその真の価値を知り、私たちの考えも進んでいたかもしれない」とコクランは観察した。しかし、実際にはそうはならなかった。 彼は自分の政策が期待通りに機能するだろうと当然のように考えていた。これは、何千年もの間医学を暗黒時代に留めていた無知と自信の有毒な混合物だった。コクランの自伝には、彼のフラストレーションが明確に表れている。なぜ人々は直感だけでは確固たる結論を導くことができないと理解できなかったのか?それは「驚くべきこと」だった。 しかし、この懐疑的な科学者が著名な医師から、自分の体が癌に侵されており、死の準備をするべきだと言われたとき、アーチー・コクランは素直に従った。「それはただ一人の主観的な判断に過ぎない、間違っているかもしれないから病理医の報告を待とう」とは考えなかったし、「なぜ外科医は病理医の意見を聞く前に私の筋肉を切り取ったのか?」とも思わなかった。コクランは医師の結論を事実として受け入れ、死の準備をした。ここには二つの謎がある。まず、コクランの控えめな指摘として、確固たる結論を導くには直感以上のものが必要だということがある。これは明らかに真実である。なぜ人々はそれに抵抗したのか?特に、専門医はなぜコクランの肉を切り取る前に病理医の意見を待とうとしなかったのか?次に、コクラン自身の謎がある。なぜ、判断を急がないことの重要性を強調していた男が、自分が末期癌であるかどうかについて急いで判断を下したのか? 思考について考えること 私たちの思考を意識の中を流れるアイデア、イメージ、計画、感情と同一視するのは自然なことだ。それ以外に何があるだろうか?もし私が「なぜその車を買ったの?」と尋ねれば、あなたは理由を挙げることができる。「燃費が良い。かわいいスタイル。お得な価格。」しかし、思考を共有するためには内省する必要がある。つまり、自分の注意を内側に向け、自分の心の中身を調べることだ。そして、内省は頭の中で渦巻く複雑なプロセスのほんの一部しか捉えることができず、あなたの決定の背後にあるものを理解することは難しい。私たちがどのように考え、決定するかを説明する際、現代の心理学者はしばしば二重システムモデルを用いて、私たちの精神的な宇宙を二つの領域に分ける。システム2は、意識的な思考の馴染みのある領域であり、私たちが焦点を当てることを選ぶすべてを含んでいる。それに対して、システム1は私たちにとってほとんど知られていない領域であり、自動的な知覚や認知の操作が行われる場所だ。今、あなたがこのページの印刷物を意味のある文に変換したり、グラスを取りながら本を持ったりしているのも、このシステム1の働きによるものだ。これらの迅速なプロセスには意識がないが、私たちはそれなしでは機能できない。私たちは機能不全に陥ってしまう。 この二つのシステムの番号付けは偶然ではない。システム1が先に来る。これは速く、常にバックグラウンドで動いている。質問がされ、あなたが瞬時に答えを知っているとき、それはシステム1から生まれたものだ。システム2はその答えを問いただす役割を担っている。それは精査に耐えるのか?証拠に裏付けられているのか?このプロセスには時間と労力がかかるため、意思決定の標準的な流れはこうだ。まずシステム1が答えを出し、その後にシステム2が関与し、システム1の決定を検証することから始まる。 システム2が実際に関与するかどうかは別の問題です。次の質問に答えてみてください。「バットとボールを合わせて1.10ドルです。バットはボールより1ドル高いです。ボールはいくらですか?」この有名な質問を読んだことがあるほとんどの人と同じように、あなたはすぐに「10セント」と答えたでしょう。じっくり考えてその答えを出したわけではなく、計算もしていません。ただ、答えが浮かんできたのです。それはシステム1のおかげです。迅速で簡単、努力は必要ありません。しかし、「10セント」は正しいのでしょうか?質問をよく考えてみてください。おそらくいくつかのことに気づいたでしょう。まず、意識的な思考は負担が大きいということです。問題をじっくり考えるには持続的な集中が必要で、瞬時の判断に比べると時間がかかります。次に、「10セント」は間違いです。正しいように感じますが、実際には間違っています。冷静に考えれば明らかに間違いです。このバットとボールの質問は、認知的反射テストという巧妙な心理的測定の一部であり、ほとんどの人々、特に非常に賢い人々があまり反省的でないことを示しています。彼らは質問を読み、「10セント」と考え、慎重に考えずに「10セント」と最終的な答えを書き留めます。そのため、彼らは間違いに気づくこともなく、正しい答え(5セント)を思いつくこともありません。これは普通の人間の行動です。私たちは強い直感に従う傾向があります。システム1は原始的な心理論に従っています。「真実のように感じるなら、それは真実です。」私たちの脳が進化した旧石器時代の世界では、それは決して悪い意思決定の方法ではありません。すべての証拠を集めてじっくり考えることが正確な答えを導く最良の方法かもしれませんが、草むらの影が動いているのを見て、ライオンについての統計を調べる狩猟採集者は、次の世代に自分の正確さを最大化する遺伝子を残すほど長生きすることはないでしょう。瞬時の判断は時には不可欠です。ダニエル・カーネマンが言うように、「システム1は少ない証拠から結論に飛びつくように設計されています。」では、その草むらの影についてはどうでしょうか?心配すべきでしょうか?草むらからライオンが現れて誰かに飛びかかるのを思い出せますか?その記憶がすぐに思い出せるなら(人々が忘れがちなことではありません)、ライオンの攻撃が一般的だと結論づけるでしょう。そして、心配し始めます。このプロセスを詳しく説明すると、重苦しく、遅く、計算的に聞こえますが、実際にはシステム1の中で完全に行われることができ、自動的で迅速、数分の一秒のうちに完了します。影を見ます。パッ!あなたは恐怖を感じ、走り出します。これが「利用可能性ヒューリスティック」であり、ダニエル・カーネマン、彼の共同研究者アモス・トヴェルスキー、そして判断と選択の急成長する科学の他の研究者たちによって発見されたシステム1の多くの操作の一つです。直感的な判断の特徴はそのようなものです。システム1は、目の前の証拠が欠陥があるか不十分であるか、他により良い証拠があるかどうかを考えることなく、瞬時に強い結論を出す仕事をすることができます。 利用可能な証拠は信頼できるものであり、十分でなければなりません。これらの暗黙の前提はシステム1にとって非常に重要であり、カーネマンはそれに奇妙でありながらも記憶に残るラベルを付けました:WYSIATI(目に見えるものがすべてです)。もちろん、システム1は好きなように結論を出すことはできません。人間の脳は秩序を求めます。世界は理解できるものでなければならず、それは私たちが見たり考えたりすることを説明できる必要があることを意味します。そして、私たちは通常それができます。なぜなら、私たちは世界に一貫性を持たせる物語を作り出すようにプログラムされた創造的な虚構製作者だからです。 想像してみてください。あなたは研究室のテーブルに座っていて、写真の列を見ています。あなたは一枚の写真を選びます。それはシャベルの写真です。なぜそれを指さしているのでしょうか?もちろん、もっと情報がなければ答えることはできません。しかし、もし実際にそのテーブルにいて、指でシャベルの写真を指さしているとしたら、「わからない」と言うのは思ったよりもずっと難しいでしょう。常識的な人々は、自分の行動に対して理にかなった理由を持っていることが期待されます。他の人、特に白衣を着た神経科学者に「なぜかわからない」と言うのは気まずいことです。 著名な研究者マイケル・ガザニガは、常識的な人々が自分の行動の理由を全く理解できないという奇妙な状況を設計しました。彼の被験者は「分離脳」患者であり、これは脳の左右の半球が互いにコミュニケーションを取れない状態を指します。なぜなら、彼らの間の接続である脳梁が外科的に切断されていたからです(これは通常、重度のてんかんの治療法として行われます)。これらの人々は驚くほど普通ですが、彼らの状態は研究者が脳の片方の半球と直接コミュニケーションを取ることを可能にします。つまり、左または右の視野にのみ画像を見せることで、もう一方の半球と情報を共有することなく行うことができます。まるで二人の異なる人と話しているかのようです。 この場合、左の視野(右半球に報告される)は雪嵐の写真を見せられ、その人はそれに関連する写真を指さすように求められました。そこで彼は合理的にシャベルを指さしました。右の視野(左半球に報告される)には鶏の爪の画像が見せられ、その後、なぜ彼の手がシャベルを指さしているのか尋ねられました。左半球はその理由を全く理解していませんでした。しかし、その人は「わからない」とは言いませんでした。代わりに、彼は物語を作り上げました。「ああ、それは簡単だ」とある患者は言いました。「鶏の爪は鶏と一緒で、鶏小屋を掃除するにはシャベルが必要なんだ。」 この説明を求める衝動は、株式市場が閉まるたびに時計のように規則的に現れます。ジャーナリストが「ダウは今日、ニュースを受けて95ポイント上昇しました」と言うときです。迅速に確認すると、実際には市場が上昇した後に出たニュースが市場を動かしたとされることが多いのですが、その最小限の精査はほとんど行われません。ジャーナリストがそのようなことをする日は稀です。 ジャーナリストは言います。「市場は今日、百の異なる理由のいずれか、あるいはその組み合わせで上昇したので、誰にもわからない。」その代わりに、分裂脳の患者がなぜシャベルの絵を指さしているのか全くわからないのに、ジャーナリストは手元にあるもので納得できるストーリーを作り上げます。説明したいという衝動は、ほとんどの場合良いことです。実際、それは現実を理解しようとする人間の努力の原動力です。問題は、混乱や不確実性(「なぜ私の手がシャベルの絵を指しているのかわからない」)から明確で自信に満ちた結論(「ああ、それは簡単だ」)に移るのが早すぎることです。その間に時間をかけることなく(「これは一つの可能な説明だが、他にもある」)。2011年、ノルウェーの首都オスロで大規模な車爆弾が爆発し、8人が死亡、200人以上が負傷したとき、最初の反応はショックでした。ここはオスロ、地球上で最も平和で繁栄した都市の一つです。インターネットやケーブルニュースでは憶測が飛び交いました。これは過激派イスラム主義者に違いない。できるだけ多くの人を殺すことを目的とした車爆弾だ。そして、その車は首相が働くオフィスタワーの外に駐車されていた。イスラム主義者に違いない。ロンドン、マドリード、バリの爆弾事件と同じだ。9/11と同じだ。人々はGoogleで支持情報を探し始めました。彼らは成功しました:ノルウェーはNATOの任務の一環としてアフガニスタンに兵士を派遣している;ノルウェーには統合が不十分なムスリムコミュニティがある;過激派ムスリムの説教者が先週、扇動で起訴されていた。さらに、爆弾事件の後に、さらに衝撃的な犯罪が起こったという知らせが届きました。それは、与党労働党が運営する若者向けのサマーキャンプでの銃乱射事件で、数十人が死亡しました。すべてが一致しました。これらはイスラム過激派テロリストによる連携攻撃でした。疑いの余地はありません。テロリストが国内の過激派かアルカイダに関連しているかはまだわかりませんが、加害者は過激派ムスリムであることは明らかでした。実際、加害者は一人だけでした。彼の名前はアンダース・ブレイビク。彼はムスリムではありません。彼はムスリムを憎んでいます。ブレイビクの攻撃は、彼がノルウェーを裏切ったと感じる多文化主義政策を持つ政府を標的にしたものでした。ブレイビクが逮捕された後、多くの人々が急いで判断を下した人々をイスラム恐怖症だと非難しましたが、理由はなくはありません。彼らの中には、一般的にムスリムを非難することにあまりにも熱心に見えた人もいました。しかし、その時点で知られていた数少ない事実や、前の10年間の大量虐殺テロの歴史を考えると、イスラム過激派テロリストを疑うのは合理的でした。科学者はそれを「もっともらしい仮説」と表現するでしょう。しかし、科学者はそのもっともらしい仮説を非常に異なる方法で扱います。他の誰と同様に、科学者にも直感があります。実際、ひらめきや直感—証明できなくても何かが真実であると感じること—は数え切れないほどのブレークスルーの背後にあります。システム1とシステム2の相互作用は微妙で創造的です。しかし、科学者は慎重であるように訓練されています。 彼らは、ペットの仮説を「真実」として祭り上げたくなる誘惑があっても、代替の説明にも耳を傾けなければならないことを理解しています。そして、自分たちの最初の直感が間違っている可能性を真剣に考慮しなければなりません。実際、科学においては、仮説が真であることを示す最良の証拠は、仮説が偽であることを証明するために設計された実験であり、しかしその実験が失敗することが多いのです。科学者は「私が間違っていると納得させるものは何か?」という質問に答えられなければなりません。もし答えられないなら、それは自分の信念にあまりにも執着しているサインです。重要なのは疑念です。科学者は、他の誰かと同じように「真実」を知っていると強く感じることがあります。しかし、彼らはその感情を脇に置き、より良い研究から得られるより良い証拠によって(ゼロにはならないものの)減少させることができる微妙に測定された疑念に置き換えなければならないことを知っています。このような科学的な慎重さは、人間の本性に反するものです。オスロ以降の推測が示すように、私たちの自然な傾向は、最初のもっともらしい説明にしがみつき、その信頼性を確認せずに支持する証拠を集めることです。これが心理学者が「確認バイアス」と呼ぶものです。私たちは、最初の説明を覆す証拠を求めることはほとんどなく、その証拠が目の前に押し付けられると、私たちは動機づけられた懐疑者となり、それを軽視したり、完全に排除する理由を見つけようとします。ガレンが自信満々に「素晴らしい治療法が、治療を受けたすべての人を治した。ただし「治らないケース」の人々は除いて」と言ったことを思い出してください。それは純粋な確認バイアスでした。「患者が治れば、それは私の治療が効果的である証拠だ。患者が亡くなれば、それは何の意味もない。」これは複雑な世界の正確なメンタルモデルを構築するには不適切な方法ですが、脳の秩序への欲求を満たすには素晴らしい方法です。なぜなら、それはすべてが明確で、一貫しており、解決済みの整然とした説明をもたらすからです。そして「すべてが合致する」という事実は、私たちが真実を知っているという自信を与えてくれます。「それは賢明だ」と高い自信を持つ宣言が続きます。 **BAIT AND SWITCH** 著名な専門医がアーチー・コクランの脇の下を切開したとき、彼は癌に侵されたように見える組織を見ました。それは本当に癌だったのでしょうか?そうであることは理にかなっていました。患者の脇の下にはしこりがあり、手には癌腫がありました。そして数年前、コクランはX線にさらされる研究に関与していたため、最初の医師が専門医に診てもらうよう勧めたのです。すべてが合致していました。これは癌だ。疑う余地はありません。そして、病理医の報告を待つ必要もなく、コクランの筋肉の一部を取り除き、患者に長くは生きられないと告げました。アーチー・コクランの懐疑的な防御は崩れました。なぜなら、コクランは専門医の話が専門医と同じくらい直感的に説得力があると感じたからです。しかし、別のメンタルプロセスも働いていた可能性があります。正式には「属性代替」と呼ばれますが、私はこれを「ベイト・アンド・スイッチ」と呼びます。難しい質問に直面したとき、私たちはしばしばそれを簡単な質問にすり替えます。「長い草の影について心配すべきか?」というのは難しい質問です。 さらなるデータがないと、答えが出せないかもしれません。そこで、より簡単な質問に置き換えます。「長い草の中からライオンが誰かを襲う場面を簡単に思い出せますか?」この質問は元の質問の代理となり、もし二つ目の質問に「はい」と答えられれば、一つ目の質問にも「はい」と答えられることになります。したがって、利用可能性ヒューリスティックは、カーネマンの他のヒューリスティックと同様に、基本的には bait-and-switch(おとり商法)です。そして、利用可能性ヒューリスティックが通常は無意識のうちに行われるシステム1の活動であるのと同様に、bait-and-switchも無意識的に行われます。 もちろん、私たちは常に自分の心の動きに無頓着というわけではありません。誰かが気候変動について尋ねてきた場合、「私は気候学の訓練を受けておらず、科学についても何も読んでいません。自分の知識に基づいて答えようとしたら、めちゃくちゃになってしまうでしょう。知識があるのは気候学者です。だから、『ほとんどの気候学者は気候変動が現実だと思っているのか?』という質問に置き換えます」と言うかもしれません。著名な癌専門医から末期癌であると告げられた普通の人も、同じように意識的にbait-and-switchを行い、医者の言うことを真実として受け入れるかもしれません。しかし、アーチー・コクランは普通の人ではありませんでした。彼は著名な医師でした。彼は病理医が報告していないことを知っていました。医師が自信過剰であることが多く、この「神の複合体」が彼らをひどい間違いに導くことを誰よりもよく知っていました。それでも彼は、専門医が言ったことが真実で最終的な言葉であるとすぐに受け入れました。おそらく、コクランは無意識のうちに「この人は私が癌かどうかを知るべき人なのか?」という質問を「私は癌なのか?」という質問に置き換えたからです。答えは「もちろん!彼は著名な癌専門医です。彼は自分の目で癌の組織を見ました。彼こそが私が癌かどうかを知るべき人です。」というものでした。だからコクランは従ったのです。 私は、誰もが判断を急ぐことが多いと言っても、誰の心の宇宙も揺るがしていないことを理解しています。人間の周りで時間を過ごしたことがある人なら、誰でもそれを知っています。しかし、それは重要です。私たちは、しっかりとした結論を出す前に、ゆっくり考えるべきだと知っています。それでも、問題に直面したとき、理にかなった解決策が思い浮かぶと、私たちはシステム2をバイパスして「答えは10セントだ」と宣言します。アーチー・コクランのような懐疑的な人でさえ、誰もが免疫を持っているわけではありません。この自動的でほとんど努力を要しない世界の考え方をデフォルト設定と呼ぶこともできますが、それでは不十分です。「デフォルト」という言葉は、他の何かにスイッチを切り替えられることを示唆していますが、私たちはそれができません。好むと好まざるとにかかわらず、システム1の働きは、意識の小川の下で止まることなく続いています。より良い比喩は視覚に関するものです。私たちが目を覚まし、自分の鼻の先を見つめる瞬間、視覚や聴覚が脳に流れ込み、システム1が働き始めます。この視点は主観的であり、私たち一人一人にとってユニークです。自分の鼻の先から世界を見ることができるのは、あなただけです。だから、これを「鼻の先の視点」と呼びましょう。 まばたきと考え 鼻の先からの視界が不完全であっても、それを完全に無視すべきではありません。 人気のある書籍では、直感と分析の二分法—「瞬間的な判断」と「考えること」—がしばしば取り上げられ、どちらか一方を選ぶべきだとされています。私は瞬間的な判断よりも考えることを重視するタイプですが、直感と分析の二分法もまた誤った考え方です。選択肢はどちらか一方ではなく、状況に応じてそれらをどのように組み合わせるかということです。この結論は、一方の道を選ぶように単純に促すものほどインスピレーションに満ちてはいませんが、真実であるという利点があります。両方の視点の先駆的な研究者たちもそれを理解しました。ダニエル・カーネマンとアモス・トヴェルスキーがシステム1の欠陥を記録している間、別の心理学者であるゲイリー・クラインは、消防チームの指揮官のような専門家の意思決定を調査し、瞬時の判断が驚くほどうまく機能することを発見しました。 ある指揮官は、日常的なキッチン火災に出動し、部下にリビングルームに立って炎を消すよう命じたとクラインに語りました。最初は火が収まったものの、再び激しく燃え上がりました。指揮官は困惑しました。さらに、キッチン火災の規模に対してリビングルームが驚くほど熱いことに気づきました。そして、なぜこんなにも静かだったのか?それほどの熱を発生させる火災はもっと音を立てるはずです。指揮官は不安を感じ、全員を家の外に出すよう命じました。消防士たちが通りに出た瞬間、リビングルームの床が崩れ落ちました—実際の火の出所はキッチンではなく地下室にあったのです。指揮官はどのようにして彼らが危険な状況にいることを知ったのでしょうか?彼はクラインに超感覚的知覚(ESP)があると言いましたが、それは自分がどうやって知ったのか分からないことを隠すための言い訳に過ぎませんでした。彼はただ「知っていた」のです—それが直感的判断の特徴です。 瞬時の判断に関して、カーネマンとクラインは異なる結論を導き出すこともできましたが、良い科学者として彼らは一緒にパズルを解くことにしました。「私たちは重要な問題のほとんどについて意見が一致しています」と、彼らは2009年の論文で結論づけました。 火の指揮官のような正確な直感には神秘的なものはありません。それはパターン認識です。訓練や経験を通じて、人々は膨大な数と複雑な詳細でパターンを記憶に刻むことができます—たとえば、トッププレイヤーが持つとされる50,000から100,000のチェスの局面などです。もし何かがパターンに合わない場合—例えば、キッチン火災が通常よりも多くの熱を発生させている場合—有能な専門家はそれを即座に感じ取ります。しかし、誰かが焦げたトーストや教会の壁のカビの中に聖母マリアを見つけるたびにわかるように、私たちのパターン認識能力は誤った肯定に対する感受性を伴います。このことに加え、鼻先の視点が明確で説得力がありながらも間違った認識を生む多くの方法があるため、直感はうまく機能することもあれば、壮大に失敗することもあります。直感が妄想を生むか洞察を生むかは、無意識に将来のために登録できる有効な手がかりに満ちた世界で働いているかどうかに依存します。 「例えば、火災の際に建物が崩壊しそうな初期の兆候や、乳児がすぐに感染症の明らかな症状を示す可能性が高いことは、カーネマンとクラインが述べた通りです。一方で、特定の株がどれだけうまくいくかを予測するために利用できる公に入手可能な情報がある可能性は低いです。もしそのような有効な情報が存在すれば、株価はすでにそれを反映しているでしょう。したがって、建物の安定性について経験豊富な消防指揮官の直感や、乳児についての看護師の直感を信頼する理由は、株式ブローカーの直感を信頼する理由よりも多いのです。」カーネマンとクラインはこう述べています。 「手がかりを学ぶことは、機会と努力の問題です。時には手がかりを学ぶのは簡単です。『子供は犬と猫を区別するために何千もの例を必要としません。』しかし、他のパターンは習得するのがはるかに難しく、例えば五万から十万のチェスパターンを学ぶためには約一万時間の練習が必要だと言われています。『学ぶ機会がなければ、有効な直感は偶然の幸運か魔法によるものに過ぎません。』とカーネマンとクラインは結論づけています。『私たちは魔法を信じていません。』」 しかし、注意が必要です。カーネマンとクラインが指摘したように、直感を働かせるために十分な有効な手がかりがあるかどうかを知るのは難しいことが多いのです。そして、明らかに直感が働く場合でも、慎重であることが望ましいのです。「しばしば、私は特定の手を説明できませんが、それが正しいと感じるだけで、私の直感は大抵の場合正しいようです。」とノルウェーの天才チェスプレイヤー、マグヌス・カールセン(世界チェスチャンピオンであり、歴史上最高ランクのプレイヤー)は観察しています。「ある局面を1時間考えると、私は通常ループに入ってしまい、有用なアイデアは出てこないでしょう。私は通常、10秒後には何をするかを知っています。それ以外はダブルチェックです。」カールセンは自分の直感を尊重していますが、直感が裏切ることもあることを知っているため、たくさんの「ダブルチェック」を行います。これは素晴らしい実践です。直感は素晴らしい結果をもたらすこともありますが、時には大きく外れることもあるため、大きな決断を下す前に考える時間があるなら、そうするべきです。そして、今明らかに真実に思えることが後に間違いである可能性があることを受け入れる準備をしておくべきです。 このアドバイスに反論するのは難しいですが、運勢クッキーの格言のように、あまりにも当たり前に感じられます。しかし、直感はしばしば非常に説得力があるため、私たちはそのアドバイスを無視して自分の感覚に従ってしまいます。2012年の大統領選挙の前日、ペギー・ヌーナン(ウォール・ストリート・ジャーナルのコラムニストで、ロナルド・レーガンの元スピーチライター)が行った予測を考えてみてください。ヌーナンは「ロムニーの勝利になる」と書きました。彼女の結論は、ロムニーの集会に集まる大勢の人々に基づいていました。「候補者は『幸せで感謝している』ように見えます。」とヌーナンは観察しました。そして、キャンペーンの一環として参加した誰かが、ヌーナンに「群衆の熱意と喜び」について語ったのです。 ノーナンは結論づけた。「振動は正しい。」彼の振動を嘲笑するのは簡単だ。しかし、私たちの中で、選挙や他の出来事がある方向に進むと確信していたのは誰だろうか?それがそう感じられたからだ。あなたは「振動は正しい」とは言わなかったかもしれないが、その考え方は同じだ。これが「鼻先の視点」の力だ。それは非常に説得力があり、何千年もの間、医師たちは自らの確信を疑うことなく、巨大な規模で不必要な苦しみを引き起こしてきた。進歩が本当に始まったのは、医師たちが自らの鼻先からの視点だけでは何が効果的かを判断するには不十分であることを受け入れたときだ。21世紀の予測は、19世紀の医学にあまりにも似ていることが多い。理論や主張、議論があり、有名な人物たちが自信満々で高額な報酬を受け取っている。しかし、実験や科学と呼べるものはほとんどなく、私たちは多くの人が思っているよりもずっと少ないことを知っている。そして、その代償を払っている。悪い予測は、悪い医学ほど明らかに害を及ぼすことは少ないが、私たちを微妙に悪い決定へと導き、その結果として金銭的損失や機会の喪失、不必要な苦しみ、さらには戦争や死に至ることもある。幸いなことに、医師たちはこの問題の解決策を知っている。それは「疑念の一さじ」だ。 スコアをつける 医師たちが自らを疑うことを学んだとき、彼らはどの治療法が効果的かを科学的にテストするために無作為化比較試験に目を向けた。予測に測定の厳密さを持ち込むのは簡単に思えるかもしれない。予測を集め、その正確さを判断し、数字を足す。それだけだ。すぐに、トム・フリードマンが本当にどれほど優れているかがわかるだろう。しかし、そんなに単純ではない。2007年、マイクロソフトのCEOだったスティーブ・バルマーが行った予測を考えてみてほしい。「iPhoneが市場シェアを獲得する可能性はゼロだ。ゼロだ。」バルマーの予測は悪名高い。Googleで「バルマー」と「最悪のテクノロジー予測」を検索するか、バルマーが好むように「Bing」してみれば、1977年にデジタル機器社の社長が「誰も自宅にコンピュータを欲しがる理由はない」と宣言したような古典とともに、予測の恥の殿堂に彼の予測が刻まれているのを見ることができる。それは適切なことのように思える。なぜなら、バルマーの予測は驚くほど間違っているからだ。「史上最悪のテクノロジー予測トップ10」の著者が2013年に指摘したように、「iPhoneは米国のスマートフォン市場で42%、世界で13.1%のシェアを持っている。」これはかなり「重要」だ。別のジャーナリストが、2013年にバルマーがマイクロソフトを退任すると発表した際に書いたように、「iPhoneだけで、マイクロソフト全体の収益を上回っている。」しかし、バルマーの予測を注意深く分析してみよう。重要な用語は「重要な市場シェア」だ。「重要」とは何を指すのか?バルマーは言わなかった。そして、彼はどの市場について話していたのか?北米?世界?何の市場?スマートフォンそれとも一般的な携帯電話? 緊急の問題を引き起こす未解決の質問が山積みです。予測が何が有効で何が無効かを学ぶための第一歩は、予測を評価することです。そのためには、予測の意味について仮定を立ててはいけません。私たちはその内容を正確に理解する必要があります。予測が正確かどうかについての曖昧さは許されませんが、バルマーの予測には曖昧さがあります。確かに、見た目には間違っているように思えますし、感覚的にも間違っていると感じます。間違っているという強い主張もできます。しかし、それが合理的な疑いを超えて間違っていると言えるのでしょうか?この点について、読者が「法的すぎる」と感じたり、ビル・クリントンの「‘is’の意味は何かによる」という有名な発言を思い出すのも無理はありません。バルマーの言葉の意味は明白に思えますが、彼の言葉を文字通りに読むとそれを支持するものではありません。しかし、彼の発言全体を考慮すると、2007年4月のUSA Todayとのインタビューでの発言は次のようになります。「iPhoneが市場シェアを獲得する可能性はゼロです。ゼロです。これは500ドルの補助金付き商品です。彼らは多くの利益を上げるかもしれません。しかし、実際に販売される13億台の電話を見れば、私たちのソフトウェアが60%、70%、80%の電話に搭載される方が、アップルが得るかもしれない2%や3%よりも良いと思います。」これでいくつかのことが明確になります。まず、バルマーは明らかに世界の携帯電話市場について言及していたので、彼の予測をアメリカや世界のスマートフォン市場シェアと比較するのは間違いです。ガートナーのITコンサルティンググループのデータを使って計算したところ、2013年第3四半期におけるiPhoneの世界の携帯電話販売シェアは約6%でした。これはバルマーが予測した「2%や3%」よりも高いですが、しばしば引用される短縮版とは異なり、笑い飛ばすほどの間違いではありません。また、バルマーはiPhoneがアップルにとって失敗するとは言っていません。実際、彼は「彼らは多くの利益を上げるかもしれません」と言っています。しかし、依然として曖昧さがあります。「重要」と見なされるためには、iPhoneが世界の携帯電話市場の2%や3%を超えてどれだけのシェアを獲得する必要があるのか、バルマーは言っていません。また、「多くの利益」とは具体的にどれくらいの金額を指しているのか、彼は明言していません。では、スティーブ・バルマーの予測はどれほど間違っていたのでしょうか?彼の口調は傲慢で軽視するものでした。USA Todayのインタビューでは、彼はアップルを嘲笑しているように見えます。しかし、彼の言葉は口調よりも微妙であり、彼の予測が間違っていたと確信を持って宣言するにはあまりにも曖昧です。ましてや、予測があまりにも間違っているために「予測の恥の殿堂」に入るべきだとは言えません。最初は新しく洗った窓のように明確に見える予測が、結局は正しいか間違っているかを決定的に判断するにはあまりにも不透明であることは珍しいことではありません。2010年11月に当時の連邦準備制度理事会の議長ベン・バーナンキに送られた公開書簡を考えてみてください。ハーバードの経済史家ニール・ファーガソンや外交問題評議会のアミティ・シェリーズを含む多くの経済学者や評論家の署名があるこの書簡は、連邦準備制度に「量的緩和」として知られる大規模な資産購入政策を停止するよう求めています。 「緩和策」は「通貨の価値下落とインフレのリスクがある」として批判されましたが、そのアドバイスは無視され、量的緩和は続けられました。しかし、その後の数年間で、米ドルは価値を失わず、インフレも上昇しませんでした。投資家で評論家のバリー・リソルツは2013年に、署名者たちが「ひどく間違っていた」と述べました。多くの人々も同意しました。しかし、明らかな反論がありました。「待て。まだ起こっていないが、必ず起こるだろう。」リソルツや批判者たちは、2010年の議論の文脈において、手紙の著者たちは量的緩和が進めば2年か3年以内に通貨の価値下落とインフレが起こると予想していたと主張するかもしれません。確かにそうかもしれませんが、彼らが書いた内容ではありません。手紙には時間枠について何も言及されていません。リソルツが2014年、2015年、あるいは2016年まで待っても問題はありません。どれだけの時間が経過しても、誰かが「ただ待て。必ず来る」と言うことができるのです。また、ドルがどれだけ下落し、インフレがどれだけ上昇すれば「通貨の価値下落とインフレ」と見なされるのかも明確ではありません。さらに悪いことに、手紙ではドルの下落とインフレの上昇は「リスク」とされています。これは、必ずしもそうなるとは限らないことを示唆しています。したがって、予測を文字通りに読むと、価値下落とインフレが起こるかもしれないし、起こらないかもしれないと言っていることになります。もし起こらなければ、その予測が必ずしも間違っているわけではありません。これは著者たちが伝えたかったことではなく、当時人々がその声明を読む際の解釈でもありませんでした。しかし、実際に書かれているのはそういうことです。ここに、私たちが日常的に遭遇する二つの予測があります。これは賢い人々が大きな問題に取り組む真剣な試みです。その意味は明確に思えます。時間が経つと、その正確性は明らかに見えます。しかし、実際にはそうではありません。さまざまな理由から、これらの予測が正しいか間違っているかを全く争いのない形で判断することは不可能です。真実は、真実は捉えにくいのです。予測を評価することは、しばしば考えられているよりもはるかに難しいということを、私は多くの経験を通じて痛感しました。 「ホロコースト…が起こるだろう」 1980年代初頭、多くの思慮深い人々が人類の未来にキノコ雲を見ていました。「私たちが自分自身に正直であるなら、核兵器を廃絶しない限り、ホロコーストが起こる可能性があるだけでなく、必ず起こるだろう」と、ジョナサン・シェルは彼の影響力のある著書『地球の運命』の中で書いています。「今日でなくとも、明日には;今年でなくとも、来年には。」武器競争に対する反対運動は、西側諸国の都市で何百万もの人々を街頭に引き出しました。1982年6月には、ニューヨーク市で推定70万人が行進し、アメリカ史上最大のデモの一つとなりました。1984年には、カーネギー財団とマッカーサー財団からの助成金を受けて、アメリカ国立科学アカデミーの研究部門である国立研究評議会が、「前例のない」任務を担った著名なパネルを招集しました。 「核戦争の回避」というテーマのパネルには、ノーベル賞受賞者の物理学者チャールズ・タウンズ、経済学者ケネス・アロー、そして分類しがたいハーバート・サイモンの3人を含む、さまざまな著名人が参加しました。その中には、数学心理学者のアモス・トヴェルスキーもいました。私は、カリフォルニア大学バークレー校で助教授に昇進したばかりの30歳の政治心理学者であり、パネルの中では最も印象に残らないメンバーでした。私がこの席に座れたのは、華々しい業績によるものではなく、たまたまパネルの目的に関連する独特な研究プログラムのおかげでした。 パネルはしっかりと準備を整え、情報分析官、軍の将校、政府関係者、軍備管理の専門家、ソビエト研究者など、さまざまな専門家を招いて議論を行いました。彼らもまた、非常に優れたメンバーでした。深い知識を持ち、知的で、雄弁でした。そして、彼らは何が起こっているのか、そして私たちがどこに向かっているのかを理解していると自信を持っていました。基本的な事実については、少なくとも意見が一致していました。長年ソビエトの指導者であったレオニード・ブレジネフは1982年に亡くなり、すぐに弱々しい老齢の後任者が登場しましたが、その後もすぐに亡くなり、次にコンスタンチン・チェルネンコが指導者となりましたが、彼もまた長くは持たないと予想されていました。 次に何が起こるかについては意見が分かれました。リベラル派も保守派も、次のソビエト指導者は厳格な共産党員になると広く予想していましたが、その理由については意見が異なりました。リベラルな専門家たちは、ロナルド・レーガン大統領の強硬姿勢がクレムリンの強硬派を強化し、ネオ・スターリニズムの後退と超大国間の関係悪化をもたらすと確信していました。一方、保守的な専門家たちは、ソビエト体制が全体主義的な自己再生の技術をほぼ完璧にしていると考え、新しい指導者も旧指導者と同じであり、ソビエト連邦は引き続き世界平和を脅かし、反乱を支援し隣国を侵略し続けるだろうと考えていました。彼らは自分たちの見解に自信を持っていました。 専門家たちはチェルネンコについては正しかった。彼は1985年3月に亡くなりました。しかし、その後歴史の流れは急変し、カール・マルクスがかつて言ったように、その時知識人は脱落することになります。チェルネンコの死から数時間以内に、政治局はエネルギッシュでカリスマ的な54歳のミハイル・ゴルバチョフを次期ソビエト共産党の書記長に指名しました。ゴルバチョフは迅速かつ劇的に方向転換を行い、グラスノスチ(情報公開)やペレストロイカ(再構築)の政策を通じてソビエト連邦をリベラル化しました。また、アメリカとの関係を正常化し、軍備競争を逆転させようとしました。ロナルド・レーガンは慎重に反応し、その後熱心に支持し、数年のうちに世界は核戦争の危機から、ソビエトとアメリカの指導者を含む多くの人々が核兵器の完全廃絶の可能性を見出す新しい時代へと移行しました。この変化を予見していた専門家はほとんどいませんでした。 しかし、予想外の出来事が起こった後、ほとんどの人々はその理由や次に何が起こるかを自信を持って語るようになりました。リベラル派にとっては、すべてが完璧に理解できるものでした。ソ連経済は崩壊し、新たなソ連の指導者たちはアメリカとの無駄な争いに疲れていました。「こんな生活は続けられない」と、ゴルバチョフは権力を握る前日、妻のライサに言ったのです。これは起こるべくして起こったことでした。だから、正しい視点で振り返れば、それほど驚くべきことではありませんでした。そして、レーガンが評価されるべきではありませんでした。むしろ、彼の「悪の帝国」というレトリックはクレムリンの古参たちを強化し、避けられない事態を遅らせただけでした。保守派にとっても説明は明白でした。レーガンはソ連の挑発を受けて軍拡競争を激化させ、今やゴルバチョフは降参しているのだと。正しい視点で見れば、すべては予測可能でした。私の内なるシニックは、何が起ころうとも専門家たちは自らの予測の失敗を軽視し、常に自分たちが予見していたかのような歴史の流れを描くのが得意だと疑い始めました。結局、世界は非常に重要な出来事に関して大きな驚きを目撃したのです。もしこれが疑念の震えを引き起こさなかったら、何が引き起こすのでしょうか?私はこれらの専門家たちの知性や誠実さを疑っているわけではありません。彼らの中には、私が小学校の頃に大きな科学賞を受賞したり、高い政府の地位にあった人も多くいました。しかし、知性や誠実さだけでは不十分です。国家安全保障のエリートたちは、予知的な時代の著名な医師たちに似ていました。彼らもまた、知性と誠実さにあふれていました。しかし、鼻先の妄想は誰をも欺くことができ、特に最も優れた人々を欺くことがあるのです。 このことから、専門家の予測について考え始めました。1988年のある昼食の際、当時のバークレーの同僚ダニエル・カーネマンが予測可能なアイデアを提案しました。彼は、知性と知識が予測を改善するが、その効果はすぐに薄れるだろうと推測しました。博士号を持ち、数十年の経験を積んだ人々は、ニューヨーク・タイムズの注意深い読者よりもわずかに正確であるだけかもしれません。もちろん、カーネマンは単なる推測をしているに過ぎず、彼の推測もまた推測です。政治専門家の予測精度を真剣にテストした人はいませんでした。そして、この課題を考えれば考えるほど、その理由がわかってきました。タイムラインの問題を考えてみてください。明らかに、時間枠のない予測は無意味です。それにもかかわらず、予測者たちは、ベン・バーナンキへの手紙の中でのように、しばしば時間枠を設定します。彼らは不誠実ではありません、少なくとも通常は。むしろ、彼らは心の中で持っている時間枠についての共有された暗黙の理解に頼っているのです。だから、時間枠のない予測は、作成されたときには無意味に見えないのです。しかし、時間が経つにつれて、記憶は薄れ、かつては誰にとっても明白だった暗黙の時間枠は次第にそうではなくなります。 その結果、予測の「本当の」意味についての面倒な争いがしばしば生じます。今年の出来事が予想されていたのか、それとも来年なのか?この10年なのか、それとも次の10年なのか?時間枠がない限り、これらの議論を誰もが納得する形で解決することは不可能です。特に、名声がかかっている場合はなおさらです。この問題だけでも、多くの日常的な予測が検証不可能なものにしてしまいます。同様に、予測はしばしば重要な用語の明確な定義ではなく、暗黙の理解に依存しています。たとえば、スティーブ・バルマーの予測における「重要な市場シェア」のように。このような曖昧な表現は例外ではなく、むしろ一般的です。そしてこれもまた、予測を検証不可能にします。これらは予測を評価する際の小さな障害の一部です。確率は、はるかに大きな障害です。一部の予測は、何かが起こるか起こらないかを明確に主張しているため、判断が容易です。たとえば、ジョナサン・シェルの核戦争に関する予測のように。「核兵器を廃絶するか、さもなければ『ホロコーストが起こる』」とシェルは書きました。結果的に、どちらの超大国も核兵器を廃棄せず、シェルの本が出版された年にも翌年にも核戦争は起こりませんでした。したがって、シェルの言葉を文字通りに解釈すれば、彼は明らかに間違っていました。しかし、もしシェルが「核戦争が起こる可能性が非常に高い」と言っていたらどうでしょうか?その場合、状況はより不明確になります。シェルはリスクを大げさに誇張したのか、それとも彼が正しかったのか、そして人類がこれまでで最も無謀なロシアンルーレットを生き延びたのかもしれません。この問題を決定的に解決する唯一の方法は、歴史を何百回もやり直すことです。そして、もし文明がその多くのやり直しの中で放射能を帯びた瓦礫の山で終わるなら、私たちはシェルが正しかったことを知るでしょう。しかし、それはできないので、私たちは知ることができません。しかし、私たちが全能の存在であり、その実験を行うことができると想像してみましょう。歴史を何百回もやり直し、その結果63%が核戦争で終わることがわかったとします。シェルは正しかったのでしょうか?おそらく。しかし、私たちは自信を持って言うことはできません。なぜなら、彼が「非常に高い可能性」と言ったときに正確に何を意味していたのかがわからないからです。 これは意味論的な言い争いのように聞こえるかもしれません。しかし、シェルマン・ケントが驚いたように、それはそれ以上のものです。情報機関の世界では、シェルマン・ケントは伝説的存在です。歴史の博士号を持つケントは、1941年に新たに設立された情報調整官(COI)の研究分析部門に参加するためにイェール大学の教職を離れました。COIは戦略情報局(OSS)となり、OSSは中央情報局(CIA)となりました。ケントが1967年にCIAを退職するまでに、彼はアメリカの情報コミュニティが「情報分析」と呼ぶものの方法を大きく変えました。情報分析とは、スパイや監視によって収集された情報を体系的に検討し、それが何を意味するのか、次に何が起こるのかを理解するプロセスです。ケントの仕事におけるキーワードは「推定」です。ケントが書いたように、「推定とは、知らないときに行うことです」。そして、ケントが繰り返し強調したように、私たちは次に何が起こるかを決して本当に知ることはありません。 したがって、予測とは何かが起こる可能性を推定することに他なりません。ケントと彼の同僚たちは、国家情報局という、CIAが利用できるすべての情報を基にそれを統合し、米国政府の最高責任者が次に何をすべきかを決定するのに役立つあらゆることを予測するという仕事を、長年にわたって行ってきました。この局はあまり知られていませんが、非常に影響力のある機関でした。ケントと彼の同僚たちは完璧ではありませんでした。特に悪名高いのは、1962年に発表された推定で、ソ連がキューバに攻撃用ミサイルを配備するほど愚かではないと主張していたことです。しかし実際には、彼らはすでに配備していました。それでも、ケントは高い分析の厳密さを維持していたため、彼らの推定は概ね高く評価されていました。国家情報推定を作成する際には、リスクが高く、言葉の一つ一つが重要でした。ケントはそれぞれの言葉を慎重に考慮しました。しかし、ケントの専門性でさえも混乱を防ぐことはできませんでした。1940年代後半、ユーゴスラビアの共産主義政府がソ連から離脱し、ソ連が侵攻するのではないかという恐れが高まりました。1951年3月、国家情報推定(NIE)29-51が発表されました。「クレムリンがどの行動を取る可能性が高いかを判断することは不可能ですが、[東欧の]軍事および宣伝の準備の程度は、1951年にユーゴスラビアへの攻撃が深刻な可能性として考慮されるべきであることを示しています」と報告書は結論づけました。ほとんどの基準で見れば、これは明確で意味のある言葉です。推定が発表され、政府の高官たちがそれを読んだとき、誰も異なる意見を持ちませんでした。しかし数日後、ケントは外務省の上級官僚と雑談をしていると、その官僚が何気なく「ところで、あなたたちが言う『深刻な可能性』とは何を意味しているのですか?どのくらいの確率を考えていたのですか?」と尋ねました。ケントは悲観的で、攻撃の可能性は65対35だと感じていました。その官僚は驚きました。彼と彼の同僚たちは「深刻な可能性」をはるかに低い確率だと考えていたのです。 困惑したケントはチームに戻り、彼ら全員がNIEで「深刻な可能性」を使うことに同意していたため、各自にその意味について尋ねました。ある分析官は、80対20の確率、つまり侵攻が起こる可能性が高いと考えていました。別の者は、20対80、つまりその逆だと考えていました。他の回答はその極端な間に散らばっていました。ケントは愕然としました。情報を提供しているように見えるフレーズが、実際にはほとんど役に立たないほど曖昧だったのです。あるいは、役に立たないどころか、危険な誤解を生んでしまったのかもしれません。そして、彼らが行ってきた他のすべての作業はどうなっていたのでしょうか?「本当に合意がないまま、5か月分の推定判断について合意しているように見えていたのか?」とケントは1964年のエッセイに書きました。「NIEには『深刻な可能性』や、製作者と読者にとって非常に異なる意味を持つ他の表現が散見されたのか?私たちはこのような文を書くとき、実際に何を言おうとしていたのか?」 ケントが心配するのも無理はなかった。1961年、CIAがカストロ政権を打倒するためにキューバの亡命者たちの小部隊をピッグス湾に上陸させる計画を立てていたとき、ジョン・F・ケネディ大統領は軍に対して偏りのない評価を求めた。統合参謀本部は、その計画には「成功の可能性がある」と結論づけた。「成功の可能性がある」という言葉を書いた人物は、実際には成功の可能性が3対1で失敗するという意味を考えていたと後に語った。しかし、ケネディには「成功の可能性がある」が具体的に何を意味するのかは伝えられず、彼はそれをもっとポジティブな評価だと受け取ったのも無理はなかった。もちろん、もし統合参謀本部が「侵攻は失敗する可能性が3対1だと感じている」と言っていたら、ケネディが計画を中止したかどうかは分からないが、少なくとも彼はその後の未曾有の惨事を承認することについて、もっと真剣に考えたかもしれない。 シャーマン・ケントは解決策を提案した。まず、「可能性」という言葉は、分析者が判断を下さなければならない重要な事柄に対してのみ使うべきであり、合理的に確率を割り当てることができない場合に限るべきだとした。つまり、「可能性がある」というのは、ほぼゼロからほぼ100%までの範囲を持つことを意味する。もちろん、それでは役に立たないので、分析者はできるだけ自分たちの推定の範囲を狭めるべきだ。そして混乱を避けるために、使用する用語には数値的な意味が明確に定められているべきであり、ケントはそれをチャートにまとめた。 一般的な範囲 確実性の可能性 100% 確実 93%(前後6%) ほぼ確実 75%(前後12%) 可能性が高い 50%(前後30%) おそらくそうではない 7%(前後10%) ほぼそうではない 5% 不可能 したがって、国家情報評価が「可能性が高い」と言った場合、それは63%から87%の確率で実現することを意味する。ケントの提案はシンプルで、混乱の余地を大いに減らした。しかし、結局それは採用されなかった。人々は原則として明確さと精度を好んだが、実際に明確で正確な予測を行う段階になると、数字に対してそれほど熱心ではなかった。中には、数字を使うのは不自然だと感じる人もいたが、それは曖昧な言葉を使い続けてきた人にとっては理解できる感情だが、変化に対する弱い反論に過ぎない。その他には、美的な嫌悪感を示す人もいた。言語には独自の詩があり、数値的な確率について明示的に話すのは安っぽいと感じたのだ。まるで賭け屋のように聞こえる。ケントはその反応には感心しなかった。「俺はクソったれの詩人よりも賭け屋の方がいい」と彼は伝説的な返答をした。 当時も今も、より深刻な反対意見は、確率の推定を数字で表現することが、読者に対してそれが客観的な事実であるかのように思わせる可能性があるということだ。それは危険である。しかし、数字を排除することが解決策ではない。数字も言葉と同様に、推定—意見—を表現するものであり、それ以上のものではないと読者に知らせることが重要だ。同様に、数字の精度が「予測者はこの数字が正しいことを正確に知っている」と暗に示していると主張することもできる。しかし、それは意図されたものではなく、推測されるべきではない。 また、「深刻な可能性」といった言葉は、数字が示すことと同じことを示唆していることを忘れないでください。唯一の違いは、数字はそれを明示的に示し、混乱のリスクを減少させることです。そして、もう一つの利点があります。漠然とした考えは漠然とした言葉で簡単に表現できますが、予報士が「深刻な可能性」といった用語を数字に変換することを強いられると、彼らは自分の考え方を慎重に考えなければなりません。このプロセスはメタ認知として知られています。練習を重ねる予報士は、不確実性の微妙な度合いを区別するのが上手くなります。これは、アーティストが微妙なグレーの色合いを区別するのが上手くなるのと同じです。しかし、数字を採用する上でのより根本的な障害は、責任と私が「可能性の誤謬」と呼ぶものに関連しています。気象学者が「雨が降る確率は70%」と言った場合、実際に雨が降らなければ彼女は間違っているのでしょうか?必ずしもそうではありません。彼女の予測は暗黙的に「雨が降らない確率は30%」とも言っています。したがって、雨が降らなければ、彼女の予測は外れたかもしれませんし、正確だったかもしれません。その一つの予測だけでは判断することはできません。確実に知るためには、その日を何百回もやり直す必要があります。その再実行のうち70%で雨が降り、30%で降らなければ、彼女は正確だったことになります。もちろん、私たちは全能の存在ではないので、その日をやり直すことはできませんし、判断することもできません。しかし、人々は判断をします。そして、彼らはいつも同じように判断します。「もしかしたら」のどちら側、つまり50%の側に確率があったのかを見ます。予測が「雨が降る確率は70%」と言い、実際に雨が降れば、人々はその予測が正しかったと思います。逆に、雨が降らなければ、彼らはそれが間違っていたと思います。この単純な誤りは非常に一般的です。洗練された思考を持つ人々でもこの誤りに陥ります。2012年、最高裁判所がオバマケアの合憲性に関する長らく待たれた判決を発表しようとしていたとき、予測市場—人々が可能な結果に賭けることができる市場—は、その法律が無効になる確率を75%と見積もっていました。裁判所がその法律を支持した際、賢明なニューヨーク・タイムズの記者デイビッド・レオンハートは「市場—群衆の知恵—は間違っていた」と宣言しました。 この基本的な誤りの普及は、恐ろしい結果をもたらします。もし情報機関が「ある出来事が起こる確率は65%」と言った場合、それが起こらなければ非難されるリスクがあります。そして、その予測自体が「起こらない確率は35%」と言っているため、それは大きなリスクです。では、安全な選択は何でしょうか?あいまいな言葉を使い続けることです。「十分な可能性」や「深刻な可能性」といった表現を使う予報士は、可能性の誤謬を自分に有利に働かせることができます。もし出来事が起これば、「十分な可能性」は50%よりもかなり大きな意味に遡って解釈されることができ、予報士は的中したことになります。もし起こらなければ、それは50%よりもずっと小さな意味に縮小され、再び予報士は的中したことになります。このような歪んだインセンティブがあるため、人々が確固たる数字よりもあいまいな言葉を好むのは不思議ではありません。 ケントはそのような政治的障壁を克服することができなかったが、年月が経つにつれて数字を使うことの重要性を訴える彼の主張はますます強まった。研究が重なるごとに、人々が「できる」「かもしれない」「おそらく」といった確率的な言葉に非常に異なる意味を付与することが示された。それでも、情報機関は抵抗を続けた。サダム・フセインのいわゆる大量破壊兵器に関する大失敗と、その後の大規模な改革があった後に、ようやく数字で確率を表現することがより受け入れられるようになった。CIAの分析官たちがオバマ大統領に対して、パキスタンの施設にいる謎の男がオサマ・ビン・ラディンである可能性が「70%」または「90%」であると伝えたとき、それはシャーマン・ケントにとって小さな名誉回復となった。他のいくつかの分野では、数字が標準となっている。「わずかな雨の可能性」が天気予報で「30%の雨の可能性」に取って代わられた。しかし、あいまいな表現は依然として非常に一般的で、特にメディアではその空虚さに気づくことはほとんどない。それはただ流れてしまう。「私はヨーロッパの債務危機が未解決で、非常に危機的な状況に近づいていると思います」と、ハーバード大学の経済史家で人気の解説者であるニール・ファーガソンは2012年1月にインタビューで語った。「ギリシャのデフォルトは数日以内の問題かもしれません。」ファーガソンは正しかったのか?「デフォルト」という言葉の一般的な理解は、債務の完全な拒否を含むが、ギリシャはその後数日、数ヶ月、数年の間にそれを行わなかった。しかし、「デフォルト」には技術的な定義もあり、ギリシャはファーガソンの予測の後にそれを行った。ファーガソンはどの定義を使っていたのか?それは明確ではないので、ファーガソンが正しかった可能性はあるが、確信は持てない。しかし、もし何のデフォルトもなかったとしたら、ファーガソンが間違っていたと言えるだろうか?いいえ。彼はギリシャが「かもしれない」と言っただけで、「かもしれない」という言葉は空虚な言葉だ。それは何かが可能であることを意味するが、その可能性の確率については何も言っていない。ほとんど何でも「かもしれない」ことが起こる。私は自信を持って、明日地球がエイリアンに攻撃されるかもしれないと予測できる。そして、もしそうならなかった場合、私は間違っているわけではない。すべての「かもしれない」にはアスタリスクが付いており、「またはそうでないかもしれない」という言葉は細かい文字の中に埋もれている。しかし、インタビュアーはファーガソンの予測の細かい文字に気づかなかったため、彼に明確にするように尋ねることはなかった。 もし私たちが測定と改善に真剣であるなら、これは通用しない。予測には明確に定義された用語とタイムラインが必要であり、数字を使用しなければならない。そしてもう一つ重要なことがある:たくさんの予測が必要だ。私たちは歴史をやり直すことができないので、一つの確率的な予測を判断することはできないが、多くの確率的な予測があればすべてが変わる。気象学者が明日雨の可能性が70%であると言った場合、その予測は判断できないが、彼女が明日、明後日、その次の日と数ヶ月間天気を予測すれば、彼女の予測は集計され、実績が明らかになる。もし彼女の予測が完璧であれば、彼女が雨の可能性が70%と言ったときには70%の確率で雨が降り、30%と言ったときには30%の確率で雨が降る、という具合だ。これをキャリブレーションと呼ぶ。 シンプルなチャートにプロットすることができます。このチャートの対角線は、完璧なキャリブレーションを示しています。 もし気象予報士の曲線がこの線の上に大きく位置している場合、彼女は自信がなさすぎることを意味します。つまり、彼女が「20%の確率で起こる」と言ったことが、実際には50%の確率で起こることになります(このページを参照)。逆に、曲線が線の下に大きく位置している場合、彼女は自信過剰であり、「80%の確率で起こる」と言ったことが、実際には50%の確率でしか起こらないということになります。 キャリブレーションが不正確になる2つの方法:自信がなさすぎる(線の上)と自信過剰(線の下)です。この方法は、毎日新しい天候があるため、天気予報に対してはうまく機能します。しかし、大統領選挙のようなイベントにはあまり適していません。なぜなら、戦争や疫病、その他の衝撃によって真の根本原因が乱されない状態で、統計を成り立たせるために十分な予測を積み上げるには何世紀もかかるからです。少しの創造性が役立つかもしれません。例えば、大統領選挙の州レベルに焦点を当てることで、1回の選挙で50の結果を得ることができます。しかし、それでも問題があります。キャリブレーション計算に必要な多くの予測が、稀なイベントに関する予測を評価することを実用的ではなくし、一般的なイベントであっても、私たちは忍耐強いデータ収集者であり、慎重なデータ解釈者である必要があります。 キャリブレーションが重要であることは間違いありませんが、「完璧なキャリブレーション」が私たちが完璧な予測精度を想像する際に考えるものではありません。完璧とは神のような全知を意味します。「これが起こる」と言って実際に起こる、または「これが起こらない」と言って実際に起こらないことです。これを表す技術用語は「解像度」です。 このページの2つの図は、キャリブレーションと解像度が良い判断の異なる側面をどのように捉えているかを示しています。上の図は完璧なキャリブレーションを示していますが、解像度は低いです。予報士が「何かが起こる確率は40%」と言ったとき、それが40%の確率で起こり、60%と言ったときには60%の確率で起こります。しかし、彼女は40%と60%の間の「多分」の小さな範囲から外れることはありません。下の図は、素晴らしいキャリブレーションと解像度を示しています。再び、キャリブレーションは素晴らしく、予測は期待通りに起こります—40%の予測は40%の確率で実現します。しかし、今回は予報士がより決定的で、実際に起こる事象には高い確率を、起こらない事象には低い確率を適切に割り当てています。 キャリブレーションと解像度を組み合わせることで、良い予報士が何をすべきかを完全に捉えるスコアリングシステムが得られます。例えば、Xの発生確率が70%だと言った場合、Xが実際に起こると、彼女はかなり良い結果を出すべきです。 しかし、Xの発生確率が90%だと言う人は、もっと良い予測をするべきです。そして、Xを100%の自信を持って正しく予測できる人は、高い評価を得るでしょう。しかし、傲慢さには罰が必要です。「Xは確実だ」と言った予測者は、Xが起こらなかった場合に大きな打撃を受けるべきです。その打撃の大きさは議論の余地がありますが、賭けの観点から考えるのが妥当です。もし私が「ヤンキースがドジャースに勝つ可能性は80%」と言い、それに賭けをする用意があるなら、私はあなたに4対1のオッズを提示しています。もしあなたが私の賭けを受け入れ、100ドルを賭けると、ヤンキースが勝った場合には私に100ドルを支払い、ヤンキースが負けた場合には私があなたに400ドルを支払います。しかし、もし私が「ヤンキースの勝利の確率は90%」と言った場合、オッズは9対1に上がります。さらに「勝つ可能性は95%」と言えば、オッズは19対1になります。これは極端です。もしあなたが100ドルを賭けることに同意すれば、ヤンキースが負けた場合、私はあなたに1,900ドルを支払うことになります。私たちの予測のスコアリングシステムは、その痛みを反映するべきです。このシステムの背後にある数学は、1950年にグレン・W・ブライアによって開発され、結果はブライアスコアと呼ばれています。実際、ブライアスコアは、あなたの予測と実際に起こったこととの距離を測定します。したがって、ブライアスコアはゴルフのスコアのようなもので、低い方が良いのです。完璧なスコアは0です。50%の確率での予測や、ランダムな推測の合計は、ブライアスコア0.5を生み出します。最も極端に間違った予測、つまり何かが100%起こると言って実際には起こらない場合、毎回2.0という壊滅的なスコアを得ます。これは真実から最も遠い結果です。 私たちはここまで来ました。明確に定義された条件とタイムラインを持つ予測の質問があります。数字を伴う多くの予測があり、スコアを計算するための数学もあります。人間が可能な限りの曖昧さを排除しました。私たちは新たな啓蒙の時代に突入する準備が整ったのでしょうか? 数学の意味 まだそうではありません。この演習の全体の目的は、予測の正確性を評価し、何が予測において機能し、何が機能しないかを見極めることです。そのためには、ブライアスコアの意味を解釈する必要があり、さらに2つの要素が必要です:ベンチマークと比較可能性です。仮にあなたのブライアスコアが0.2だと発見したとしましょう。それは神のような全知(0)からは遠いですが、チンパンジーのような推測(0.5)よりはずっと良いので、人間として期待される範囲に入ります。しかし、私たちはそれ以上のことを言うことができます。ブライアスコアの意味は、何が予測されているかによって異なります。例えば、アリゾナ州フェニックスの天気を考えてみてください。毎年6月、非常に暑くて晴れます。「常に100%を暑くて晴れに割り当てる」という無思考のルールに従った予測者は、ブライアスコアを0に近づけることができ、0.2を大きく上回ることができます。ここでの適切なスキルのテストは、予測者が無思考で変化なしと予測するよりも良い結果を出せるかどうかです。これは過小評価されているポイントです。 例えば、2012年の大統領選挙後、ネイト・シルバーやプリンストン大学のサム・ワン、その他の世論調査集計者たちは、すべての州の結果を正確に予測したことで称賛されましたが、「変化なし」という単純な予測、つまり2008年に民主党か共和党のどちらかに投票した州は2012年も同じように投票するだろうという予測が48州中48州を当てることができたことにはほとんど誰も気づきませんでした。これは、当時「彼はすべての州を当てた!」という興奮した声が少し過剰だったことを示唆しています。幸いなことに、世論調査集計者たちはプロです。彼らは、予測を改善することが少しずつの積み重ねのゲームであることを理解しています。もう一つの重要な基準は、他の予測者との比較です。誰が他のすべての予測者を上回れるのか?誰がコンセンサス予測を上回れるのか?彼らはどのようにそれを実現するのか?これらの質問に答えるためには、ブライヤースコアを比較する必要がありますが、そのためには公平な条件が求められます。フェニックスの天気を予測するのは、ミズーリ州スプリングフィールドのように天候が非常に変わりやすい場所で予測するよりもはるかに簡単です。したがって、フェニックスの気象学者のブライヤースコアをスプリングフィールドの気象学者と比較するのは不公平です。スプリングフィールドでの0.2のブライヤースコアは、あなたが世界クラスの気象学者であることを示すかもしれません。これは単純なポイントですが、大きな意味を持っています。古い予測を新聞から掘り起こしても、トーナメント以外では、実際の予測者が同じ期間に同じ出来事を正確に予測することはほとんどないため、同じ基準での比較はほとんど得られません。すべてを考慮に入れると、私たちは準備が整いました。アーチー・コクランやエビデンスに基づく医療の他の先駆者たちのように、私たちは慎重に設計された実験を行う必要があります。予測者を集め、大量の質問を明確な時間枠とあいまいでない言葉で投げかけます。予測は数値的な確率スケールを用いて表現される必要があります。そして、時間が経過するのを待ちます。研究者が仕事をきちんとこなしていれば、結果は明確になるでしょう。データを分析し、重要な質問—予測者はどれほど優れているのか?誰が最も優れているのか?彼らを特別なものにしているのは何か?—に答えることができます。 専門的な政治的判断 それが私が1980年代半ばに目指したことですが、初めのうちは厳しい状況に直面しました。最も著名な評論家たちに参加をお願いしても、誰も参加してくれませんでした。それでも、284人の真剣な専門家を集めることに成功しました。彼らは政治や経済のトレンドや出来事を分析することを生業とする専門家たちです。中には大学やシンクタンクで働く学者もいれば、米国政府の機関や世界銀行、国際通貨基金などの国際機関、またはメディアで働く人々もいました。少数は非常に有名で、他の人々は専門コミュニティでよく知られており、キャリアの初期段階にある人々もいました。しかし、私は匿名性を保証する必要がありました。なぜなら、トム・フリードマンのエリートクラスに属していない専門家たちでさえ、職業上の報酬がないために自分の評判を危険にさらすことをためらっていたからです。 匿名性は、参加者が恥ずかしさを恐れずに最善の推測を行うことを保証しました。公の競争の影響については、将来の研究を待たなければなりませんでした。専門家に最初に尋ねた質問は、自分自身に関するものでした。年齢は?(平均は43歳でした。)関連する職務経験は?(平均は12.2年でした。)教育は?(ほとんど全員が大学院での訓練を受けており、半数は博士号を持っていました。)また、彼らのイデオロギー的傾向や政治問題を解決するための好ましいアプローチについても尋ねました。予測に関する質問は、1年から5年、さらには10年先までの時間枠をカバーし、その日のニュースから引き出された多様なトピックに触れました:政治的、経済的、国内的、国際的な問題です。メディアや権力の場で専門家が語っているトピックについて尋ねられたため、専門家たちは時には自分の専門分野で予測を求められましたが、より多くの場合はそうではありませんでした。これにより、真の専門家の予測の正確性を、賢く情報に通じた一般人のそれと比較することができました。合計で、専門家たちは約28,000の予測を行いました。質問をするのに数年かかりました。その後は待つことになり、たとえ終身雇用の職にある者にとっても忍耐が試されました。私は、ミハイル・ゴルバチョフとソ連の政治局が世界の運命を形作る重要なプレーヤーであった時に実験を始めましたが、結果をまとめ始めた頃には、ソ連は歴史の地図上にしか存在せず、ゴルバチョフはピザハットのコマーシャルに出演していました。最終結果は2005年に発表されました。私が国家研究評議会のパネルに参加して予測について考え始めてから21年、6回の大統領選挙、3回の戦争が経過していました。私はそれらを学術論文『専門家の政治判断:その正確さは?どうすればわかるのか?』として発表しました。この研究プログラム全体を「EP」と呼ぶことにします。 そして結果は…もしこの本を読む前にEPJのオチを知らなかったなら、今は知っています:平均的な専門家は、ダーツを投げるチンパンジーとほぼ同じくらいの正確さでした。しかし、入門統計の授業で学生が警告されるように、平均値は隠れた真実を覆い隠すことがあります。したがって、統計学者が片足をオーブンに、もう片方の足を冷凍庫に入れて寝るという古いジョークがありますが、平均温度は快適だからです。EPJの結果には、統計的に区別可能な2つの専門家グループが存在しました。最初のグループはランダムな推測よりも良い結果を出せず、長期予測ではチンパンジーにさえ負けてしまいました。2番目のグループはチンパンジーに勝ちましたが、その差は大きくなく、謙虚である理由は十分にありました。実際、彼らは「常に変化なしを予測する」や「最近の変化率を予測する」といった単純なアルゴリズムにわずかに勝っただけでした。それでも、彼らの予測力は控えめではありましたが、確かに存在していました。では、なぜ一方のグループが他方よりも良い結果を出したのでしょうか?それは、彼らが博士号を持っているか、機密情報にアクセスできるかどうかではありませんでした。また、彼らの考え方、すなわちリベラルか保守的か、楽観的か悲観的かでもありませんでした。重要な要素は、彼らがどのように考えたかでした。 あるグループは「ビッグアイデア」を中心に思考を組織する傾向がありましたが、どのビッグアイデアが真実でどれが虚偽かについては意見が分かれていました。中には環境の破滅を唱える人々(「私たちはすべてを使い果たしている」)もいれば、豊穣を信じる楽観主義者(「すべてのものに対してコスト効果の高い代替品を見つけられる」)もいました。また、経済の重要な部分を国家が管理することを支持する社会主義者もいれば、規制を最小限に抑えたい自由市場の原理主義者もいました。彼らはイデオロギー的には多様でしたが、思考が非常にイデオロギー的であるという点で一致していました。彼らは複雑な問題を好みの因果関係のテンプレートに押し込もうとし、合わないものは無関係な気晴らしとして扱いました。あいまいな答えにはアレルギーを持ち、分析を限界まで押し進め(それ以上も)、自分たちが正しい理由を積み上げながら「さらに」「加えて」といった言葉を使いました。その結果、彼らは異常に自信を持ち、「不可能」や「確実」と宣言することが多かったのです。自分たちの結論に固執し、予測が明らかに外れたときでさえ考えを変えることに消極的でした。「待っていてください」と彼らは言うのです。 もう一つのグループは、より実践的な専門家たちで、直面する特定の問題に応じて多くの分析ツールを使い分けていました。これらの専門家は、できるだけ多くの情報を多様な情報源から集めました。思考する際には、しばしば思考のギアを切り替え、「しかし」「だが」「とはいえ」「一方で」といった移行マーカーを使って話しました。彼らは確実性ではなく、可能性や確率について語りました。そして、誰も「私は間違っていた」と言いたくはありませんが、これらの専門家はより容易にそれを認め、考えを変えることができました。 数十年前、哲学者アイザイア・バーリンは、時代を超えた偉大な著者たちの思考スタイルを比較した高く評価されたがあまり読まれないエッセイを書きました。彼は自らの観察を整理するために、戦士詩人アルキロコスに帰属する2500年前のギリシャの詩の一節を引用しました。「狐は多くのことを知っているが、ハリネズミは一つの大きなことを知っている。」アルキロコスが狐側なのかハリネズミ側なのかは誰にもわかりませんが、バーリンは狐を好みました。私はどちらの側にも立つ必要は感じませんでした。ただ、この比喩が私のデータの中にある深い何かを捉えていると思ったのです。私はビッグアイデアの専門家を「ハリネズミ」と呼び、より多様な専門家を「狐」と名付けました。 狐はハリネズミに勝ちました。そして、狐は単に安全策を取って60%や70%の予測をすることで勝ったわけではなく、ハリネズミが90%や100%の大胆な予測をする中で勝利しました。狐はキャリブレーションと解決能力の両方でハリネズミを上回りました。狐には本物の先見の明がありましたが、ハリネズミにはそれがありませんでした。ハリネズミはどうやってランダムな推測よりもわずかに悪い結果を出すことができたのでしょうか? その質問に答えるために、典型的なハリネズミに出会いましょう。ラリー・クドローはCNBCでビジネス・トークショーをホストし、多くの著作を持つ評論家ですが、彼はレーガン政権で経済学者としてキャリアをスタートさせ、その後、ロナルド・レーガンの経済政策の礎となったアート・ラッファーと共に働きました。クドローの一つの大きなアイデアは供給側経済学です。ジョージ・W・ブッシュ大統領が供給側の処方に従い、大幅な減税を実施した際、クドローは同等の規模の経済ブームが続くと確信しました。彼はそれを「ブッシュ・ブーム」と呼びました。しかし、現実は期待に届きませんでした。成長と雇用創出はプラスでしたが、長期平均に比べるとやや失望を感じさせるものであり、特にクリントン政権時代の大幅な増税から始まった経済成長と比較するとそうでした。それでもクドローは自らの信念を貫き、年々「ブッシュ・ブームは予想通りに起こっている」と主張し続けました。彼はそれを「語られざる最大の物語」と呼びました。2007年12月、金融危機の初期の兆しが見え始めた数ヶ月後、経済は不安定に見え、多くの観察者が景気後退が迫っている、あるいはすでに到来したと心配していましたが、クドローは楽観的でした。「景気後退はない」と彼は書きました。「実際、私たちはブッシュ・ブームの7年目に突入しようとしています。」その後、全米経済研究所は2007年12月を2007-2009年の大不況の公式な始まりと認定しました。月が経つにつれて経済は弱まり、懸念が高まりましたが、クドローは動じませんでした。「景気後退はない、そして景気後退は起こらない」と彼は主張しました。ホワイトハウスが2008年4月に同じことを言ったとき、クドローは「ジョージ・W・ブッシュ大統領は国で最も優れた経済予測者になるかもしれない」と書きました。春から夏にかけて経済は悪化しましたが、クドローはそれを否定しました。「私たちは実際の景気後退ではなく、精神的な景気後退にいる」と彼は書き、そのテーマを9月15日まで繰り返しました。この日、リーマン・ブラザーズが破産を申請し、ウォール街は混乱に陥り、世界の金融システムは凍りつき、人々は急降下するジェット機の乗客のように目を見開き、腕の肘掛けに指を食い込ませました。なぜクドローはこれほどまでに一貫して間違っていたのでしょうか?私たちと同様に、ハリネズミの予測者もまずは目の前の視点から物事を見ます。それは自然なことです。しかし、ハリネズミは「一つの大きなこと」を知っており、次に何が起こるかを考える際に何度もその大きなアイデアを使います。その大きなアイデアは、ハリネズミが決して外さない眼鏡のようなものだと考えてください。ハリネズミはその眼鏡を通してすべてを見ます。そして、それは普通の眼鏡ではありません。エメラルド・シティの訪問者がL・フランク・バウムの『オズの魔法使い』で着用を求められたような、緑色のレンズの眼鏡です。緑色のレンズの眼鏡をかけることは、時には役立つことがあります。なぜなら、それは見過ごされがちな現実の何かを強調するからです。 おそらく、テーブルクロスの中に目に見えない微かな緑の痕跡があるかもしれませんし、流れる水の中に微妙な緑の色合いがあるかもしれません。しかし、もっと頻繁に見られるのは、緑色の眼鏡が現実を歪めることです。どこを見ても緑が見え、実際にそこにあるかどうかは関係ありません。そして、実際にはほとんどの場合、そこにはありません。エメラルドシティは物語の中でもエメラルド色ではなかったのです。人々は緑色の眼鏡を強制的にかけさせられたため、そう思い込んでいただけなのです。したがって、ハリネズミの一つの大きなアイデアは、彼の先見の明を向上させるのではなく、歪めてしまいます。そして、より多くの情報があっても、それは同じ色眼鏡を通して見られるため、役に立ちません。それはハリネズミの自信を高めるかもしれませんが、正確さは向上しません。それは悪い組み合わせです。予測可能な結果は? EPJ研究において、ハリネズミたちが自分たちの専門分野について最もよく知っていることに関して予測を行ったとき、彼らの正確さは低下しました。アメリカ経済はラリー・クドローの専門分野ですが、2008年には経済が危機に瀕していることがますます明らかになっていたにもかかわらず、彼は他の人々が見ていることを見抜けませんでした。彼にはそれが見えなかったのです。すべてが緑に見えたのです。間違っていたことがクドローのキャリアに悪影響を及ぼしたわけではありません。2009年1月、アメリカ経済が大恐慌以来最悪の危機に直面している中、クドローの新番組『クドロー・レポート』がCNBCで放送を開始しました。これもEPJデータと一致しており、有名さと正確さの間には逆相関があることが明らかになっています。専門家が有名であればあるほど、正確性は低くなるのです。これは、編集者やプロデューサー、一般の人々が悪い予測者を探しているからではありません。彼らはハリネズミを探しているのですが、たまたま彼らは悪い予測者なのです。大きなアイデアに駆り立てられたハリネズミは、聴衆を引きつけ、保持するための簡潔で明確なストーリーを語ります。メディアトレーニングを受けたことがある人なら誰でも知っているように、最初のルールは「シンプルに、愚か者よ」です。さらに良いことに、ハリネズミは自信に満ちています。彼らの一つの視点からの分析により、ハリネズミは自分が正しい理由を積み上げることができますが、「さらに」「その上」といった言葉を使いながら、他の視点やそれが引き起こす厄介な疑念や注意点を考慮することはありません。したがって、EPJが示したように、ハリネズミは何かが確実に起こる、または起こらないと言う可能性が高いのです。多くの聴衆にとって、それは満足のいくことです。人々は不確実性を不安に感じる傾向があり、「もしかしたら」という言葉は不確実性を明るい赤いクレヨンで強調します。ハリネズミのシンプルさと自信は先見の明を損ないますが、神経を落ち着かせる効果があります—これはハリネズミのキャリアにとって良いことです。フォックスたちはメディアではあまりうまくいきません。彼らは自信がなく、「確実」や「不可能」と言うことが少なく、「もしかしたら」のニュアンスに落ち着くことが多いです。そして、彼らのストーリーは複雑で、「しかし」や「一方で」といった言葉が多く含まれています。なぜなら、彼らは問題を一つの視点から見た後、別の視点、さらに別の視点から見るからです。この多くの視点を集約することは、テレビには向いていません。しかし、それは良い予測にとっては不可欠です。ドラゴンフライアイ 1906年、伝説的なイギリスの科学者サー・フランシス・ゴルトンは、田舎に行きました。 フェアで行われた試みでは、数百人がそれぞれ「屠殺されて処理された」生の牛の重さを推測する様子が観察されました。彼らの平均的な推測、つまり集団の判断は1,197ポンドで、正解の1,198ポンドよりも1ポンド少ないものでした。これは、ジェームズ・スロウィッキーのベストセラー『群衆の知恵』によって広められ、今ではその名が付けられた現象の最初の実例でした。多くの人々の判断を集約することは、グループの平均的なメンバーの正確さを常に上回り、ガルトンの重さ推測者たちと同じくらい驚くほど正確であることが多いのです。ただし、集団の判断が常に個々の推測よりも正確であるわけではありません。実際、どのグループにもグループを上回る個人が存在する可能性があります。しかし、その的中した推測は、通常、推測者のスキルよりも運の力を示すことが多いのです。これは、同じ演習を何度も繰り返すことで明らかになります。各回でグループを上回る個人が現れますが、それは異なる個人であることが多いのです。平均を一貫して上回るには、稀なスキルが必要です。一部の人々はこれを「集約の奇跡」と呼びますが、簡単に解明できます。重要なのは、有用な情報が広く分散していることを認識することです。ある人が小さな情報を持ち、別の人がより重要な情報を持ち、また別の人がいくつかの情報を持っている、という具合です。ガルトンが屠殺される運命の牛の重さを推測する人々を見ていたとき、彼は彼らが持っている情報を数値に変換する様子を観察していました。肉屋が牛を見たとき、彼は長年の訓練と経験から得た情報を提供しました。肉屋で肉を定期的に購入する男性が推測をしたとき、彼はさらに少し情報を加えました。昨年のフェアで牛の重さを覚えていた第三者も同様に情報を加えました。そして、このように続いていきました。数百人が有効な情報を追加し、個々の持つ情報をはるかに超える集団のプールを作り出しました。もちろん、彼らは神話や間違いも提供し、有用な手がかりと同じくらい大きな誤解を招く手がかりのプールを作り出しました。しかし、両方のプールには重要な違いがありました。有効な情報はすべて1,198ポンドという同じ方向を指していましたが、誤りは異なる源から来ており、異なる方向を指していました。一部は正しい答えが高いと示唆し、一部は低いと示唆しました。したがって、彼らは互いに打ち消し合いました。有効な情報が積み重なり、誤りが相殺されることで、最終的な結果は驚くほど正確な推定値となりました。集約がどれほど効果的かは、何を集約しているかに依存します。何も知らない多くの人々の判断を集約すると、何も得られません。少し知っている人々の判断を集約する方が良く、十分な数がいれば印象的な結果を生むこともありますが、さまざまなことについて多くを知っている同数の人々の判断を集約することが最も効果的です。なぜなら、集団の情報プールがはるかに大きくなるからです。 集約の集約も、印象的な結果を生むことがあります。適切に実施された世論調査は、有権者の意図に関する多くの情報を集約しますが、調査を組み合わせることで「調査の調査」が生まれ、多くの情報源を一つの大きなプールにまとめることができます。これは、ネイト・シルバーやサム・ワン、その他の統計学者たちが2012年の大統領選挙で行ったことの核心です。そして、調査の調査は他のデータソースとさらに集約することができます。ポリーヴォートは、選挙調査、政治専門家のパネルの判断、政治学者が開発した定量モデルなど、多様な情報源を集約して大統領選挙を予測する学術コンソーシアムのプロジェクトです。1990年代から運営されており、調査が変わり、専門家が意見を変える際にも、最終的な勝者をしばしば正確に予測する強い実績があります。 さて、狐が一人で作業するアプローチを見てみましょうが、彼らがすることは、頭の中での集約を行うことです。しかし、このような頭の中での集約は難しい場合があります。0から100の間の数字を当てるゲームを考えてみてください。参加者の中で、誰の予想が全員の平均予想の3分の2に最も近いかを競います。それが全てです。そして、賞品があると想像してください:正解に最も近い読者がロンドンとニューヨーク間のビジネスクラスの航空券を獲得します。実際、フィナンシャル・タイムズは1997年に行動経済学の先駆者リチャード・セイラーの提案でこのコンテストを開催しました。もし私が1997年にフィナンシャル・タイムズを読んでいたら、どうやってそのチケットを手に入れたでしょうか?まず、誰でも0から100の間で何でも予想できるので、予想はランダムに散らばるだろうと考え始めるかもしれません。それなら平均予想は50になります。そして50の3分の2は33です。だから、私は33を予想すべきです。この時点で、私は自分に満足しています。これで決まりだと思っています。しかし、「最終回答」と言う前に、一度考え直し、他の参加者について考えると、彼らも私と同じ思考プロセスを経ていることに気づきます。つまり、彼らも皆33を予想したということです。ということは、平均予想は50ではなく33になります。そして33の3分の2は22です。だから、私の最初の結論は実際には間違っていました。私は22を予想すべきです。今、私は非常に賢い気分になっています。しかし、待ってください!他の参加者も私と同じように他の参加者について考えたはずです。つまり、彼らも皆22を予想したということです。ということは、平均予想は実際には22になります。そして22の3分の2は約15です。だから私は…これがどこに向かっているか分かりますか?参加者たちはお互いを意識しており、さらに自分たちが意識していることを理解しているため、数字は縮小し続け、もはや縮小できないポイントに達します。そのポイントは0です。だから、これが私の最終回答です。そして、私は確実に勝つでしょう。私の論理は完璧です。私はゲーム理論に詳しい高学歴の人間なので、0がナッシュ均衡解と呼ばれることも知っています。証明完了。唯一の疑問は、誰が私と一緒にロンドンに行くかということです。ところが、私は間違っていました。 実際のコンテストでは、多くの人が0まで考えを巡らせましたが、Oは正しい答えではありませんでした。むしろ、全く近い答えでもありませんでした。全ての参加者の平均的な予想は18.91で、優勝した予想は13でした。私はどうしてこんなに間違えたのでしょうか?論理的には正しかったのですが、私は問題を一つの視点、つまり論理の視点からしか見ていなかったのです。他の参加者は誰でしょうか?彼らは皆、この問題を慎重に考え、論理を見抜き、最終的な答えである0に向かって突き進むような人たちなのでしょうか?もし彼らがバルカン人であれば、確かにそうでしょう。しかし、彼らは人間です。フィナンシャル・タイムズの読者は一般の人々より少し賢く、パズルを解くのが得意かもしれませんが、全員が完全に合理的であるわけではありません。中には認知的に怠惰で、他の参加者も自分と同じように問題に取り組んでいることに気づかない人もいるでしょう。彼らは最終的な答えとして33を選ぶかもしれません。ある人たちは論理に気づき、22にたどり着くかもしれませんが、考え続けることをやめてしまうかもしれません。そして実際にそうなったのです—33と22が人気のある答えでした。私はこの異なる視点から問題を考えず、それを自分の判断に組み込まなかったために間違えました。私がすべきだったのは、論理と心理的論理の両方の視点から問題を見て、見えたものを組み合わせることでした。この視点の統合は、二つに限られる必要はありません。セイラーの数字当てゲームでは、第三の視点を想像し、それを使って判断をさらに改善することができます。第一の視点は合理的なバルカン人の視点です。第二の視点は、時には合理的だけれど少し怠惰な人間の視点です。第三の視点は、最初の二つの視点を特定し、それを集約して予想を立てる参加者の視点です。オリジナルのスタートレックのテレビシリーズでは、スポックは冷静に論理的なバルカン人、マッコイは熱血漢の人間、カーク船長はその二つの合成体でした。数字当てゲームでは、スポックの答えは0、マッコイの答えは33—あるいは22かもしれません—で、カーク船長は両方を考慮したでしょう。これをカーク船長の視点と呼ぶことができます。参加者の中にカーク船長が数人しかいなければ、彼らの反応は数学的に大きな変化をもたらさないかもしれません。しかし、もしもっと多くのカーク船長がいれば、彼らの洗練された思考が大きな違いを生む可能性があり、私たちの答えを少しでも改善することができるでしょう。これを自分の判断に組み込むのは簡単ではありません。これは複雑になってきており、最終的な予想が10か11か12かという判断は微妙です。しかし、時にはこれらの微細な違いが良い結果と素晴らしい結果の違いになることがあります。これは後にスーパー予測者たちとともに見ることになるでしょう。そして、三つや四つの視点で止まる理由はありませんが、数字当てゲームではそれが実用的に進められる限界です。 他の文脈では、第四、第五、そして第六の視点が判断をさらに鋭くすることがあります。理論的には、限界はありません。このプロセスの最も良い比喩は、トンボの視覚です。私たちと同様に、トンボも二つの目を持っていますが、それらは非常に異なる構造をしています。それぞれの目は巨大で膨らんだ球体で、その表面は小さなレンズで覆われています。種によっては、一つの目に三万個ものレンズが存在することもあり、それぞれのレンズは隣接するレンズとはわずかに異なる物理的な空間を占めているため、独自の視点を提供します。これらの数千の独特な視点からの情報はトンボの脳に流れ込み、見事な視覚に統合されます。その結果、トンボはほぼすべての方向を同時に見ることができ、高速で飛ぶ昆虫を捕らえるために必要な明瞭さと精度を持っています。トンボのように膨らんだ目を持つキツネは、醜い混合比喩ですが、キツネの先見の明が、緑色の眼鏡をかけたハリネズミよりも優れている理由の一つを捉えています。キツネは視点を集約します。しかし、残念ながら、私たちにとって集約は自然なことではありません。鼻先の視点は、現実を客観的かつ正確に見ていると主張し、他の視点を考慮する必要がないと考えます。私たちはしばしばその意見に同意します。代替の見解を考慮することはありません—明らかに考慮すべきであるときでさえ。これはポーカーのテーブルで痛いほど明らかです。弱いプレイヤーでさえ、原則として、対戦相手の目を通して見ることが重要であることを知っています。「彼女が20ドルベットを上げた?それは彼女の考えや持っているカードについて何を示しているのか?」各ベットは、対戦相手が持っているもの、あるいは持っていると思わせたいものに関する手がかりです。それを組み合わせる唯一の方法は、彼女の席に自分を置いて想像することです。良い視点を持つ人は多くの利益を得ることができます。ですから、ポーカーを真剣に考える人は、すぐに上達するか、別の趣味を始めるだろうと考えるかもしれません。しかし、実際にはそうならないことが多いのです。「非常にシンプルな例を挙げましょう」と、エリートプロのポーカープレイヤーであり、ワールドシリーズ・オブ・ポーカーの優勝者、心理学の博士課程を修了したアニー・デュークは言います。「ポーカーをプレイする誰もが、フォールド、コール、またはレイズができることを知っています。ですから、専門家でないプレイヤーが他のプレイヤーのレイズを見たとき、彼らは自動的にそのプレイヤーが強いと仮定します。まるでベットのサイズがその人の手の強さと何らかの形で相関しているかのように。」これは間違いです。デュークはポーカーを教えており、学生たちにトンボのように見ることを理解させるために、ゲームの状況を通じて彼らを導きます。手札が配られます。あなたは自分のカードが気に入ります。いくつかのラウンドのベッティングの最初で、あなたはある金額を賭けます。他のプレイヤーはすぐにあなたのベットを大幅に上げます。さて、あなたは他のプレイヤーが何を持っていると思いますか?デュークは何千人もの学生に教えてきましたが、「彼らは皆、‘彼らは本当に強い手を持っていると思う’と言います。」それから彼女は、同じ状況を想像するように彼らに求めます。ただし、彼女と対戦しているとします。 役に立つ。”カードが配られた。彼らの手札は強力を超え、無敵だ。デュークは賭けをする。さて、あなたはどうする?彼女の賭けを上げる?「彼らは私に言う、『いや、そうじゃない』。」もし彼らが賭けを上げれば、デュークは彼らの手札が強いと判断し、フォールドするかもしれない。彼らは彼女を怖がらせたくない。彼らはデュークが各ラウンドの賭けに参加し続けることを望んでおり、ポットをできるだけ大きくしたいのだ。だから、彼らは賭けを上げない。彼らはただコールする。デュークは次に、勝てる可能性があるが、まだ打ち負かされる手札を持っているという仮定を彼らに示す。賭けを上げる?いいえ。もう少し弱いが、まだ勝つ可能性が高い手札はどうか?賭けを上げない。 「彼らは本当に素晴らしい手札を持っていても、私を追い払いたくないから、決して賭けを上げない。」それからデュークは彼らに尋ねる。「なぜ、賭けを上げる相手は強い手札を持っていると仮定するのですか?あなたが同じ強い手札で賭けを上げないのに。」デュークは言う。「私がこの演習を通して彼らを導くまで、人々は相手の視点からテーブルを真に見ることができていないことに気づかない。」もしデュークの生徒たちが全員、初めてポーカーを試す退職後のバカンスを楽しんでいる人たちであれば、これは単に素人がナイーブであることを示すだけだ。しかし、「彼らは十分にポーカーをプレイしていて、ゲームに情熱を持ち、自分自身を十分に上手だと考えている人たちで、私とのセミナーに千ドルを支払っている」とデュークは言う。「そして、彼らはこの基本的な概念を理解していない。」自分自身を超えて、現実を異なる視点から見ることは難しい。しかし、フォックスはそれを試みる可能性が高い。気質や習慣、意識的な努力によって、彼らは他の視点を考慮するという難しい作業に取り組む傾向がある。しかし、古い反射性逆説のジョークを思い出してほしい。世界には二種類の人間がいる:二種類の人間がいると思っている人と、そう思わない人。私は後者だ。私のフォックス/ハリネズミモデルは二分法ではない。それはスペクトラムだ。EPJでは、私の分析は「ハイブリッド」と呼ぶものにまで広がった。「フォックス・ハリネズミ」、つまりスペクトラムのハリネズミ側に少し近いフォックスと、「ハリネズミ・フォックス」、つまり少しフォックスらしさを持ったハリネズミだ。しかし、カテゴリーを四つに広げても、人々の思考スタイルを捉えることはできない。人々は状況によって異なる考え方をすることができ、仕事では冷静で計算高いかもしれないが、買い物の際には直感的で衝動的になることもある。そして、私たちの思考習慣は不変ではない。時には、変化に気づかないうちに進化することもある。しかし、私たちは努力によって、一つのモードから別のモードに切り替えることもできる。どのモデルも人間の本質の豊かさを捉えることはできない。モデルは物事を単純化するためのものであり、だからこそ、どんなに優れたものでも欠陥がある。しかし、モデルは必要だ。私たちの心はモデルで満ちている。モデルがなければ機能しないし、私たちはしばしば、いくつかのモデルが現実の良い近似であるため、うまく機能している。「すべてのモデルは間違っている」と統計学者のジョージ・ボックスは観察した。「しかし、いくつかは役に立つ。」 「役立つ。」フォックス/ハリネズミモデルは出発点であり、終わりではない。ダーツを投げるチンパンジーのジョークは忘れよう。重要なのは、EPが控えめながらも実際の予測能力を見出したことであり、その重要な要素は思考のスタイルだった。次のステップは、その洞察をどのように進めるかを考えることだった。 スーパーフォアキャスターたちはこう判断した。「イラクは国連の決議や制限に反して、大量破壊兵器(WMD)プログラムを続けている。バグダッドは化学兵器や生物兵器を保有しており、国連の制限を超える射程のミサイルも持っている。もし放置されれば、今後10年以内に核兵器を持つ可能性が高い。」 この言葉は平坦だが、2002年10月に公表されたときには人々の関心を引くものであった。テロリストたちは13か月前に9/11の凶悪事件を引き起こしていた。アメリカはタリバンを排除するためにアフガニスタンに侵攻し、タリバンはオサマ・ビン・ラディンをかくまっていた。その後、ジョージ・W・ブッシュ政権はサダム・フセインのイラクに目を向け、イラクがアルカイダとつながりがあること、イラクが9/11の背後にいること、中東の他の国々やその地域から流れる石油に対して脅威であること、イラクが国連の要求に従ってWMDを破棄していないこと、そしてその在庫を増やしており、日々危険度が増していることを示唆した。ホワイトハウスは、サダム・フセインがヨーロッパを攻撃する能力を持っている、あるいはすぐに持つことになると主張した。批評家たちは、政権がとっくにイラク侵攻を決定しており、鮮やかな言葉を使って脅威を誇張していると反論した。「我々は、煙を上げる銃がキノコ雲であることを望んでいない」とコンドリーザ・ライスは述べた。これにより、戦争への支持を煽るためのものであるとされた。 その時、国家情報評価2002-16HCが発表された。国家情報評価は、中央情報局(CIA)、国家安全保障局(NSA)、防衛情報局(DIA)、および他の13の機関の合意見解である。これらの機関は総称して情報コミュニティ(IC)と呼ばれる。正確な数字は機密だが、ざっくりとした推定によれば、ICの予算は500億ドル以上で、10万人以上の職員が働いている。その中で、2万人が情報分析官であり、彼らの仕事は情報を収集することではなく、収集された情報を理解し、国家安全保障に対するその影響を判断することである。そして、この非常に複雑で高価で経験豊富な情報機関は、2002年10月にブッシュ政権のイラクWMDに関する主要な主張が正しいと結論付けた。多くの人々はそれを説得力があると感じた。情報の役割は権力に真実を伝えることであり、一時的に権力を握っている政治家たちが聞きたいことを伝えることではない。したがって、NIEはこの問題を解決した。サダム・フセインが活動中のWMDプログラムを持ち、致命的な武器を生産していることは事実であり、その脅威は増大していた。これらの事実にどう対処するかは別の問題だが、政治に目がくらんでいる者だけがそれを否定するだろう。 ブッシュ政権を厳しく批判していた人々、例えばトム・フリードマンのように「ブッシュ派」と揶揄した人たちでさえ、サダム・フセインがどこかで何かを隠していると確信していました。しかし、今ではそれらの「事実」が誤りであったことがわかっています。2003年にアメリカがイラクに侵攻した際、WMD(大量破壊兵器)を探し回りましたが、何も見つかりませんでした。これは現代史における最悪の、あるいは最もひどい情報機関の失敗の一つです。情報機関は屈辱を味わいました。メディアからの非難、公式調査、そして情報機関の職員が公聴会で汗をかきながら厳しい表情で座っている様子が繰り返され、議会の委員会が交代で彼らを責め立てました。何が間違っていたのでしょうか?一つの説明は、情報機関がホワイトハウスの圧力に屈したというものでした。情報が政治化されていたのです。しかし、公式調査はその主張を否定しました。ロバート・ジャーヴィスも同様です。彼の見解はより説得力があると私は感じます。なぜなら、ジャーヴィスは情報に関する洞察に満ちた非党派的な学問を40年以上にわたって行ってきたからです。ジャーヴィスは『Why Intelligence Fails』の著者であり、1979年のイラン革命を予見できなかった情報機関の失敗を詳細に分析しています(ジャーヴィスはCIAのために行った事後分析は数十年間機密扱いでした)。また、サダム・フセインのWMDに関する誤報についても同様です。この場合、ジャーヴィスは情報機関の結論は誠実であり、合理的だったと判断しました。「しかし、その結論は合理的ではなかった」とあなたは思うかもしれません。「間違っていたのです!」その反応は全く理解できますが、それもまた間違いです。重要なのは「情報機関の判断は正しかったのか?」ではなく、「情報機関の判断は合理的だったのか?」ということです。この質問に答えるためには、その時点で判断を下していた人々の立場に自分を置く必要があります。つまり、その時に利用可能だった情報だけを考慮する必要があり、その証拠はほぼすべての主要な情報機関がサダムが何かを隠していると疑うに足るものでした。彼が何を隠しているのかを見たからではなく、サダムが何かを隠しているように振る舞っていたからです。国連の武器査察官とかくれんぼをすることが、侵攻や自らの崩壊を引き起こすリスクを伴うのに、他にどんな説明があるのでしょうか?しかし、精神的なタイムトラベルほど難しいことはありません。歴史家でさえ、その時代の人々の立場に自分を置き、後に何が起こったかの知識に影響されないようにするのは難しいのです。したがって、「情報機関の判断は合理的だったのか?」という質問は挑戦的です。しかし、「情報機関の判断は正しかったのか?」という質問には簡単に答えられます。第2章で述べたように、そのような状況は私たちを難しい質問から簡単な質問に置き換える誘惑に駆り立てます。難しい質問を簡単な質問に置き換え、それに答えた後に、私たちが難しい質問に答えたと心から信じるのです。この特定の手法—「それは良い決定だったのか?」を「良い結果をもたらしたのか?」に置き換えること—は人気があり、また有害です。賢いポーカーのプレイヤーは、この間違いを初心者の失敗と見なします。 の最も重要な教訓である。”初心者は、次のカードが勝利をもたらす確率を過大評価し、大きく賭けて運良く勝つことがあるが、その勝利が彼女の愚かな賭けを賢明にするわけではない。逆に、プロは勝利の確率が高いことを正しく見極め、大きく賭けて運が悪く負けることもあるが、それが彼女の賭けを愚かにするわけではない。優れたポーカーのプレイヤー、投資家、経営者は皆、このことを理解している。もし彼らが理解していなければ、自分の仕事で優れた成果を維持することはできない。なぜなら、経験から誤った教訓を引き出し、時間とともに判断力を悪化させてしまうからだ。したがって、ロバート・ジャーヴィスが述べたように、情報機関の結論が合理的でありながらも間違っていたと結論づけることは矛盾しているわけではない。しかし、ここが重要な点だが、ジャーヴィスは情報機関を免責しなかった。「誤りがあっただけでなく、修正可能な誤りもあった」と彼は情報機関の分析について書いている。「分析はもっと良くできたし、すべきだった。」それが違いを生んだだろうか?ある意味では、そうではない。「結果として、情報評価は確実性が低くなるだけで、根本的に異なる結論には至らなかった。」したがって、情報機関は依然としてサダムが大量破壊兵器を持っていると結論づけただろうが、その結論に対する自信ははるかに低かっただろう。それは穏やかな批判のように聞こえるかもしれないが、実際には壊滅的なものである。情報機関の自信が低ければ、議会の一部が侵攻を支持するための基準を「合理的な疑いを超えて」と設定していた場合、サダムが大量破壊兵器を生産しているという60%や70%の推定は彼らを満足させなかったかもしれない。武力行使を承認する議会決議は通過しなかったかもしれず、アメリカは侵攻しなかったかもしれない。数千の命と数兆ドルの利害がかかる状況は、そうそうない。 しかし、NIE 2002-16HCは60%や70%とは言っていなかった。「イラクは…」「バグダッドは…」というような表現は、驚きの可能性を全く認めていない。それは「太陽は東から昇り、西に沈む」と同じである。2002年12月12日のホワイトハウスのブリーフィングで、CIA長官のジョージ・テネットは「スラムダンク」という表現を使った。彼は後にその引用が文脈から外れていると抗議したが、ここでは重要ではない。なぜなら「スラムダンク」は確かに情報機関の態度を要約していたからだ。そして、それは異常だった。情報分析は常に不確実性を伴い、しばしば大きな不確実性を含む。アナリストたちはそれを知っている。しかし、イラクの大量破壊兵器に関して、情報機関は傲慢に陥った。その結果、単に間違っていただけでなく、間違っているはずがないと言ったときに間違っていた。事後分析では、情報機関が自らの誤りを真剣に探求したことがなかったことが明らかになった。「支配的な見解を攻撃するための『レッドチーム』は存在せず、悪魔の代弁者からの分析もなく、競合する可能性を提供する文書もなかった」とジャーヴィスは書いている。「最も注目すべきは、誰も私たちが今真実だと信じている見解に近い意見を提案しなかったことだ。」大統領の調査がこの惨事を厳しく指摘したように、「サダムが禁止された武器プログラムを終了したと結論づけられなかったことは、最も重要な教訓の一つである。」 物事を考慮することすらしないのは、別の問題です。情報機関(IC)は巨大な官僚機構であり、大きな失敗に対してもゆっくりと反応します。ジャーヴィスは、1979年のイラン革命を予見できなかった失敗についての事後分析を終えた後、CIAの政治分析部門の責任者に会った際のことを語りました。彼女は「私たちから何も聞いていないことは、あなたの懸念を裏付けるものだと思いますが、大きな会議と分析、議論を行うつもりです」と言ったそうです。しかし、その会議は結局実現しませんでした。WMD(大量破壊兵器)に関する失敗の衝撃は異なり、官僚機構はその基盤を揺るがされました。「彼らはそれを真剣に受け止めました」とジャーヴィスは言います。 2006年、情報先端研究プロジェクト活動(IARPA)が設立されました。その使命は、情報機関をより賢く、より効果的にする可能性のある最先端の研究に資金を提供することです。その名が示すように、IARPAはDARPA(国防高等研究計画局)をモデルにしており、DARPAの軍事関連の研究は現代世界に大きな影響を与えています。DARPAの研究は、インターネットの発明にも寄与しました。2008年、国家情報長官室は、16の情報機関全体を統括する機関であり、ナショナルリサーチカウンシルに委員会を設立するよう依頼しました。その任務は、良い判断に関する研究を統合し、情報機関がその研究を有効に活用できるよう支援することでした。ワシントンの基準からすると、これは大胆(あるいは無謀)な試みでした。官僚機構が、世界で最も尊敬される科学機関の一つに対して、官僚機構が無知である可能性を示す客観的な報告書を作成するよう依頼することは、日常的には行われません。さまざまな分野の著名な科学者が委員会に参加し、心理学者のバルーク・フィッシュホフが議長を務めました。私もその場にいました。おそらく、2005年の著書『Expert Political Judgment』での「ダーツを投げるチンパンジーに勝てるか?」という挑戦が物議を醸したためでしょう。2年後、私たちは100%アーチー・コクランの原則に基づいた報告書を提出しました。「情報機関は、よく文書化された行動原則に反する分析手法や、その直感的な魅力を超えて効果の証拠がない手法に依存すべきではない」と報告書は指摘しています。情報機関は「現在および提案された手法を、できるだけ現実的な条件下で厳密にテストすべきです。このような証拠に基づく分析アプローチは、情報機関が国家の敵よりも賢く、機敏であり続けるために必要な継続的な学習を促進します」と述べています。 これはシンプルなアイデアですが、長い間医学の分野でもそうであったように、日常的に見落とされています。たとえば、CIAは、元アナリストのリチャーズ・ヒューアーが書いたマニュアルをアナリストに提供しており、心理学からの関連する洞察、特にアナリストの思考を妨げるバイアスについて説明しています。これは素晴らしい仕事です。そして、アナリストに心理学の基本を理解させることが、認知の罠を避け、より良い判断を生む助けになるというのは理にかなっています。 しかし、それは本当にそうなのでしょうか?誰もわかりません。これまでにテストされたことはありません。一部のアナリストは、そのトレーニングが直感的に非常に説得力があるため、テストする必要がないと考えています。聞き覚えがありますか?50億ドルの質問、つまり「情報分析官の予測はどれほど正確なのか?」という問いにも答えられません。もちろん、何人かは自分たちが知っていると思っています。高官たちは、情報コミュニティ(IC)が80%または90%の確率で正しいと主張するかもしれません。しかし、これらは単なる推測に過ぎません。19世紀の医師たちが、自分たちの治療法が80%または90%の確率で患者を治していると確信していたのと同じように、彼らが正しいか、ほぼ正しいか、あるいは非常に間違っている可能性があります。正確性の指標がない限り、情報分析官の正確性に対して意味のある責任を問うことはできません。最後の文にある「意味のある」という言葉に注目してください。国家情報長官が誤った判断で議会に引きずり出されることは、正確性に対する責任です。それは誤った情報や気まぐれに基づいているかもしれず、政治的なパフォーマンス以上の目的はないかもしれませんが、それでも責任です。それに対して、意味のある責任は、何かがうまくいかなかったときに動揺するだけでは不十分です。正確性を体系的に追跡することが必要です—前述の理由からです。しかし、情報コミュニティの予測はこれまで体系的に評価されたことがありません。代わりにあるのはプロセスに対する責任です:情報分析官は、研究、思考、判断を行う際に何を期待されているかを指示され、その基準に従って責任を問われます。代替仮説を考慮しましたか?反証となる証拠を探しましたか?これは理にかなったことですが、予測を立てる目的は「予測を作る方法」のチェックリストのすべての項目にチェックを入れることではありません。未来を予見することです。プロセスに対する責任はあるが、正確性に対する責任がないのは、医師が手を洗い、患者を診察し、すべての症状を考慮することを確保する一方で、治療が効果的かどうかを確認しないのと同じです。情報コミュニティだけがこのように運営しているわけではありません。正確性を確認せずに予測を作成または購入する組織のリストは驚くべきものです。しかし、イラクのWMDの失敗という衝撃や、国家研究評議会の報告書の促し、そして一部の献身的な公務員の努力のおかげで、ICは何かをすることに決めました。より正確に言えば、IARPAが決定しました。情報先進研究プロジェクト活動(IARPA)は、情報コミュニティの外ではほとんど知られていない機関であり、その理由も明白です。IARPAには、スパイが隠密行動をすることも、情報を解釈するアナリストもいません。その仕事は、ICの能力を向上させる可能性のある高リスク・高リターンの研究を特定し、支援することです。これにより、IARPAはDARPAに似ていますが、DARPAは規模が大きく、設立されてからの期間も長く、しばしば革新的な技術に資金を提供するため、はるかに有名です。ほとんどの情報研究はそれほどエキゾチックではありませんが、国家安全保障にとって同じくらい重要であることもあります。2010年の夏、IARPAの2人の職員、ジェイソン・マセニーとスティーブ・リーバーは、バークレーを訪れました。 バーバラ・メラーズと私は、観光客向けのサンフランシスコの眺めが楽しめるホテルで彼らに会った。そこで彼らは、景色と同じくらい嬉しいニュースを伝えてくれた。彼らは、ナショナルリサーチカウンシルの報告書における重要な推奨事項に基づいて行動する計画を立てていた。この推奨事項は、私が自信を持って「ほこりをかぶるだろう」と予測していたものだ。IARPAは、情報分析官が日々行う予測の方法を発明するための大規模なトーナメントをスポンサーすることにした。チュニジアの大統領は、来月中に快適な亡命先に逃げるのか? 中国でのH5N1の発生は、今後6か月で10人以上の命を奪うのか? ユーロは今後12か月で1.20ドルを下回るのか? IARPAは、ニューヨーク・タイムズを注意深く読む人なら誰でも正解できるほど簡単でもなく、誰もが正解できないほど難しくもない、いわゆる「ゴルディロックスゾーン」の難易度の質問を探していた。IARPAは、このゴルディロックスゾーンを新しい予測の才能を見つけるためと、才能を育成する新しい方法をテストするための最適な場所と見なしていた。提案されたトーナメントは、私の以前のEPJトーナメントとはかなり異なる設計となっており、彼らの最も長い質問は、私の最も短い質問よりも通常は短くなるだろう。IARPAは、今やほぼ不可能であることが分かっていることを人々にやらせるためにお金を無駄にしたくなかった。人間の視覚システムは、100メートル先のスネレン視力検査チャートの最下行を読むことは決してできないし、目の筋肉を永遠に鍛え続けてもそれは変わらない。そして、EPJや他の研究が示すように、人間の認知システムは、個人や国家の人生の転機を数年先まで予測することは決してできないし、スーパー予測者を探すための英雄的な努力もそれを変えることはできない。IARPAの計画は、トップ研究者がゴルディロックスゾーンの質問に対して正確な確率推定を生成するためのトーナメントスタイルのインセンティブを作り出すことだった。研究チームは互いに競い合い、独立したコントロールグループとも競争することになる。チームは、コントロールグループの「群衆の知恵」による予測を上回らなければならず、そのマージンは私たち全員が intimidating(威圧的)と感じるものであった。初年度、IARPAはチームにその基準を20%上回ることを求め、4年目にはその勝利のマージンを50%にまで引き上げることを望んでいた。しかし、それはIARPAの計画の一部に過ぎなかった。各チーム内で、研究者はアーチー・コクランスタイルの実験を行い、内部コントロールグループに対して何が本当に効果的かを評価することができた。研究者は、例えば、予測者に基本的なトレーニングを提供することでその精度が向上すると考えるかもしれない。しかし、すべての予測者を単に訓練した場合、それが何を証明するのだろうか? もし予測者の精度が上がったとしたら、それはトレーニングが効果的だったからかもしれないし、質問が簡単になったからかもしれないし、単に予測者が運が良かっただけかもしれない。もし精度が下がったとしたら、それはトレーニングが逆効果だったからかもしれないし、トレーニングがなければさらに精度が低下していたかもしれない。知る方法はなかった。この問題を認識していますか? それは医療の歴史を通じて医師たちが直面してきた問題なのだ。 アーチー・コクランは解決策を見出しました。それは、自分が知らないことを知っているふりをするのをやめ、実験を始めることです。予測者の中から無作為に選ばれたグループにトレーニングを行い、別のグループには行わない。その他の条件は全て一定に保ち、結果を比較します。もしトレーニングを受けたグループの予測精度が向上し、未受講のグループがそうでなければ、そのトレーニングは成功したことになります。研究の可能性は想像力次第で無限ですが、それを活用するためには多くの予測者が必要でした。私の同僚たちと私は、ブログや専門ネットワークを通じて呼びかけました。「世界の未来を予測したいですか?これはあなたのチャンスです。自宅を離れる必要はなく、毎日少しの時間を使って政治経済のパズルについて考え、最善の推測をしてください。」私たちのリクルート活動は実を結びました。最初の年には数千人のボランティアが参加し、約3,200人が初期の心理測定テストを通過して予測を始めました。私たちはこの研究チームとプログラムを「グッド・ジャッジメント・プロジェクト」と名付けました。この規模のプロジェクトには年間何百万ドルもの費用がかかります。しかし、IARPAがこれを行うことが官僚的に勇気のあることだったのは、費用の問題ではありません。結局、情報コミュニティの年間予算は約500億ドルで、これはほとんどの国の年間国内総生産を上回ります。その巨額の資金に対して、IARPAのトーナメントのコストは微々たるものでした。では、何が勇気あることだったのか。それは、何が明らかになるかということです。例えば、数百人の普通の人々に地政学的な出来事を予測させ、その予測がどれほど修正され、どれだけ正確であるかを見て、その情報を使って最も優れた40人を特定します。そして、全員にさらに多くの予測を行わせます。今度は、全体のグループの平均予測を計算します—「群衆の知恵」ですが、特にその40人のトップ予測者に重みを与えます。最後に、その予測を微調整します。「エクストリマイズ」するということは、予測を100%または0%に近づけることを意味します。予測が70%であれば、例えば85%に引き上げるかもしれません。30%であれば、15%に減らすかもしれません。 さて、このようにして作成した予測が、他のどのグループや方法よりも優れているとしたら、しかもその差が大きいとしたらどうでしょうか。あなたの予測は、機密情報にアクセスできる政府のプロの情報分析者の予測さえも上回ります—その差は機密のままです。地政学的な出来事を予測することに人生を捧げてきた情報専門家たちにとって、数百人の普通の人々と単純なアルゴリズムに負けることがどれほど衝撃的か想像してみてください。実際にそれが起こりました。私が説明したのは、IARPAのトーナメントで勝つために私たちが使用した方法です。特に革新的なものではありません。エクストリマイズの微調整でさえ、非常にシンプルな洞察に基づいています。大人数の判断を組み合わせて「群衆の知恵」を計算することで、すべての人々の間に分散している関連情報を集めるのです。 しかし、これらの人々の誰もがすべての情報にアクセスできるわけではありません。一人はその一部しか知らず、別の人はさらに多くを知っている、という具合です。もし、これらの人々全員にすべての情報が与えられたらどうなるでしょうか?彼らはより自信を持ち、予測を100%や0%に近づけるでしょう。その後、「群衆の知恵」を計算すると、それもまたより極端なものになるでしょう。もちろん、すべての人に関連する情報を与えることは不可能ですから、私たちは極端な状況を想定して、もし可能であれば何が起こるかをシミュレーションします。IARPAのおかげで、数百人の普通の人々と簡単な数学が、数十億ドルの支援を受けた専門家と競い合うだけでなく、彼らを上回ることができることがわかりました。そして、それはIARPAの決定がもたらした不安を呼ぶ発見の一つに過ぎません。もしこのトーナメントが、アルゴリズムの魔法の助けなしに、普通の人々が情報コミュニティ(IC)を打ち負かすことができることを発見したら、どれほど脅威になるでしょうか。 ダグ・ローチは、灰色のひげと薄くなった髪、眼鏡をかけていて、誰にとっても脅威には見えません。彼はIBMでコンピュータープログラマーをしていたように見えますが、今は退職しています。彼はサンタバーバラの静かな住宅街に、素敵な水彩画を描くアーティストの妻と共に住んでいます。彼のFacebookのアバターはアヒルです。ダグは小さな赤いオープンカーのミアータを運転してカリフォルニアの風を楽しむのが好きですが、それだけでは一日の時間を占めるには限界があります。ダグは国際問題に特別な専門知識はありませんが、何が起こっているのかに対して健全な好奇心を持っています。彼はニューヨークタイムズを読み、地図でカザフスタンを見つけることができます。そこで、彼は「グッドジャッジメントプロジェクト」にボランティアとして参加しました。毎日1時間ほど、彼のダイニングテーブルは予測センターとなり、彼はノートパソコンを開いてニュースを読み、世界の運命を予測しようとしました。 最初の年、ダグは「セルビアは2011年12月31日までに正式に欧州連合の候補国として認められるか?」や「ロンドン金市場の金の価格(1オンスあたりUSD)は2011年9月30日に1850ドルを超えるか?」といった104の質問に答えました。これは多くの予測ですが、ダグが行ったことを過小評価しています。私のEPJ研究では、専門家に質問ごとに1つの予測を行うよう求め、その後スコアを付けました。それに対して、IARPAのトーナメントは予測者にリアルタイムで予測を更新することを奨励しました。したがって、6ヶ月後に締切がある質問が開かれると、予測者は初期の判断を下すことができます。たとえば、イベントが6ヶ月の締切までに起こる確率を60%と見積もったとします。その翌日、ニュースで何かを読んで、予測を75%に引き上げることを納得させられるかもしれません。スコアリングの目的のために、これらは後で別々の予測としてカウントされます。もし1週間が経過しても予測に変更を加えなければ、その予測は7日間75%のままです。その後、新しい情報を見つけて予測を70%に下げることに納得するかもしれません。予測は再度変更されるまでそのままの状態が続きます。このプロセスは、6ヶ月が経過して質問が締切を迎えるまで続きます。 この時点で、彼女のすべての予測は、この一つの質問に対する最終的なブライヤースコアを算出する計算に組み込まれています。そして、それはたった一つの質問です。4年間で、国際問題に関する約500の質問が数千人のGJP(Good Judgment Project)の予測者に投げかけられ、100万を超える未来に関する判断が生まれました。しかし、個々のレベルでも、その数字はすぐに膨れ上がります。1年目だけで、ダグ・ローチは約1000の別々の予測を行いました。ダグの予測の正確さは、その量と同じくらい印象的でした。1年目の終わりには、ダグの全体的なブライヤースコアは0.22で、2800人の競技者の中で5位にランクインしました。ブライヤースコアは予測と現実のギャップを測定するもので、2.0は予測が現実の完全な反対である場合の結果、0.5はランダムな推測によって得られる値、0は的の中心を意味します。したがって、0.22は質問の難しさを考慮すると、初見で印象的です。例えば、2011年1月9日に最初に尋ねられたこの質問を考えてみてください。「イタリアは2011年12月31日までに債務を再構築するか、デフォルトするか?」正しい答えは「いいえ」であることが今では分かっています。ダグが0.22を得るためには、この質問の11か月間の平均判断が約68%の信頼度で「いいえ」でなければなりませんでした。この期間中、ユーロ圏を揺るがす金融パニックの波を考えると、悪くはありません。そして、ダグはすべての質問に対して平均的にその正確さを維持しなければなりませんでした。2年目には、ダグはスーパー予測者チームに参加し、さらに良い結果を出し、最終的なブライヤースコアは0.14となり、2800人のGJPボランティアの中で最高の予測者となりました。彼はまた、同じ質問の結果に対する先物契約を売買する予測市場を40%上回りました。彼は、極端なアルゴリズムを打ち負かした唯一の人物でした。さらに、ダグはコントロールグループの「群衆の知恵」を超え、60%以上も上回りました。これは、IARPAが設定した数百万ドルの研究プログラムの4年目のパフォーマンス目標を一手で超えたことを意味します。ダグ・ローチは、どんな基準で見ても驚異的な成果を上げました。ダグを印象的でないように見せる唯一の方法は、彼を神のような全知(ブライヤースコア0)と比較することです。それは、タイガー・ウッズが全盛期にホールインワンを逃したことで軽視されるようなものです。それがダグ・ローチを脅威にしました。彼は適用可能な経験や教育を持たず、機密情報へのアクセスもありませんでした。彼が受け取った唯一の報酬は、すべてのボランティアがシーズンの終わりに受け取る250ドルのアマゾンギフト券でした。ダグ・ローチは、切手を集めたり、ゴルフをしたり、模型飛行機を作ったりする代わりに予測を行う退職者であり、彼はその予測が非常に得意であったため、CIA本部にデスクを持ち、給与とセキュリティクリアランスを持つ経験豊富な情報分析官が彼を上回る余地はあまりありませんでした。 誰かが、アメリカが毎年数十億ドルを地政学的予測に費やす理由を尋ねるかもしれません。ドゥガにギフト券を渡して彼にやらせればいいのに、と。しかし、もしダグ・ローチが特別な才能を持つ予言者であれば、現状に対する脅威はほとんどないでしょう。結局、一人の人間ができる予測には限界があります。しかし、ダグは特別ではありません。私たちはすでにネブラスカ州の農務省の退職者ビル・フラックに出会っています。彼を含む、最初の年にトップの成績を収めた2800人のボランティアの中には、他に58人のスーパーフォアキャスターがいました。彼らは私たちの最初のスーパーフォアキャスターのクラスです。最初の年の終わりには、彼らの集団的なブライヤースコアは0.25で、他の全てのフォアキャスターの0.37と比較しても、その差は後の年に広がり、4年間のトーナメントの終わりにはスーパーフォアキャスターが通常のフォアキャスターを60%以上上回る結果となりました。 スーパーフォアキャスターの優れた点を示す別の指標は、彼らが未来をどれだけ先まで見通せるかです。トーナメントの4年間を通じて、スーパーフォアキャスターは300日先を見越して予測する際、通常のフォアキャスターが100日先を見越して予測するよりも正確でした。言い換えれば、通常のフォアキャスターはスーパーフォアキャスターと同じ距離を見通すためには、予測能力を3倍にする必要があるということです。このようなパフォーマンスの差はどれほど重要なのでしょうか?仮に、平均的な通常のフォアキャスターのブライヤースコアが20/100の視力に相当するとしましょう。眼科医がそのフォアキャスターに視力を20/40に改善するメガネを提供したとします。これは60%の改善です。どれほど重要なのでしょうか?20/40は、鋭い視力にはほど遠いですが、このページのスネレンチャートを見てください。20/100から20/40への変化は、2行目から5行目の文字をしっかりと把握できるようになり、野球のボールをキャッチしたり、街で友人を認識したり、契約書の細かい文字を読む能力が大幅に向上し、正面衝突を避けることができるようになります。累積的に見れば、それは人生を変えるほどの影響があります。 さて、これらのスーパーフォアキャスターは、アマチュアとして自分の余暇に世界の出来事を予測しており、手に入る情報を駆使しています。それにもかかわらず、彼らはプロフェッショナルたちが越えられないほど高いパフォーマンスの基準を設定することに成功しました。もちろん、スーパーフォアキャスターと情報分析官との直接的な比較ができれば素晴らしいのですが、そのような情報は厳重に守られています。しかし、2013年11月、ワシントン・ポストの編集者デイビッド・イグネイシャスは、「プロジェクトの参加者」がスーパーフォアキャスターが「情報コミュニティの分析官の平均より約30%良いパフォーマンスを発揮した」と語ったと報じました。 IARPAは、このような結果が起こり得ることを予測してトーナメントに資金を提供したため、そのような決定は非常に珍しいのです。 テストは明らかに組織にとって利益となる可能性がありますが、組織は自らの利益を持つ人々で構成されています。特に、快適な現状を維持し、向上させることが重要です。著名で報酬の高い評論家たちが、自らの評判を危険にさらしてまで公に正確性を試されることを嫌がるのと同様に、組織内部の権力者たちも、自分の判断を試されることになる予測トーナメントに参加することはあまりないでしょう。CEO室のボブは、郵便室のデイブが自分よりも会社のビジネストレンドを予測するのが得意だということを聞きたくもないし、他の人にも知られたくないのです。それでも、IARPAはそのようなことを実行しました。彼らは、情報コミュニティの使命を、情報コミュニティ内部の人々の利益、特に官僚的な安定を乱したくない人々の利益よりも優先させたのです。 重力に逆らう—しかしどれくらいの間?ここで私が議論を展開した目的は、読者を納得させることですが、私はあなたがまだこれらのスーパーフォーキャスターたちに納得していないことを願っています。もし私が2800人のボランティアに、これから投げるコインが表になるか裏になるかを予測するように頼んだとしましょう。彼らは予測します。次に、コインを投げて、誰が正解したかを記録します。この手順を104回繰り返します(トーナメントの最初の年に行われた予測の数です)。結果は典型的なベルカーブのようになります。 私の予測者の大多数は、コイン投げの結果を約50%の確率で正しく予測することになるでしょう。彼らはカーブの中央に位置します。しかし、少数の人々はかなり異なる結果を得ることになります。ほとんどが間違っている人(カーブの左端)や、ほとんどが正しい人(カーブの右端)もいます。これらの極端な結果は、その結果を得た人々のスキルについて何を示しているのでしょうか?ESPを信じない限り、その答えは「何もない」です。そこにはスキルは関与していません。コイン投げを正しく予測することができる人は、1回でも100回でも、コイン投げの予測能力を示しているわけではありません。それはすべて運です。もちろん、104回のコイン投げのうち70%を正しく予測するには多くの運が必要であり、1人だけが予測を行う場合は非常にあり得ません。しかし、2800人のコイン投げ予測者がいる場合、そのあり得ないことがかなりあり得ることになります。これは複雑なことではありません。しかし、ランダム性を誤解するのは簡単です。私たちはそれに対する直感的な感覚を持っていません。ランダム性は、自分の鼻先の視点からは見えません。私たちは自分自身から一歩外に出なければ、それを見ることはできません。心理学者エレン・ランガーは、一連の実験を通じて、私たちがランダム性をどれほど理解していないかを示しました。ある実験では、彼女はイェール大学の学生に、誰かがコインを30回投げるのを見て、その結果が表になるか裏になるかを予測するように頼みました。学生たちは実際の投げ方を見ることはできませんでしたが、各投げの結果は知らされました。 しかし、結果は操作されていた。すべての学生が正解を15問、不正解を15問得たが、ある学生は最初に連続して正解を出し、別の学生は連続して不正解を出した。ランガーはその後、実験を繰り返した場合に自分がどれくらいできると思うかを学生に尋ねた。最初に正解を出した学生は自分のスキルに対する評価が高く、再び成功するだろうと考えていた。ランガーはこれを「コントロールの幻想」と呼んだが、同時に「予測の幻想」でもある。文脈を考えてみてほしい。これらはエリート大学の学生であり、自分の知性がランダム性の象徴である活動を通じて試されていることを知っている。ランガーが書いたように、彼らは「超合理的」であることが期待される。しかし、彼らが最初に遭遇したパターンは、完全にランダムな結果を予測できると真剣に信じ込ませるほど彼らを欺いた。 イェール大学の研究室の外では、この種の妄想は日常的なものだ。テレビのビジネスニュースを見てみると、しばしば話し手が彼らの劇的な予測成功の一つに言及されて紹介される。「ペドロ・ジフは2008年の崩壊を予測した!」という具合だ。これは彼らを信頼できる存在に見せ、次の予測を聞きたいと思わせるためのものだ。しかし、これらの発言がその人の予測の真実の記録であると仮定しても—実際にはそうでないことが多い—視聴者が少しでもシステム2の思考を適用すれば、ゲストの正確性についてほとんど何も教えてくれないことがわかる。ダーツを投げるチンパンジーでも、十分な数のダーツを投げれば時折的中することがあるし、誰でも株式市場が崩壊する前に「崩壊する」と警告し続ければ、次の株式市場の崩壊を簡単に「予測」できる。しかし、多くの人々はこれらの空虚な主張を真剣に受け止めてしまう。この誤謬の一つの変種は、非常に成功した人物を特定し、その人物が成し遂げたことが極めてあり得ないことであることを示し、運が説明にならないと結論づけることだ。これはウォール街のニュース報道でよく見られる。誰かが6年または7年連続で市場を上回ると、ジャーナリストはその偉大な投資家を特集し、運だけでそのような結果を得ることがどれほどあり得ないかを計算し、これがスキルの証拠であると勝ち誇って発表する。間違いは何か?彼らはその偉大な人物が行ったことを試みていた他の多くの人々を無視している。もしそれが何千人もいるなら、誰かがそのように運良くなる確率は急上昇する。宝くじの当選者を考えてみてほしい。特定のチケットが大きな宝くじに当たることは非常にあり得ないことで、しばしば数百万分の1だが、私たちは宝くじの当選者が優れたチケット選びのスキルを持っているとは結論づけない—なぜなら、何百万ものチケットが販売されていることを知っているからで、どこかで誰かが当たる可能性が高いからだ。似たような間違いは、残されたビジネス書をひっくり返すことで見つけることができる。ある企業や経営者が成功を重ね、成功から成功へと進み、金を積み上げ、雑誌で称賛されるプロファイルが掲載される。次に何が起こるのだろうか? 避けられないことですが、これは成功を語り、読者に対して企業や経営者が行ったことを真似するだけで同様の成功を収められると保証する本です。これらの物語は真実かもしれませんし、単なるおとぎ話かもしれません。真相を知ることは不可能です。これらの本は、取り上げられた特性や行動が幸せな結果をもたらしたという確固たる証拠をほとんど提供せず、ましてやそれを模倣した人が同じように幸せな結果を得られるかどうかについては言及しません。また、英雄のコントロールを超えた要因—運—が幸せな結果に寄与した可能性があることもほとんど認められません。 この不幸なジャンルに加わらないためにも、ここまでの証拠は、スーパーフォアキャスターが本当にスーパーフォアキャスターであることを示していないことを明言しておきます。ましてや、読者がサンタバーバラに引退し、小さな赤いコンバーチブルを運転すれば、ダグ・ローチと同じくらい正確に予測できるわけではありません。それでは、ダグや他の人たちについてどう考えればよいのでしょうか?彼らはスーパーフォアキャスターなのでしょうか、それともスーパーハッピーな運の持ち主なのでしょうか?まだ答えないでください。これは、判断を評価する努力の周りを蚊のように飛び回る厄介な二項対立の一つです。人生のほとんどのことは、さまざまな比率でスキルと運が関与しています。その組み合わせは、ほぼすべてが運で少しだけスキル、またはほぼすべてがスキルで少しだけ運、あるいは千の他の可能なバリエーションの一つかもしれません。この複雑さが、何をスキルに帰属させ、何を運に帰属させるかを判断するのを難しくしています。このテーマは、グローバルな金融戦略家であるマイケル・モーブッサンが著書『成功の方程式』で深く掘り下げています。しかし、モーブッサンが指摘したように、アスリートやCEO、株式アナリスト、スーパーフォアキャスターに適用される優れた経験則があります。それは「平均への回帰」と呼ばれます。 いくつかの統計的概念は理解しやすく、忘れやすいものです。平均への回帰はその一つです。例えば、男性の平均身長が5フィート8インチだとしましょう。次に、6フィートの男性を想像し、その成人の息子を思い描いてみてください。最初の直感的な判断(システム1の思考)は、息子も6フィートであるというものかもしれません。それは可能ですが、あまり現実的ではありません。なぜそうなるのかを理解するためには、少し難しいシステム2の推論を行う必要があります。もし私たちがすべての人の身長を知り、父親と息子の身長の相関関係を計算したとしたら、強いが不完全な関係、つまり約0.5の相関があることがわかります。これは、以下のグラフに示されているデータポイントを通る線で表されています。父親が6フィートの場合、私たちは父親の身長と人口の平均に基づいて妥協的な予測を立てるべきです。息子の最良の予測は5フィート10インチです。息子の身長は、人口の平均と父親の身長の中間、つまり2インチ平均に回帰しています。 しかし、私が言ったように、平均への回帰は理解するのは簡単でも、忘れやすいものです。例えば、慢性的な腰痛に悩んでいるとしましょう。すべての日が同じではありません。 ある日には気分が良いと感じ、別の日には少し痛みを感じるけれどもそれほどではなく、時にはひどい日もあります。もちろん、ひどい日には、ホメオパシーや科学的根拠のない医療処置を行う他の治療者を訪ねて助けを求める可能性が高くなります。翌日目が覚めると…気分が良くなっています!治療が効いたのです!プラセボ効果が役立ったかもしれませんが、実際には治療を受けなくても翌日には気分が良くなっていたでしょう。これは「平均への回帰」という現象によるもので、考えを巡らせない限り、あなたの頭には浮かんでこないでしょう。この小さな誤解は、多くの人々が信じているけれども信じるべきではないことの原因となっています。しかし、平均への回帰を念頭に置いておけば、それは貴重なツールになります。 例えば、2800人のボランティアに104回のコイン投げの結果を再予測させたとしましょう。分布は再びベルカーブの形になり、大多数の人が50%の周りに集まり、ほとんど当たらないかほとんど全てを正しく予測する人はごく少数です。しかし、今回は誰が驚くほど良い結果を出すのでしょうか?おそらく、前回とは異なる人々になるでしょう。ラウンド間の相関はほぼゼロになり、特定の予測者に対する最良の予測は50%の平均的な正確さになります。つまり、完全な平均への回帰です。この点を明確にするために、最初のラウンドで驚くほど良い結果を出した人だけに再度この課題を行わせると想像してみてください。平均への回帰のおかげで、ほとんどの人が2回目には悪化する可能性が高いです。そして、最も運の良かった人ほどその下降が大きくなるでしょう。90%の正解を得た人は、50%に急速に戻ることを予想すべきです。もちろん、再び9回または10回正解する人がいる可能性もありますが、他の人が急速に平均に回帰している事実は、彼らをコイン投げの達人と宣言する前に躊躇させるべきです。再度課題を行わせてみてください。最終的には彼らの運も尽きるでしょう。したがって、平均への回帰はパフォーマンスにおける運の役割をテストするための不可欠なツールです。モーブシンは、スキルが支配する活動では遅い回帰が見られることが多く、運による活動では速い回帰が見られると指摘しています。 例を挙げると、IARPAトーナメントに参加しているフランクとナンシーの2人を想像してみてください。1年目、フランクはひどい結果を出しますが、ナンシーは素晴らしい成績を収めます。以下のベルカーブでは、フランクは下位1%にランクされ、ナンシーは上位99%にランクされています。もし彼らの結果が完全に運によるものであれば、2年目にはフランクもナンシーも50%に戻ると予想されます。もし彼らの結果が運とスキルの半々であれば、フランクは約25%(1%から50%の間)に上昇し、ナンシーは約75%(50%から99%の間)に下降するでしょう。もし彼らの結果が完全にスキルによって決まるものであれば、回帰は起こらず、フランクは2年目も同じようにひどい成績を出し、ナンシーは同じように素晴らしい成績を出すことになります。 第1年のパフォーマンス 第2年の期待されるパフォーマンス 100% スキル Ac———>8 509% スキル & 50% 欠如 A+B 100% 運 AOR トーナメントにおける運の量は、1年から次の年への平均への回帰の量を決定します。では、スーパーフォーキャスターたちは年を重ねるごとにどうだったのでしょうか?それが重要な問いです。そしてその答えは驚くほど良好でした。たとえば、2年目と3年目には、平均への回帰とは逆の現象が見られました。スーパーフォーキャスター全体、特にダグ・ローチを含む彼らは、他の全てのフォーキャスターに対してリードを実際に増やしました。しかし、この結果は注意深い読者に疑念を抱かせるべきです。これは、スーパーフォーキャスターの結果にはほとんど運が働いていなかったことを示唆しています。彼らが予測していた内容の性質や、一部の質問に潜む不可避の不確実性を考えると、この可能性には深く疑念を抱かざるを得ません。いくつかの質問は、誰も予見できないような奇妙な最後の瞬間の出来事によって解決されました。その一例として、東シナ海での船舶間の致命的な対立があるかどうかという質問がありました。質問の締切直前に、怒った中国の漁船の船長が、国境違反で自分の船を押収した韓国の海上保安官を刺したことで、答えは「はい」となりました。他の質問は、変数のシステム間の複雑な相互作用に基づいていました。たとえば、長い間予測の評判を損なってきた石油の価格です。価格を上下させる要因は膨大で、アメリカのフラッカーからリビアのジハード主義者、シリコンバレーのバッテリー設計者まで多岐にわたります。そして、それらの要因に影響を与える要因の数はさらに多いのです。これらの因果関係の多くは非線形でもあり、エドワード・ローレンツが示したように、蝶の羽ばたきのような小さな出来事でも大きな違いを生むことがあります。したがって、私たちは謎に直面しています。もし偶然が重要な役割を果たしているのなら、なぜスーパーフォーキャスター全体が全体の平均に向かって著しい回帰を示さないのでしょうか?何らかの相殺プロセスがスーパーフォーキャスターのパフォーマンスを押し上げているに違いありません。そして、それが何であるかを推測するのは難しくありません。第1年目に最初のスーパーフォーキャスターのコホートが特定された後、私たちは彼らを祝福し、「スーパーフォーキャスター」と認定し、他のスーパーフォーキャスターとチームを組ませました。平均に回帰する代わりに、彼らのスコアはさらに良くなりました。これは、「スーパーフォーキャスター」として認識され、知的に刺激的な仲間たちとチームを組むことで、彼らのパフォーマンスが向上し、そうでなければ見られたであろう平均への回帰を打ち消すほどだったことを示唆しています。3年目と4年目には、新たなスーパーフォーキャスターのコホートを集め、エリートチームで働かせました。それにより、より公平な比較が可能になりました。新しいコホートは、前年と同じかそれ以上の成果を上げ続け、再び平均への回帰仮説に反しました。しかし、ウォール街の人々がよく知っているように、凡人は統計的な重力の法則に逆らえるのは限られた時間だけです。 スーパー予測者たちのパフォーマンスの一貫性は、時間の経過とともに一部のトップパフォーマーの入れ替わりが避けられないことを隠してはいけません。個々の成績が前年からどれだけ変わるかの相関関係は約0.65で、これは父親と息子の身長の相関関係よりもわずかに高い数値です。したがって、平均への回帰がかなりあることを期待すべきです。そして、実際にその通りのことが観察されます。毎年、約30%の個々のスーパー予測者が翌年にはトップ2%のランクから外れます。しかし、それは同時に、70%のスーパー予測者がスーパー予測者のままであるということでもあります。このような一貫性がコインを投げて予測する人々の間で生じる確率(年ごとの相関が0の場合)は1億分の1未満ですが、予測者の間で生じる確率(年ごとの相関が0.65の場合)ははるかに高く、約3.12分の1です。 これらのことから、二つの重要な結論が導き出されます。一つは、特定の年のスーパースターを絶対的な存在として扱うべきではないということです。ダグ・ローチでさえも例外ではありません。運が影響することもあり、スーパースターたちが時折悪い年を過ごし、普通の結果を出すことは当然のことです。これは、スーパースターのアスリートたちが時折平凡に見えることと同じです。しかし、もっと基本的で希望に満ちた結論として、スーパー予測者たちは単に運が良かったわけではなく、主に彼らの結果はスキルを反映しているということです。これが大きな疑問を引き起こします:なぜスーパー予測者たちはそんなに優れているのでしょうか? サンフォード「サンディ」シルマンは、2008年に多発性硬化症と診断されました。命に関わるものではありませんでしたが、衰弱させるものでした。彼は弱く、すぐに疲れてしまい、背中や腰に痛みを抱えていました。歩くことも難しく、タイピングさえも苦労しました。2011年には「壁に書かれた文字が見えた」と彼は振り返ります。彼はすぐに大気科学者としての仕事を辞めなければならないことを理解しました。サンディは57歳でした。仕事を失うことは彼の人生に空虚感をもたらすことを知っており、彼は自分が管理できるペースで忙しく過ごすための何かが必要でした。そこで、予測トーナメントのボランティア募集の記事を読んで、彼は参加を決め、グッド・ジャッジメント・プロジェクトのために予測を始めました。「人々が働かなくなると、少し迷子になったり、無価値に感じたりするものです」と、音声をテキストに変換するソフトウェアを使って書いたメールで彼は私に語りました。「GJPは私にとって『移行プロジェクト』として良いかもしれないと思いました。仕事ほどのプレッシャーや重要性はないけれど、まだ何か意味のあることをして、頭を活かしておけるという意味で。」そして、彼の頭脳は素晴らしいものです。サンディはブラウン大学で数学と物理学のダブルメジャーを取得した学士号を持ち、MITの技術と政策プログラムから修士号、さらにハーバード大学から応用数学の修士号、そしてハーバード大学から応用物理学の博士号を取得しています。博士号を取得した後、彼はミシガン大学で大気研究科学者となり、そこでの彼の研究は「追加の非メタンの影響」といった厳しいタイトルのもとに発表されました。 揮発性有機化合物、有機硝酸塩、酸素化有機種の直接排出が「地球の対流圏化学に与える影響」についての研究は、彼に多くの賞や栄誉をもたらしました。そして、彼の知性は数学や科学にとどまらず、彼は非常に熱心な読者でもあります。英語だけでなく、フランス語にも堪能です。これは学校教育やスイスでの客員研究員としての経験のおかげです。彼は妻がロシア人であるためロシア語も学び、また「12歳の時にイタリア語を学びたいと決めて、自分で勉強を始めた」ため、イタリア語も話せます。スペイン語も話しますが、サンディはそれがイタリア語に非常に近いため、別の言語としてカウントすべきではないと思っています。残念ながら、サンディの健康に関する予測は的中しました。2012年、彼は障害休暇を取得しましたが、ミシガン大学の同僚に宛てた通常通り優しい文面の中で「私はこれを早期退職の同等と見なすことを好む」と書きました。 より嬉しいことに、サンディの他の予測の多くも的中しました。トーナメントの1年目、彼はランダムに割り当てられたコントロール条件のもとで一人で予測を行い、ブライヤースコア0.19で終了しました。これにより、彼は全体のチャンピオンとして他の約2800人を抜いて同点になりました。ほとんどの参加者はより刺激的な環境で働いていましたが、サンディは大喜びでした。「少しプロフェッショナルらしくない言い方かもしれませんが、もちろんとても興奮します。素晴らしい気分です。少し「ゾクゾク」します。これに似た経験は、高校時代に数学コンペティションで1位になった時だけです。心の中では、私はまだ高校生のままです。」私たちが最初のスーパー予測者のリストを作成したとき、サンディの名前はトップにありました。サンディの素晴らしい頭脳が彼の素晴らしい結果を説明しているのではないかと疑わざるを得ません。そして、他のスーパー予測者にも同じことが言えるでしょう。研究が始まって2年後、私たちはウォートンスクールのハンツマンホールの会議室でスーパー予測者の集まりを開催しましたが、彼らが非常に鋭い人々であり、特にエリートメディアを注意深くフォローしていることは、会話から明らかでした。彼らは本を読むことも大好きです。若いブルックリンの映画製作者ジョシュア・フランケルに趣味で何を読むか尋ねると、彼はトマス・ピンチョンのような高尚な著者の名前を次々と挙げ、少し考えた後、最近ドイツのロケット科学者ヴェルナー・フォン・ブラウンの伝記やニューヨークの歴史に関する本を読んだと付け加えました。ただし、フランケルはニューヨークに関する本も仕事のためであることに注意を払っていました。彼はロバート・モーゼスというニューヨークの偉大な都市計画者と、自由な精神を持つ反計画者ジェーン・ジェイコブスとの伝説的な対立を描いたオペラを制作しています。フランケルは「ジェパディ!」で対戦するのは避けた方が良い人物です。スーパー予測者たちは、他の人々よりも知識が豊富で知的だから優れているのでしょうか?それは彼らにとっては嬉しいことですが、私たちにとっては少し落ち込むことになります。知識は誰もが増やすことができるものですが、それはゆっくりとしか増やせません。 精神的に活発でない人々が、生涯学習者に追いつく可能性はほとんどありません。知性はさらに手強い障害のように感じられます。認知能力を高める薬やコンピューターパズルを信じる人々がいつか正当化されるかもしれませんが、ほとんどの人は成人の知性は比較的固定されており、受精時のDNAのくじ引きや出生時の愛情深く裕福な家庭のくじ引きの結果であると考えています。もしスーパー予測が、三標準偏差のMENSA認定の天才—上位1%—の仕事であるなら、私たちの大多数は決してその資格を得ることができません。では、なぜ挑戦する必要があるのでしょうか?知識と知性が先見の明を促すという考えはもっともらしいですが、アーチー・コクランが示したように、もっともらしさだけでは不十分です。私たちは仮説を検証する必要があります。プロジェクトの共同リーダーであるバーバラ・メラーズと、予測を始める前に厳しい心理テストを耐え抜いたボランティアのおかげで、私たちはそのためのデータを得ることができました。 流動知性、つまり生の計算能力を測るために、ボランティアはこのページにあるようなパズルを解かなければなりませんでした。目標は、右下の空白を埋めることです。これを解くには、行のパターンを生成するルールを特定する必要があります(各行にはその図形の中心に独特のシンボルが必要です)し、各列にはすべての三つの形が含まれていなければなりません。正解は、第二行の第二の図形です。 流動知性は帰納的空間推論としてのものであり、高度なパターン認識スキルがあっても、現実世界でパターンを見つける場所を知らなければあまり役に立ちません。そこで、私たちは結晶化知性—知識—を測定するために、「最高裁判所には何人の判事がいますか?」といったアメリカ中心の質問や、「国連安全保障理事会の常任理事国はどの国ですか?」といったよりグローバルな質問を使用しました。 結果に入る前に、最初の年に数千人がGJPにボランティアとして参加し、全てのテストを乗り越えて予測を行うことに十分な動機を持った2,800人は、無作為に選ばれたサンプルからは程遠いことを考慮してください。これは重要です。無作為選択は、サンプルが抽出元の母集団を代表することを保証します。それが欠けている場合、私たちはボランティアがアメリカや他の場所の一般の人々を反映しているとは仮定できません。結局のところ、私たちの2,800人のボランティアは、ブログや記事で予測トーナメントについて読んで、「そうだ、私は貴重な自由時間の大部分をナイジェリアの政治、ギリシャの債券、中国の軍事支出、ロシアの石油とガス生産、その他の複雑な地政学的問題を分析するために使いたい」と考えた人々です。私はそれをほぼ1年間行いたいと思っています。そして、250ドルのギフト券以外の物質的な利益は求めていません。これらの人々が平均的な人々ではないことに自信を持てます。したがって、スーパー予測者の成功における知性と知識の役割を理解するためには、さらに一歩進む必要があります。 私たちは、スーパーフォアキャスターの知性と知識を、他の予測者だけでなく、アメリカの一般人口とも比較する必要があります。結果はどうだったのでしょうか?通常の予測者は、知性と知識のテストで約70%の人口よりも高いスコアを獲得しました。スーパーフォアキャスターはさらに良く、約80%の人口よりも高い位置にいました。ここで三つの点に注意してください。まず、知性と知識の大きな向上は一般の人々から予測者に向かうものであり、予測者からスーパーフォアキャスターに向かうものではありません。次に、スーパーフォアキャスターは平均を大きく上回っていますが、極端に高いスコアを出しているわけではなく、ほとんどがいわゆる天才の領域には達していません。この「天才」という概念は、しばしば恣意的に定義されるもので、上位1%やIQ135以上とされています。つまり、知性と知識は役立ちますが、ある閾値を超えるとそれ以上の効果はあまりないようです。スーパーフォアキャスティングには、ハーバードの博士号や五カ国語を話す能力は必要ないのです。この結論には満足感があります。なぜなら、私がこの研究を始めたときにダニエル・カーネマンが私に共有した直感と見事に一致するからです。つまり、高度な専門家がニューヨーク・タイムズの注意深い読者よりも優れた予測者になることはあまりないだろうということです。この点は読者にとっても満足できるはずです。ここまで読んでいるなら、あなたには必要な資質があるでしょう。しかし、必要な知性と知識を持っているだけでは不十分です。トーナメントに参加した多くの賢く情報通な予測者たちは、スーパーフォアキャスターの精度には遠く及びませんでした。そして歴史には、予測が実際にはあまり先見の明がなかった優れた人々が数多く存在します。ロバート・マクナマラ—ケネディ大統領とジョンソン大統領の下で国防長官を務めた—は「最も優秀な者たち」と称されましたが、彼と彼の同僚たちは、南ベトナムが共産主義者に奪われれば、東南アジア全体が続いて危険にさらされるという確信のもと、ベトナム戦争をエスカレートさせました。彼らの確信は、真剣な分析に基づいていませんでした。実際、この重要な予測に関する真剣な分析は1967年まで行われず、エスカレーションの決定が下された数年後のことでした。「私たちの意思決定の基盤は深刻に欠陥があった」とマクナマラは自伝に書いています。「私たちはその時も後でも、自分たちの仮定を批判的に分析することに失敗しました。」結局、重要なのは計算能力ではなく、それをどう使うかです。 FERMI-IZE 予測トーナメントで決して尋ねられなかった質問があります。それは「シカゴにはピアノ調律師が何人いるか?」というものです。Googleに答えを探させることは考えないでください。イタリア系アメリカ人の物理学者エンリコ・フェルミ—原子爆弾の発明における中心的な人物—は、インターネットが発明される数十年前にこの小さな頭の体操を考案しました。そしてフェルミの学生たちは、シカゴの電話帳を手元に持っていませんでした。彼らには何もありませんでした。それでもフェルミは、彼らが合理的に正確な推定を出すことを期待していました。フェルミの教室の外では、ほとんどの人が眉をひそめ、目を転がし、耳をかき、ため息をつくことでしょう。 「さて、もしかしたら」—長い間の沈黙の後、彼らは数字を提示するだろう。その数字はどうやって導き出されたのか?彼らに尋ねると、肩をすくめて「まあ、そんな感じだ」としか言わない。数字はまるでブラックボックスから出てきたようなもので、彼ら自身もその生成過程を理解していない。フェルミは、人々がもっと良い推測をすることができると知っており、その鍵は「これが起こるためには何が真実でなければならないか?」といった質問で問題を分解することだと考えていた。ここでも、私たちは「この質問に答えるためにはどんな情報が必要か?」と尋ねることで問題を分解できる。 では、シカゴにいるピアノ調律師の数を計算するために何を知る必要があるのか?ピアノ調律師の数は、ピアノ調律の仕事の量と、1人のピアノ調律師を雇うのにどれだけの労力がかかるかに依存する。したがって、私はこの質問を解決するために次の4つの事実を知っていれば良いのだ。 1. シカゴにあるピアノの数 2. ピアノが年間に調律される頻度 3. ピアノの調律にかかる時間 4. 平均的なピアノ調律師が年間に働く時間 最初の3つの事実があれば、シカゴにおけるピアノ調律の総作業量を計算できる。そして、それを最後の数字で割れば、シカゴにいるピアノ調律師の数をかなり正確に把握できる。しかし、私はその情報を持っていない!だから、あなたは私が答えられない質問を4つに分けて時間を無駄にしたと思うかもしれない。しかし、そうではない。フェルミが理解していたのは、質問を分解することで、知っていることと知らないことをより明確に分けることができるということだ。したがって、推測—ブラックボックスから数字を引き出すこと—は排除されるわけではない。しかし、私たちはその推測のプロセスを明るみに出し、検証できるようにしたのだ。そして、その結果、最初に質問を読んだときにブラックボックスから出てきた数字よりも、より正確な推定が得られる傾向がある。 もちろん、これは私たちが「愚かに見えること」を恐れる根深い恐怖を克服しなければならないことを意味する。フェルミ的思考は、私たちに間違える勇気を与えてくれる。その精神で、私は4つの項目それぞれについて最善を尽くしてみる。 1. シカゴには何台のピアノがあるのか?全く分からない。しかし、最初の質問を分解したように、これも答えるために何を知る必要があるかを考えて分解できる。 a. シカゴには何人の人がいるのか?確かではないが、シカゴはニューヨークとロサンゼルスに次ぐアメリカの第3の都市であることは知っている。そして、LAにはおおよそ400万人いると思う。それは参考になる。これを絞り込むために、フェルミは信頼区間を設定することを勧める—正しい答えが含まれていると90%確信できる範囲だ。だから、私はシカゴには150万人以上いるとかなり確信している。そして、350万人未満であるとも思っている。しかし、その範囲内で正しい答えはどこにあるのかは分からない。だから、中央値を取ってシカゴには250万人いると推測する。 b. ピアノを所有している人の割合はどれくらいか?ピアノはほとんどの家庭にとって高価すぎるし、買える人の多くは本当に欲しいと思っていない。だから、1%と見積もる。それはほとんどブラックボックスからの推測だが、私ができる最善の推測だ。 c. どれくらいの機関、つまり学校、コンサートホール、バーなどがピアノを所有しているのでしょうか?正確にはわかりませんが、多くの機関が所有していると思います。音楽学校のようなところでは、たくさんのピアノを持っているでしょう。そこで、私はざっくりとした推測をして、人口一人あたりのピアノの数を倍にして、だいたい100人に2台、つまり2%くらいだと考えます。この推測をもとに簡単な計算をして、シカゴには約5万台のピアノがあると結論づけます。 次に、ピアノはどれくらいの頻度で調律されるのでしょうか?おそらく年に一度でしょう。それが妥当だと思いますが、理由はわかりません。これもまたざっくりとした推測です。では、ピアノの調律にはどれくらいの時間がかかるのでしょうか?私は2時間だと考えます。これもまた推測です。 次に、平均的なピアノ調律師は年間どれくらい働くのでしょうか?これは分解して考えることができます。アメリカの標準的な労働時間は週40時間で、2週間の休暇を引くと、年間の労働時間は約2000時間になります。ピアノ調律師も特に異なる理由はないと思うので、40時間を50週で掛け算します。しかし、調律師はピアノの間を移動する時間も必要なので、その分を引く必要があります。移動にかかる時間は、作業時間の20%だと推測します。したがって、平均的なピアノ調律師は年間1600時間働くと結論づけます。 ここまでの推測をまとめて最終的な計算をします。もし5万台のピアノが年に一度調律され、1台の調律に2時間かかるとすると、合計で10万時間の調律時間が必要です。それを1人のピアノ調律師の年間労働時間で割ると、シカゴには約62.5人のピアノ調律師がいることになります。したがって、シカゴには63人のピアノ調律師がいると推定します。果たして私の推測はどれくらい正確なのでしょうか? 多くの人々がこのフェルミの古典的な問題に挑戦してきました。その中には心理学者のダニエル・レビティンも含まれています。彼はシカゴの電話帳でピアノ調律師のリストを83件見つけましたが、重複しているものも多く、正確な数は不明です。しかし、私の推定は多くの粗い推測に基づいているにもかかわらず、驚くほど正確に近いようです。フェルミはその推定の正確さで知られていました。彼はほとんど情報がない状態でも、こうした裏紙の計算を用いて、後の測定で驚くほど正確な数字を導き出していました。多くの物理学や工学の学部では、フェルミ推定やフェルミ問題—「メリーランド大学の学生が1学期に消費するピザの平方インチの数を推定せよ」といった奇妙な課題—がカリキュラムの一部となっています。私はレビティンのフェルミ推定に関する議論を超予測者のグループと共有したところ、大きな賛同を得ました。サンディ・シルマンは、フェルミ推定が大気モデルを扱う科学者としての仕事にとって非常に重要であり、「私の自然な考え方の一部になった」と語ってくれました。これは予測者にとって大きな利点であることがわかります。 殺人ミステリー 2004年10月12日、パレスチナ解放機構の75歳の指導者、ヤーセル・アラファトが激しい嘔吐と腹痛に襲われ、重篤な状態に陥りました。その後の3週間で彼の容体は悪化し、10月29日にはフランスの病院に搬送されました。彼は昏睡状態に陥りました。数十年前、政治家としての役割を引き受ける前、アラファトは爆撃や銃撃を指揮し、多くのイスラエルによる暗殺未遂を生き延びてきましたが、2004年11月11日、かつてはイスラエルにとって壊滅的な敵であった彼は死亡が確認されました。彼を殺した原因は不明でしたが、彼が亡くなる前から毒殺されたのではないかという憶測がありました。2012年7月、スイスのローザンヌ大学放射線物理学研究所の研究者たちは、アラファトの所持品を調査し、異常に高いポロニウム210のレベルを発見したと発表しました。これは不吉な知らせでした。ポロニウム210は、摂取すると致命的な放射性元素です。2006年には、ロンドンに住む元ロシアのスパイであり、ウラジーミル・プーチンの著名な批評家であるアレクサンダー・リトビネンコがポロニウム210で暗殺されました。その年の8月、アラファトの未亡人は、彼の遺体をスイスとフランスの2つの機関によって掘り起こして検査することを許可しました。そこでIARPAはトーナメントの予測者たちに次の質問をしました。「フランスまたはスイスの調査で、ヤーセル・アラファトの遺体からポロニウムの高いレベルが見つかるだろうか?」 この質問は一見すると難しいもので、イスラエル・パレスチナ紛争の複雑さを背景に持つ、まるでCSI:エルサレムの殺人ミステリーのようでした。一般の人はどのようにこの問題に取り組むでしょうか?彼らはおそらく、質問を読んだ瞬間に浮かんだ直感から始めるでしょう。その直感の強さは人によって異なります。アラファトや長いイスラエル・パレスチナ紛争についてあまり知らない人は、ほんのささやき程度の感覚しか得られないかもしれません。しかし、その地域の政治に詳しく情熱を持つ人にとっては、それはまるで叫びのように感じられるでしょう。「イスラエルがそんなことをするはずがない!」と感じるかもしれませんし、「もちろんイスラエルがやったに違いない!」と思うかもしれません。その直感は「鼻先の感覚」とでも言うべきもので、どのようにしてその感覚が生まれたのかは私にはわかりません。しかし、それを予測に変えるのは簡単です。どれくらい強く感じますか?もし直感が「イスラエルがそんなことをするはずがない!」なら、予測は5%かゼロにします。「もちろんイスラエルがやった!」なら、予測は95%か100%にして終わりです。もしもっと曖昧な気持ちなら、50%に近い数字を選びます。テレビのコメンテーターが素早く予測を行うとき、彼らはほとんどこれだけを行っています。これは正確な予測を行う方法ではありません。もし「鼻先の感覚」に誤りが含まれていたら、それを見抜くことはできません—まるで認知的反射テストで「10セント!」と口走ってしまったときのように。そしてここには間違いがあります。それに気づきましたか? もう一度質問を読み直してみてください。「フランスまたはスイスの調査は、ヤーセル・アラファトの遺体にポロニウムの高濃度が見つかるでしょうか?」という質問です。「イスラエルがそんなことをするはずがない!」や「もちろん、イスラエルがやったに違いない!」という反応は、この質問には実際には答えていません。彼らは別の質問、「イスラエルはアラファトを毒殺したのか?」に答えているのです。システム1は典型的な釣り餌とすり替えを行いました。実際に尋ねられた難しい質問が、答えやすい別の質問に置き換えられてしまったのです。この罠は回避できたはずです。鍵となるのは「フェルミ的思考」をすることです。 ビル・フラックはネブラスカ州カーニーに住んでおり、中西部の真ん中で、中東からは遠く離れた場所にいます。彼はイスラエル・パレスチナ問題に関する専門知識はまったくありませんが、この質問に対して素晴らしいスタートを切るためにそれは必要ありませんでした。フェルミのように考えたビルは、「答えがイエスになるためには何が必要か?ノーになるためには何が必要か?」と自問自答しながら質問を解きほぐしました。彼は、分析の最初のステップが政治とは無関係であることに気づきました。ポロニウムは急速に崩壊します。答えがイエスであるためには、科学者たちが何年も前に亡くなった男性の遺体からポロニウムを検出できる必要があります。彼らはそれができるのでしょうか?チームメイトがアラファトの所持品の検査に関するスイスチームの報告書へのリンクを投稿していたので、ビルはそれを読み、ポロニウム検査の科学に精通し、彼らがそれを行えることに満足しました。それから初めて、彼は分析の次の段階に進みました。 再び、ビルはアラファトの遺体がポロニウムで汚染される可能性について考えました。明らかに「イスラエルがアラファトを毒殺した」というのは一つの方法です。しかし、ビルは質問を慎重に分解したため、他にも可能性があることに気づきました。アラファトには多くのパレスチナの敵がいました。彼らが彼を毒殺した可能性もあります。また、「イスラエルがアラファトに対してリトビネンコ事件を起こしたように見せかけるために、何らかのパレスチナの派閥による意図的な死後汚染があった可能性もある」とビルは後に私に話しました。これらの代替案は重要でした。なぜなら、アラファトの遺体がポロニウムで汚染される可能性が増えることで、ポロニウムが見つかる確率も高まるからです。また、二つのヨーロッパのチームのうち一つが陽性結果を得れば、質問の正しい答えがイエスになるという点も、彼の分析を後押ししました。これはまだ始まりに過ぎませんが、ビルのフェルミ的分析のおかげで、彼はすでに釣り餌とすり替えの罠を回避し、その後の分析のための道筋を示しました。彼は素晴らしいスタートを切ったのです。 次のステップは何でしょうか?イスラエルの責任について直感に基づいて結論を出さないことを知っているほとんどの人は、今こそアラファトの死の際の複雑な政治に取り組むべきだと考えるでしょう。しかし、それにはまだ早すぎます。その理由を示すために、私はレンゼッティ家についての質問をします。レンゼッティ家はチェスナットアベニュー84番地の小さな家に住んでいます。 フランク・レンゼッティは44歳で、引越し会社の簿記係として働いています。メアリー・レンゼッティは35歳で、保育園でパートタイムの仕事をしています。彼らには5歳の子供、トミーがいます。また、フランクの未亡人の母、カミラも家族と一緒に住んでいます。私の質問は、レンゼッティ家がペットを飼っている可能性はどのくらいかということです。それに答えるために、多くの人は家族の詳細に注目するでしょう。「レンゼッティという名前はイタリア系だ」と誰かが思うかもしれません。「フランクとカミラもそうだ。つまり、フランクはたくさんの兄弟姉妹と一緒に育ったかもしれないが、子供は一人だけだ。彼は大きな家族を持ちたいと思っているかもしれないが、経済的に余裕がないのだろう。それなら、ペットを飼うことで少し補っているのかもしれない。」別の人はこう考えるかもしれません。「人々は子供のためにペットを飼うが、レンゼッティ家には子供が一人しかいないし、トミーはペットの世話をするにはまだ若すぎる。だから、ペットを飼っている可能性は低いように思える。」 このような物語を作ることは非常に魅力的ですが、特にここで提供した情報よりもはるかに詳細な情報がある場合にはなおさらです。しかし、スーパーフォアキャスターたちは、少なくとも最初はそんなことに気を取られません。彼らが最初にすることは、アメリカの家庭のうち何パーセントがペットを飼っているかを調べることです。統計学者はそれを「ベースレート」と呼びます。つまり、ある広いクラスの中でどれだけ一般的であるかということです。ダニエル・カーネマンは、これをより印象的な視覚的な用語で「外部の視点」と呼びます。これは、特定のケースの詳細である「内部の視点」と対照的です。数分間Googleで調べると、アメリカの家庭の約62%がペットを飼っていることがわかります。これがここでの外部の視点です。外部の視点から始めるということは、レンゼッティ家がペットを飼っている可能性は62%だと推定することから始めるということです。その後、内部の視点、つまりレンゼッティ家に関する詳細を見て、その初期の62%を上げたり下げたりするために使います。内部の視点に引き寄せられるのは自然なことです。通常、具体的で魅力的な詳細が詰まっており、何が起こっているのかについての物語を作るために利用できます。一方、外部の視点は通常、抽象的で簡素であり、物語を作るのにはあまり適していません。そのため、賢く成功した人々でさえ、外部の視点を考慮することをしばしば忘れてしまいます。ウォール・ストリート・ジャーナルのコラムニストであり、元レーガン大統領のスピーチライターであるペギー・ヌーナンは、世論調査でジョージ・W・ブッシュの支持率が、任期の終わりには最低だったにもかかわらず、退任から4年後に47%に回復し、オバマ大統領と同じになったことを見て、民主党に問題が起こると予測しました。ヌーナンはそれを驚くべきことであり、非常に重要だと感じました。しかし、もし彼女が外部の視点を考慮していたら、大統領が退任した後に支持率が常に上昇することを発見していたでしょう。リチャード・ニクソンの支持率も上がったのです。したがって、ブッシュの支持率の改善は全く驚くべきことではなく、彼女がそこから引き出した意味は幻想的であることを強く示唆しています。スーパーフォアキャスターたちは、そのような間違いを犯しません。 ビル・フラックに、今後12ヶ月の間に中国とベトナムの間で国境を巡る武力衝突が起こるかどうか尋ねられた場合、彼はその国境問題や現在の中越関係の詳細にすぐには踏み込まないでしょう。代わりに、過去にどれくらい武力衝突があったかを考えるでしょう。「例えば、中国とベトナムの間に敵対的な行動が5年ごとに起こると仮定しましょう」とビルは言います。「それを基に5年ごとの再発モデルを使って未来を予測します」。したがって、特定の年において、外部の視点から見るとビルには衝突が起こる確率は20%と示唆されます。それを確認した後、ビルは今日の状況を見て、その数字を上下に調整します。異なる外部の視点を見つけることはしばしば可能です。レンゼッティ問題では、アメリカの家庭におけるペットの飼育率が一つの外部の視点です。しかし、これをさらに洗練させることができます。84チェスナットアベニューのような一戸建て住宅は、アパートやコンドミニアムよりもペットに優しい住環境です。したがって、レンズを絞り、アメリカの一戸建て住宅のペット飼育率—例えば73%—を外部の視点として使うことができます。この第二の外部の視点は、私たちが興味を持っている特定のケースにより近いので、73%が出発点としてはより良い選択になるでしょう。もちろん、私は外部の視点が明白な例を挙げることで自分を楽にしています。しかし、アラファト・ポロニウム問題における外部の視点は何でしょうか?それは難しいです。中東の指導者が毒殺の疑いを調査するために定期的に遺体を掘り起こされるわけではないので、こうしたケースで毒が検出される確率が73%であるという情報を簡単にグーグル検索で見つけることはできません。しかし、それは外部の視点を飛ばして内部の視点に直接進むべきだということを意味しません。フェルミスタイルで考えてみましょう。ここには亡くなった有名人がいます。主要な調査機関は、疑いの理由が十分にあると考え、遺体を掘り起こしています。そのような状況下で、調査が毒殺の証拠を見つけることはどれくらいの頻度でしょうか?私はわかりませんし、調べる方法もありません。しかし、少なくとも裁判所や医療調査官が調査する価値があると納得するだけの表面的な根拠があることは知っています。それはゼロをかなり上回っている必要があります。したがって、少なくとも20%としましょう。しかし、確率は100%にはなりません。もしそれがそれほど明確で確実であれば、埋葬前に証拠が発見されていたはずです。したがって、確率は80%を超えることはないとしましょう。これは大きな幅です。中央値は50%です。したがって、この外部の視点は私たちの出発点として機能します。なぜ外部の視点が最初に来るべきなのか疑問に思うかもしれません。結局のところ、内部の視点に飛び込んで結論を導き出し、その後外部の視点に移ることもできるのではないでしょうか?それでもうまくいくのでしょうか?残念ながら、そうではないでしょう。その理由は、アンカリングと呼ばれる基本的な心理的概念にあります。私たちが推定を行うとき、私たちは何らかの数字から始めて調整する傾向があります。私たちが最初に始める数字はアンカーと呼ばれます。 それは重要です。なぜなら、私たちは通常、調整が不十分であり、悪いアンカーが簡単に悪い推定を生む可能性があるからです。そして、悪いアンカーに落ち着くのは驚くほど簡単です。ダニエル・カーネマンとアモス・トヴェルスキーの古典的な実験では、無意味な数字、たとえばランダムに選ばれた数字に人々をさらすだけで、その判断に影響を与えることができることが示されました。したがって、内面的な視点から始める予測者は、ほとんど意味のない数字に左右されるリスクがあります。しかし、外面的な視点から始めれば、彼女の分析は意味のあるアンカーから始まります。そして、より良いアンカーは明確な利点です。 **内面的な視点** あなたは質問をフェルミ化し、外面的な視点を考慮し、そして今、ついに内面的な視点に深く入り込むことができます。アラファトとポロニウムに関する質問の場合、それは中東の政治や歴史を掘り下げることを意味します。そして、その情報は膨大です。ですので、小さな図書館を作り、本を読み漁るために6ヶ月間の時間を確保するのが正しいのでしょうか?いいえ、間違いです。そのような勤勉さは称賛に値しますが、同時に誤った方向に進むことになります。無目的に一本の木を調べ、次に別の木、また別の木と進んでいくと、すぐに森の中で迷ってしまいます。内面的な視点の良い探求は、あちこちをさまよいながら情報を吸収し、洞察が自然に浮かび上がることを期待することではありません。それはターゲットを絞り、目的を持った調査です。再度、フェルミ化が鍵となります。ビル・フラックがアラファトとポロニウムの質問をフェルミ化したとき、彼は「はい」と答えるためのいくつかの道筋があることに気づきました:イスラエルがアラファトを毒殺した可能性、アラファトのパレスチナの敵が彼を毒殺した可能性、またはアラファトの遺体が死後に汚染され、毒殺のように見せかけられた可能性です。このような仮説は、内面的な視点を調査するための理想的な枠組みです。最初の仮説から始めましょう:イスラエルがポロニウムでヤーセル・アラファトを毒殺した。これが真実であるためには何が必要でしょうか?1. イスラエルはポロニウムを持っているか、手に入れることができる。2. イスラエルはアラファトを死なせるために大きなリスクを取るほど強く望んでいる。3. イスラエルはポロニウムでアラファトを毒殺する能力がある。これらの要素はそれぞれ調査され、賛否の証拠を探し、どれくらい真実である可能性があるか、したがってその仮説がどれくらい真実である可能性があるかを把握します。そして次の仮説へ、さらに次へと進みます。これは探偵の仕事のように聞こえますが、実際にそうなのです。正確に言えば、これは本物の調査者が行う探偵の仕事であり、テレビ番組の探偵とは異なります。それは体系的で、遅く、要求が高いですが、情報の森の中を無目的にさまようよりもはるかに効果的です。 **テーゼ、アンチテーゼ、合成** あなたは外面的な視点と内面的な視点を持っています。今、それらを統合する必要があります。ちょうどあなたの脳が両目の異なる視点を一つのビジョンに統合するように。デビッド・ロッグというスーパー予測者であり、バージニアに住む半引退したソフトウェアエンジニアは、ヨーロッパのテロリズムに関する質問に取り組む際にそれを実現しました。 2015年初頭、パリの風刺雑誌シャルリー・エブドでテロリストによって11人が殺害された直後のことだった。IARPAは「2015年1月21日から3月31日の間に、フランス、イギリス、ドイツ、オランダ、デンマーク、スペイン、ポルトガル、またはイタリアでイスラム過激派による攻撃が行われる可能性はありますか?」と問いかけた。 メディアがイスラム過激主義やヨーロッパのムスリムコミュニティに関する情報で溢れていたこの時期、内面的な見方に飛びつくのは魅力的だった。しかし、デイビッドはもっと賢明だった。まず、彼はウィキペディアでイスラム過激派によるテロ攻撃のリストを見つけた。そして、過去5年間に指定された国々での攻撃の数を数えた。その数は6件だった。「したがって、基本的な発生率は1.2件/年と計算しました」と彼はGJPフォーラムに書き込んだ。外部の視点を確立した後、デイビッドは内部の視点に切り替えた。過去数年間、イラクとシリアのイスラム国(ISIS)の動きが急速に台頭していた。何百人ものヨーロッパのムスリムが参加し、ISISはヨーロッパに対してテロ攻撃を繰り返し脅迫していた。デイビッドは、これが状況を非常に大きく変えたため、2010年以前のデータはもはや関連性がないと判断した。そこで彼はそれらを計算から除外した。その結果、基本的な発生率は1.5件に上昇した。「これは、ISISの勧誘や脅威のレベルを考えると、まだ低いと思います」と彼は述べた。しかし、デイビッドはシャルリー・エブド襲撃後にセキュリティ対策が大幅に強化されたことも指摘し、これが攻撃の可能性を減少させるだろうと考えた。この二つの要因を天秤にかけた結果、デイビッドは「1/5だけ上げて、1.8件(年あたりの攻撃数)にすることにします」と決定した。 予測期間には残り69日があった。そこでデイビッドは69を365で割り、その後1.8を掛け算した。結果は0.34だった。したがって、彼はIARPAの質問に対する答えが「はい」である可能性は34%だと結論づけた。 これは外部の視点と内部の視点を融合させた教科書的な例だった。しかし、デイビッドは「34%、最終的な答え」と言っているわけではなかった。彼はGJPフォーラムで自分の分析を共有した。なぜなら、彼はチームメイトが何を考えているのかを知りたかったからだ。言い換えれば、彼はより多くの視点を求めていたのだ。外部の視点、内部の視点、そしてその二つの統合を考えることは終わりではなく、良い始まりに過ぎない。スーパーフォーキャスターは常に自分の見解に統合できる他の視点を探し続ける。新しい視点を得る方法は多岐にわたる。他の予測者は何を考えているのか?彼らはどのような外部と内部の視点を持っているのか?専門家は何を言っているのか?自分自身で異なる視点を生み出す訓練をすることもできる。ビル・フラックが判断を下すとき、彼はしばしばデイビッド・ロッグのように自分の考えをチームメイトに説明し、批評を求める。部分的には、彼は彼らが欠陥を見つけて自分の視点を提供してくれることを期待しているからだ。しかし、彼の判断を書き留めることは、それから距離を置く方法でもあり、彼はそれを見直して精査することができる。「これは自己フィードバックのプロセスです」と彼は言う。「私はこれに同意しますか?これには穴がありますか?これを埋めるために他の何かを探すべきですか?」 「もし私が他の誰かだったら、これに納得できるだろうか?」 これは非常に賢いアプローチです。研究者たちは、人々に自分の初期判断が間違っているかもしれないと仮定させ、その理由を真剣に考えさせた後、再度判断を下させることで、最初の判断と組み合わせると精度が向上することを発見しました。この方法は、他の人からの第二の見積もりを得るのとほぼ同じくらいの精度向上をもたらします。同様の効果は、数週間の時間を置いてから再度見積もりを求めることでも得られました。このアプローチは「群衆の知恵」という概念に基づいており、「内なる群衆」と呼ばれています。億万長者の金融家ジョージ・ソロスはその良い例です。彼は成功の鍵の一つとして、自分自身から一歩引いて自分の思考を評価し、異なる視点を自分に提供するという精神的習慣を挙げています。 質問に対して別の視点を得るためのさらにシンプルな方法があります。それは、質問の言い回しを少し変えることです。例えば、「南アフリカ政府はダライ・ラマに6ヶ月以内にビザを与えるだろうか?」という質問を考えてみてください。単純な予測者は、ダライ・ラマがビザを取得することを示唆する証拠を探しに行き、彼がビザを取得しないことを示唆する証拠を無視してしまいます。一方、より洗練された予測者は確認バイアスについて知っており、両方の方向に証拠を探します。しかし、常に「彼はビザを取得するのか?」という質問を考えていると、思考の場が一方向に傾いてしまい、無意識のうちに確認バイアスに陥る可能性があります。「これは南アフリカだ!黒人の政府関係者はアパルトヘイトの下で苦しんだ。もちろん、チベットのネルソン・マンデラにビザを与えるだろう。」その傾向をチェックするために、質問を逆さまにして「南アフリカ政府はダライ・ラマにビザを6ヶ月間拒否するだろうか?」と尋ねてみてください。この小さな言い回しの変更は、反対方向に傾くことを促し、ビザを拒否する理由を探すことを助けます。例えば、最大の貿易相手国を怒らせたくないという欲求が大きな理由の一つです。 外部の視点、内部の視点、他の外部および内部の視点、自分自身からの第二の意見…それは多くの視点であり、必然的に多くの矛盾した情報を伴います。デイビッド・ロッグの対立する外部と内部の視点をうまく統合したものは簡単に見えましたが、実際にはそうではありません。そして、統合される視点の数が増えるにつれて、その難しさは増します。スーパーフォアキャスターがGJPフォーラムに投稿するコメントは、「一方では/他方では」という弁証法的なやり取りであふれています。そして、スーパーフォアキャスターは二つ以上の手を持っています。「一方では、サウジアラビアは大きな財政的余裕があるため、石油価格を低く保つリスクは少ない」と、2014年11月にサウジがOPECの生産削減に同意するかどうかを判断しようとしていたスーパーフォアキャスターは書いています。「他方では、サウジアラビアは王政への従順を買うために、より高い社会支出を支えるために高い価格が必要です。」 しかし、サウジアラビアは、北アメリカでの掘削熱や世界的な需要の減少といった価格下落の要因を制御できないと考えているかもしれません。そのため、彼らは生産削減を無駄だと見なす可能性があります。結論としては、「気がかりな感じがする、80%」ということです。(実際、サウジアラビアは生産削減を支持しなかったため、多くの専門家は驚きました。)これが「トンボの目」の働きです。そして、確かにこれは精神的に負担が大きいものです。スーパーフォーキャスターは、対立する意見についての議論を日常的に行い、ほとんどの人が頭痛に屈するような段階を過ぎてもその議論を続けます。彼らは「十セント!」と即答する人々とは真逆の存在です。そのため、誰もが驚かないように、彼らは認知反射テスト(CRT)で素晴らしい結果を出しました。昔の「二度考えろ」というアドバイスは忘れてください。スーパーフォーキャスターはしばしば三度考え、時にはさらに深く分析するための準備をしていることもあります。それでも、彼らは普通の人々です。予測は彼らの趣味であり、唯一の報酬はギフト券とFacebookでの自慢です。なぜ彼らはそんなに多くの時間を費やすのでしょうか?一つの答えは、それが楽しいからです。「認知の必要性」という心理学用語は、難しい思考に取り組み楽しむ傾向を指します。認知の必要性が高い人々は、クロスワードや数独パズルが好きで、難しいほど良いと感じるタイプであり、スーパーフォーキャスターはこのテストで高得点を得ます。また、性格の要素も関与している可能性があります。性格心理学における「ビッグファイブ」の一つに「経験への開放性」があり、これは多様性の好みや知的好奇心などのさまざまな側面を含みます。多くのスーパーフォーキャスターにおいて、この特性は明らかです。ガーナ出身でないほとんどの人は、「ガーナの大統領選挙で誰が勝つか?」という質問が無意味だと感じるでしょう。彼らはどこから始めればよいのか、なぜそれに取り組む必要があるのかも分からないでしょう。しかし、私がその仮定の質問をダグ・ローチに投げかけたとき、彼は単に「これはガーナについて何かを学ぶ機会だ」と答えました。 しかし最終的には、知性と同様に、これは誰かが持っている特性よりも行動に関係しています。優れたパズル解決者は予測のための原材料を持っているかもしれませんが、基本的で感情的に充満した信念を疑う意欲がなければ、自己批判的思考の能力が高い、あまり知的でない人に対してしばしば不利になります。重要なのは、持っている生の計算能力ではなく、それをどう活用するかです。ダグ・ローチを見てください。彼の自然な傾向は明らかです。しかし、彼はそれだけで乗り切れるとは考えていません。彼はその傾向を育てています。ダグは、人々が楽しみのために読むとき、自然に同じ考えを持つ人々に引き寄せられることを知っています。そこで彼は、ニューヨーク・タイムズからマイナーなブログまで、数百の情報源を含むデータベースを作成し、それらをイデオロギーの方向性、主題、地理的起源でタグ付けし、次に読むべきものを多様性を重視した基準で選ぶプログラムを書きました。 ダグのシンプルな発明のおかげで、彼は常に異なる視点に出会うことができるでしょう。ダグは単に心が開かれているだけではなく、積極的に心を開いています。積極的オープンマインド(AOM)は、心理学者ジョナサン・バロンによって提唱された概念で、彼はペンシルベニア大学で私の隣のオフィスにいます。バロンのAOMテストでは、「人々は自分の信念に反する証拠を考慮すべきである」「自分に賛成する人々よりも、自分に反対する人々に注意を払う方が有益である」「考えを変えることは弱さの兆候である」「直感が意思決定において最良のガイドである」「証拠が反対を示しても、自分の信念を貫くことが重要である」といった声明に対して、あなたが同意するかどうかを尋ねます。予想通り、スーパーフォアキャスターたちはバロンのテストで高得点を獲得します。しかし、もっと重要なのは、スーパーフォアキャスターたちがこの概念を体現していることです。彼らは言葉だけでなく行動でも示しています。スーパーフォアキャスターにとって、信念は単なるスローガンではありませんが、もし一言で表す必要があるなら、それが適切な表現でしょう。 スーパーフォアキャスター?私たちはビッグデータの時代に生きています。膨大で急増する情報技術ネットワークは、データサイエンティストたちが強力なコンピュータと難解な数学を駆使して分析できる驚異的な量の情報を生み出しています。そこから秩序と意味が引き出され、現実はかつてないほど明確に見え、予測されます。しかし、正直に言うと、私たちのほとんどはデータサイエンティストたちがどのようにしてそれを成し遂げているのか、まったく理解していません。それは少し intimidating(威圧的)であり、眩しいものでもあります。科学者でありSF作家でもあるアーサー・C・クラークが有名な言葉を残したように、「十分に進化した技術は魔法と区別がつかない」のです。 コーネル大学の数学の助教授であるリオネル・レビンは、その魔法使いの一人です。彼の履歴書には、ハーバード大学での数学の学士号、バークレーでの数学の博士号、数々の名誉ある助成金やフェローシップ、そして「複数のソースを持つ内部集約モデルのスケーリング限界」といった難解なタイトルの論文が並んでいます。数学の魔法使いらしく、彼は若いです。彼がハーバードを卒業した年、情報機関はサダム・フセインが大量破壊兵器を持っていると100%確信したと決定しました。レビンはまた、スーパーフォアキャスターでもあります。彼は極端な例ではありますが、スーパーフォアキャスターの中心的な特徴を強調しています。それは、彼らが数字に対する特別な才能を持っているということです。彼らのほとんどは、基本的な数理能力を問う簡単なテストを見事にクリアしました。そのテストには「ウイルス感染の確率は0.05%です。10,000人中、感染するのは約何人ですか?」という質問が含まれていました(答えは5人です)。そして、数理能力は彼らの履歴書にも明らかに表れています。多くは数学、科学、またはコンピュータプログラミングのバックグラウンドを持っています。ブルックリンの映画製作者で、現在はアートの世界にいるジョシュア・フランケルも、数学と科学を専門とするニューヨークの高校に通い、大学卒業後の最初の仕事はコンピュータアニメーションを使った視覚効果の制作でした。私は、数字に対して不安を感じるスーパーフォアキャスターに出会ったことがありませんし、ほとんどの人は数字を実用的に使う能力を持っています。そして、彼らは時折それを行います。ビル・フラックが通貨の為替レートの予測を求められると、彼はそのレートの歴史的変化を調べ、それに基づいてモンテカルロモデルを構築します。それは、専門家にとっては基本的なことです。他の人にとっては、古代アラム語のように難解です。ウォール街では、数学の魔法使いはクオンツと呼ばれ、彼らが使う数学はモンテカルロモデルよりもさらに難解になることがあります。スーパーフォアキャスターがデータに対して特別な親和性を持っていることを考えると、それが彼らの素晴らしい結果を説明するのではないかと疑うのは合理的です。アルゴリズムの手品、ささやかれた統計的呪文、そしてプレスト!驚くほど正確な予測が!数字に詳しい人々はその結論を好むかもしれませんが、高校以来微分積分をやっていない人々にとって、そして「微分積分」という言葉を読んで冷や汗をかいている人々にとっては、それはスーパーフォアキャスティングとの間に堀と城壁を作ることになります。しかし、堀も城壁もありません。スーパーフォアキャスターは、 時折、自分自身の明確な数学モデルを展開したり、他の人のモデルを参照したりすることはあるが、それは稀である。彼らの予測の大部分は、慎重な思考と微妙な判断の産物に過ぎない。「数学が役立った質問がいくつか思い浮かぶ」とライオネル・レビンは自身の予測について振り返るが、その他は主観的な判断に頼っている。「すべては、バランスを取ること、関連情報を見つけること、そしてそれが本当にどれほど関連しているのかを判断することです。これが私の予測にどれほど影響を与えるべきなのか?」数学を使わないことは、数学教授にとって誇りの一部でもある。人々は彼の予測の成功が数学のおかげだと考えるだろうから、「私は逆説的に、数学を使わずに良い予測者になれることを証明しようとした」と彼は言った。 しかし、スーパーフォアキャスターがほぼ一様に高い数的能力を持っているのは単なる偶然ではない。優れた数的能力はスーパーフォアキャスターに役立つが、それは未来を予測する難解な数学モデルにアクセスできるからではない。真実はもっとシンプルで微妙で、ずっと興味深い。 「オサマはどこに?」2011年初頭、米国の情報機関はある特異な施設に注目していた。その高い壁に囲まれた建物群は、パキスタンのアボタバードという裕福な地域では普通のことだった。しかし、その施設の住人は不明で、明らかにその状態を保ちたがっていた。それは異常だった。そして、集まった証拠の断片が、これがオサマ・ビン・ラディンの住居であることを示唆していた。それはほぼ唯一無二の状況だった。彼らはついに、9/11の攻撃からほぼ10年後にテロリストの首謀者を見つけたのだろうか?今ではその質問の答えは誰もが知っている。しかし、当時の分析官たちは知らなかった。彼らは、核兵器を持つ不安定な国の内部で軍事攻撃を発動する可能性のある難しい判断を下さなければならなかった。その判断とその結果は、映画『ゼロ・ダーク・サーティ』で dramatizedされることになる。「私は今から大統領と目を合わせに行く。知りたいのは、全くの無駄話なしで、皆がこの件についてどこに立っているのかだ」と、俳優ジェームズ・ガンドルフィーニが『ゼロ・ダーク・サーティ』でCIA長官レオン・パネッタを演じながら言う。彼は会議テーブルの頭に座り、にらみつける。「さて、非常にシンプルに。彼はそこにいるのか、それともいないのか?」副長官が最初に答える。「私たちは確実性を扱っているわけではありません。私たちは確率を扱っています。彼がそこにいる確率は60%だと言えます。」 フィクションのパネッタは次の人を指さす。「私は同意します」と彼は言う。「60%です。」 「私は80%です」と次の人が言う。「彼らのOPSEC(作戦の安全性)が私を納得させます。」 「君たちは何かに同意したことがあるのか?」とパネッタが尋ねる。こうしてテーブルを回りながら、次々と意見が出る。60%、と言う者もいれば、80%、60%と続く。パネッタは椅子に背をもたれさせ、ため息をつく。「これは混乱だな。」 ここで映画を一時停止しよう。フィクションのレオン・パネッタが何よりも望んでいるものは何か?それは合意である。 彼は、各人が同じ結論に達することを望んでいます。それによって、その結論が正しいか、少なくとも最良のものであると確信できるからです。その立場にいるほとんどの人も同じように感じるでしょう。合意は安心感を与えますが、意見の不一致は…まあ、フィクションのレオン・パネッタのように色彩豊かな表現は使わないかもしれませんが、大多数は同じ感情を共有するでしょう。しかし、フィクションのレオン・パネッタは間違っています。テーブルにいる人々は、難しい問題を独立して判断し、CIAのディレクターに自分が心から信じることを伝えるよう求められました。たとえ彼らが同じ証拠を見ていたとしても(おそらくいくつかのばらつきがあるでしょうが)、全員が正確に同じ結論に達することは考えにくいです。彼らは異なる人々であり、異なる教育、訓練、経験、そして個性を持っています。賢明な経営者は、普遍的な合意を期待せず、そのような合意が現れた場合には、集団思考が蔓延している警告信号として扱うべきです。さまざまな判断は、テーブルの周りにいる人々が実際に自分自身で考えており、独自の視点を提供していることの確かな証拠です。フィクションのレオン・パネッタは、異なる人々から異なる判断を聞いたときに喜ぶべきでした。それは「群衆の知恵」であり、贈り物のように包まれていました。彼がすべきことは、その判断を統合することだけでした。単純な平均を取ることが良いスタートになるでしょう。または、彼が最も尊敬する判断を持つ人々により多くの発言権を与える加重平均を行うこともできます。いずれにせよ、それはトンボの目の働きです。私は実際のレオン・パネッタにこの有名なシーンについて尋ね、彼はそれに似たことが実際に起こったと確認しました。「多くの人々は情報分析官で、一定期間オペレーションに関わっていた人たちでした。その部屋には多くの経験がありました」と彼は振り返ります。しかし、合意はあまりありませんでした。判断は「三十から四十パーセントの可能性があると考える人から、九十パーセント以上だと思う人まで、さまざまでした」と彼は言います。しかし、実際のレオン・パネッタ—元議員、クリントン大統領の首席補佐官、オバマ大統領の国防長官—は、その多様性に対してフィクションのレオン・パネッタとはまったく異なる反応を示しました。彼はそれを歓迎しました。「私は周りの人々に、私が聞きたいことを言うのではなく、彼らが信じることを正直に伝えてほしいと促しています」とパネッタは言いました。大統領の首席補佐官を務めていたとき、彼は多様な意見を取得し、提示することが自分の仕事の重要な部分だと考えていました。実際のレオン・パネッタとフィクションのレオン・パネッタは対照的な存在です。さて、映画を再生しましょう。フィクションのレオン・パネッタが合意の欠如に嫌悪感を示した後、ゼロ・ダーク・サーティのヒロイン、マヤが自分のチャンスを得ます。彼女は部屋の後ろでじっとしていて、イライラしています。「百パーセント、彼はそこにいる」と彼女は宣言します。「いいよ、九十五パーセントにする。だって、確実性が君たちを怖がらせるのは知ってるから。でも、百パーセントだ!」フィクションのパネッタは感心します。 他の人々が不確実性について愚痴をこぼしている間、マヤはまるでバッテリングラムのように力強い。複合施設が発見された後、彼女はビン・ラディンがそこにいると確信し、すぐに爆撃して瓦礫にすることを望んだ。攻撃が行われないまま数週間が過ぎると、彼女は上司の窓に経過日数を書きなぐった。私たちは彼女が足を踏み鳴らしながら「21」と大きな赤い数字で書き、強調するためにそれを囲むのを見た。その後、彼女は98、99、100と書き、太いマジックマーカーで下線を引いた。彼女のフラストレーションを私たちは感じた。マヤは正しい。ビン・ラディンはそこにいる。他の人々を無視しなさい。フィクションのパネッタはマヤと観客と共にいる。後に彼は助手に、他の人々は「萎縮している」ため、イエスかノーかを決められないと言った。確率は弱者のためのものだ。もう一度一時停止して考えてみてほしい。フィクションのレオン・パネッタはどう考えるか。彼には二つの選択肢しか見えない:はい、ビン・ラディンはそこにいる;いいえ、彼はいない。彼の思考のダイヤルには二つの設定しかない。「もしかしたら」という選択肢はなく、ましてや「もしかしたら」の度合いを示す設定もない。『ゼロ・ダーク・サーティ』のそのシーンの展開から判断すると、映画製作者たちはそのことを尊重している。彼らは観客もそう思うだろうと賭けている。ビン・ラディンはそこにいるのか?はいかいいえか?これは「くだらないことは抜きにして」という考え方だ。これがマヤの考え方であり、彼女は正しい。そう見えるが、システム2を使って二度考えると、実際にはマヤは不合理だ。手元の証拠から判断すると、複合施設にいる男がビン・ラディンである可能性は高かった。非常に高い可能性があるとも言える。しかし、100%?絶対に確実?彼でない可能性は全くないのか?いいえ。複合施設にいる男は別のテロリストかもしれないし、麻薬密売人、アフガンの軍閥、武器商人、あるいは偏執病を患った裕福なパキスタンのビジネスマンかもしれない。各選択肢が真実である可能性がわずかであっても、それらは簡単に1%、2%、5%などに加算されるため、私たちはビン・ラディンであることを100%確信することはできない。このような細かい区別は重要だろうか?実際、情報コミュニティはかつてサダム・フセインが大量破壊兵器を持っていると確信しすぎたため、彼が持っていない可能性を探ることはなかった。はい、それは重要だ。もちろん、マヤが足を踏み鳴らしている間、客観的な真実があった。ビン・ラディンはそこにいた。したがって、マヤの主張は正しかったが、証拠が支持できる以上の極端なものであり、彼女は「正しいが不合理」ということになる。これは、情報コミュニティが「スラムダンク」をサダム・フセインがWMDを持っている可能性を60%または70%に縮小していた場合の「間違っているが合理的」な立場の鏡像だ。最終的な結果—マヤにとっては幸せで、情報コミュニティにとっては不幸—はそれを変えない。実際のレオン・パネッタは、このようなプロセスと結果の逆説を理解している。そして、彼はフィクションのレオン・パネッタよりも確実性に対してはるかに冷静だ。「100%のものはない」と彼はインタビュー中に何度も言った。実際のレオン・パネッタは、スーパーフォアキャスターのように考える。 テーブルの頭に座っているのは、架空のレオン・パネッタではなく、実際のバラク・オバマです。ホワイトハウスの伝説的な状況室に座り、オバマはCIAの一連の職員が神秘的なパキスタンの施設にいる男の正体について意見を述べるのを聞いていました。CIAのチームリーダーは、大統領に対して、ほぼ確実にビン・ラディンであると伝えました。「彼は自信度を95%としました」と、マーク・ボウデンは『フィニッシュ:オサマ・ビン・ラディンの殺害』の中で記しています。この本は、歴史上最も有名なコマンドー襲撃の背後にある意思決定についてのボウデンの記録です。別のCIA職員も最初の意見に同意しましたが、他の職員はあまり楽観的ではありませんでした。「国家情報局の4人の上級職員がこのケースを検討し、自分たちの意見を書き出しました」とボウデンは回想します。「ほとんどの職員は自信度を約80%と見積もっていましたが、中には40%や30%と低く見積もる者もいました。」別の職員は、施設にいるのがビン・ラディンである自信度は60%だと言いました。「さて、これは確率の問題だ」と大統領はボウデンの記録によれば応じました。ボウデンは次のように編集しています。「10年前、サダム・フセインが大量破壊兵器を隠しているという誤った判断を下して以来、CIAは確実性を評価するためのほぼ滑稽なほど複雑なプロセスを導入していました……それは、良い判断のための数学的な公式を考え出そうとするようなものでした。」ボウデンはCIAの数字や確率の使い方に感銘を受けていないようです。オバマも同様だったとボウデンは述べています。「最終的に、大統領が見出したのは、より多くの確実性ではなく、より多くの混乱だった」とボウデンは報告しています。オバマは後のインタビューで「この状況では、得られるのは不確実性を隠す確率であり、実際に有用な情報を提供するものではなかった」と語ったとボウデンは書いています。続けてボウデンは「オバマはそれを自分自身に認めるのに苦労しなかった。もし彼がこの情報に基づいて行動すれば、それは純粋にギャンブルをすることになる。大きなギャンブルだ」と述べています。 さまざまな意見を聞いた後、オバマは部屋に向かって話しました。「これは五分五分だ」と彼は言いました。それは皆を黙らせました。「みんな、これはコインの裏表のようなものだ。私にはこれ以上の確実性に基づいてこの決定を下すことはできない。」ボウデンはオバマの結論を明らかに称賛しています。彼は称賛すべきでしょうか?ボウデンが提供する情報は不十分ですが、CIA職員の中央値の見積もり—「群衆の知恵」—は約70%のようです。それにもかかわらず、オバマは現実を「五分五分」と宣言します。彼はそれをどういう意味で言ったのでしょうか?ここで注意が必要です。実際にはいくつかの可能性があります。一つは、オバマが文字通りの意味で言っているということです。彼はさまざまな意見を聞き、50%を最も近い確率として選んだのかもしれません。もしそうであれば、彼は誤解しています。集団の判断はそれよりも高く、ボウデンの記録に基づけば、彼には50%がより正確であるという合理的な根拠はありません。それは空から引っ張り出された数字です。 しかし、研究者たちが示しているように、「50%」や「五分五分」という表現を使う人々は、しばしばそれを文字通りには意味していません。彼らが言いたいのは「確信が持てない」や「不確かだ」、あるいはもっと単純に「多分」といったことです。この文脈を考えると、オバマがそう考えていたのではないかと私は疑っています。もしそうであれば、それは合理的な判断だったかもしれません。オバマは重要な決定を下す立場にある執行者でした。彼は、ビン・ラディンがその施設にいる可能性が少しでもあれば攻撃を命じるべきだと感じたのかもしれません。確率が90%であろうと70%であろうと、あるいは30%であろうと、それは問題ではありませんでした。だからこそ、具体的な数字を確定させるために時間を無駄にするよりも、彼は議論を早々に切り上げて次に進んだのです。 もちろん、私にはオバマの考えがどうだったのかは分かりません。そして、もう一つの可能性のある説明があります。それは、あまり擁護の余地がないものです。フィクションのレオン・パネッタのように、オバマは推定値の幅広いばらつきに悩まされていたのかもしれません。その意見の不一致が、彼にそれらが信頼できないと思わせたのです。そこで彼は、確率論者が「無知の事前分布」と呼ぶ状態に退いたのです。これは、コインが表か裏か、あるいはこの場合、海軍SEALがノックしたときにオサマが主寝室にいるかどうかを知る前の知識の状態です。そしてそれは間違いでした。なぜなら、それはオバマがテーブル上にある情報を十分に活用しなかったことを意味するからです。しかし、フィクションのレオン・パネッタとは異なり、オバマの思考のダイヤルには二つの設定だけではなく、三つ目の設定「多分」がありました。だから、彼はその地点に落ち着いたのです。ボウデンの説明は、私が約30年前にアモス・トヴェルスキーが言った何気ない発言を思い出させました。私たちは核戦争を防ぐために任命された国家研究評議会の委員会で一緒に働いていました。彼は言いました、確率を扱う際にほとんどの人は「起こる」「起こらない」「多分」の三つの設定しか持っていないと。アモスはいたずらっぽいユーモアのセンスを持っていました。また、世界を救うための学術委員会の不条理さを理解していました。私は彼が冗談を言っていたと98%確信しています。そして、彼の冗談が人間の判断に関する基本的な真実を捉えていると99%確信しています。 **原始時代の確率** 人間は、私たちが認識できる人間である限り、不確実性に対処してきました。そして、そのほとんどの期間、私たちは不確実性の統計モデルにアクセスすることができませんでした。なぜなら、それらは存在しなかったからです。歴史の中で非常に遅い時期、つまりヤコブ・ベルヌーイの『アールス・コンジェクタンディ』が1713年に出版されるまで、最も優れた頭脳たちが確率について真剣に考え始めることはありませんでした。それ以前は、人々は鼻先の視点に頼るしかありませんでした。長い草の中で影が動くのを見ます。ライオンを心配すべきでしょうか?長い草からライオンが襲ってくる例を考えようとします。その例がすぐに思い浮かべば、逃げろ!第2章で見たように、それがあなたのシステム1が働いている証拠です。 もし反応が十分に強ければ、二者択一の結論を導き出すことができます。「はい、それはライオンです」または「いいえ、それはライオンではありません」。しかし、反応が弱い場合には、不安を感じさせる中間の可能性が生まれます。「もしかしたら、それはライオンかもしれません」。鼻先の感覚では、例えば「それがライオンである確率が60%」と「80%」を区別できるほどの微細な判断はできません。それには、ゆっくりとした意識的で慎重な思考が必要です。もちろん、私たちの祖先が直面していた切迫した存在的な問題に対処していたとき、そんな微細な区別をする必要はほとんどありませんでした。むしろ、それは望ましくなかったかもしれません。三段階のダイヤルは迅速で明確な指示を提供します。「それはライオンですか?」はい=逃げろ! もしかしたら=警戒を怠るな! いいえ=リラックス。60%の確率と80%の確率を区別する能力はほとんど意味がありません。実際、より詳細な分析はあなたの判断を遅らせ、命を危険にさらす可能性があります。この観点から、二段階または三段階のメンタルダイヤルを好むことは理解できます。そして、多くの研究がこの点を裏付けています。ある親が、子供が重い病気にかかるリスクを10%から5%に減らすためにお金を払うことをいとわない場合、5%から0%に減らすためにはその2倍から3倍の金額を払うことを厭わないかもしれません。なぜ5%から0%への減少が10%から5%への減少よりもはるかに価値があるのでしょうか?それは、5%のリスク削減以上のものをもたらすからです。それは確実性をもたらします。0%と100%は、経済学者の数学モデルが示すべき以上に私たちの心の中で重くのしかかります。再び言いますが、これは私たちの脳が進化した世界を考えると驚くべきことではありません。周囲には常にライオンが潜んでいるかもしれない、あるいは蛇がいるかもしれない、またはあなたの小屋を狙っている誰かが棍棒を持っているかもしれない、その他無数の脅威が存在していました。しかし、私たちの祖先は常に警戒を保つことはできませんでした。その認知的コストはあまりにも大きかったのです。彼らは心配のないゾーンが必要でした。その解決策は?小さな可能性を無視し、できるだけ二段階のダイヤルを使うことです。それはライオンか、そうでないか。何かが明らかにその二つの設定の間にあるとき—つまり、私たちが強制されるときだけ、私たちはメンタルダイヤルを「もしかしたら」に回します。 ハリー・トルーマンはかつて、一方的な意見を聞くのに飽きたから片腕の経済学者の話を聞きたいと冗談を言いました。「一方では…他方では…」という言い回しにうんざりしていたのです。このジョークは、トヴェルスキーのものに似た要素を持っています。私たちは答えを求めています。自信を持った「はい」または「いいえ」は、決して「もしかしたら」では得られない満足感をもたらします。この事実は、メディアが予測の記録が悪くても、何が来るかを確信しているハリネズミ型の専門家にしばしば頼る理由を説明しています。もちろん、自信のある判断を好むことが常に間違っているわけではありません。すべてが同じであれば、「フランスの人口はイタリアより多いか?」という質問に対する私たちの答えは、自信を持っているときの方が正しい可能性が高いです。自信と正確性は正の相関関係にあります。しかし、研究によれば、私たちはその相関関係の大きさを誇張していることが示されています。 人々は、同じ実績を持つ金融アドバイザーの中でも、自信に満ちたアドバイザーをより信頼する傾向があります。また、人々は自信と能力を同一視するため、「中程度の確率で起こる」と言う予測者は、あまり尊敬されないことになります。ある研究によれば、人々は「そのような判断を、予測者が一般的に無能であるか、特定の事実を知らないか、あるいは怠惰で、より高い自信を正当化するために必要な情報を集める努力を惜しんでいることの表れだと受け取った」と指摘されています。 このような原始的な思考は、多くの人々が確率を理解するのが難しい理由を説明するのに役立ちます。その一部は単純な無知や誤解に起因しています。例えば、「ロサンゼルスでの降雨確率が70%」というのは「1日の70%の時間雨が降る」や「ロサンゼルスの70%の地域で雨が降る」または「70%の予報士が雨が降ると思っているが30%はそう思っていない」という誤解です。しかし、これらの間違いの背後には、もっと根本的な問題があります。「明日雨が降る確率が70%」の意味を理解するためには、雨が降るか降らないかは不確実であり、もし私たちの予測が正しければ、100日間の予測のうち70日間は雨が降り、残りの30日は晴れるべきだということを理解しなければなりません。「雨が降る」とか「雨が降らない」と考える自然な傾向とは真逆の考え方です。 確率のこの深く直感に反する性質は、非常に洗練された人々でさえ基本的な間違いを犯す理由を説明しています。デイビッド・レオンハートが、予測市場の予測が「法律が無効になる確率が75%」と言ったのに実際には無効にならなかったために間違っていると主張したとき、もし誰かが彼の誤りを指摘したら、彼は額を叩いて「もちろん!」と言っただろうと私は確信していました。その後、レオンハートがこの罠について素晴らしいコラムを書いたことで、その疑念が確認されました。彼は、予測者が「共和党が次の選挙で上院を制する確率が74%」と言った場合、党が上院を取らなかったからといってその予測が間違っていると結論づけてはいけないと警告しました。「74%の確率がある」ということは「26%の確率がない」ということでもあるからです。 このような三つの設定のメンタルダイヤルによる混乱は広範囲にわたります。元財務長官のロバート・ルービンは、彼と当時の副官ラリー・サマーズがホワイトハウスや議会のトップ政策立案者にブリーフィングを行う際、80%の確率で何かが起こると伝えても、それを確実なものとして受け取る人々にしばしば苛立ちを感じていたと語りました。「高い確率があると言っても、これが起こらない可能性もあると伝えるために、テーブルを叩かなければならないような状況でした」とルービンは言いました。「しかし、人々は高い確率を『これは起こる』と解釈するようです。」それでも、もしこれらの教育を受けた成功した人々をその文脈から外し、座らせて話をしたら、彼らの反応はどうなるでしょうか。 教室で、「何かが起こる確率は80%です」という表現は「起こらない確率は20%です」という意味だと説明したら、彼らはきっと目を丸くして「それは明らかだ」と言うでしょう。しかし、教室を離れ、抽象的な議論から離れて現実の問題に直面すると、これらの教育を受けた優秀な人々は直感に戻ってしまいます。ルービンによれば、確率がほぼ均等な場合にのみ、結果が起こるかどうかを容易に理解できるのです。「もし60/40と言えば、人々はなんとなくその意味を理解します。」アモス・トヴェルスキーは1996年に若くして亡くなりましたが、彼はこのことを聞いて微笑んだことでしょう。 情報時代の確率 科学者たちは確率に対して根本的に異なるアプローチを取ります。彼らは不確実性を楽しむか、少なくとも受け入れます。なぜなら、現実の科学モデルにおいては、確実性は幻想だからです。レオン・パネッタは科学者ではありませんが、「何も100%ではない」と言ったときにその洞察を完璧に捉えました。 これは少し驚くべきことかもしれません。「ほとんどの人は科学を確実性と結びつける」と数学者で統計学者のウィリアム・バイヤーズは書いています。「確実性は、欠点のない状態だと感じられるので、最も望ましい状況は絶対的な確実性の状態です。科学的な結果や理論は、そのような確実性を約束しているように見えます。」一般的に、科学者は事実を生成し、それを岩に刻むように思われています。この事実の集まりが「科学」と呼ばれるものです。事実を蓄積する作業が進むにつれて、不確実性は後退します。科学の究極の目標は、不確実性の完全な根絶です。しかし、それは非常に19世紀的な科学観です。20世紀の科学の偉大な業績の一つは、不確実性が現実の不可避な要素であることを示すことでした。「不確実性は現実です」とバイヤーズは書いています。「完全な確実性の夢こそが幻想です。」これは、科学的知識の最前線でも、現在の核心に見える部分でも真実です。ある世代の科学者にとって岩のように固く見える科学的事実も、次の世代の進歩によって粉々にされることがあります。すべての科学的知識は仮説的です。何も岩に刻まれてはいません。もちろん、実際には科学者たちは確実性の言葉を使いますが、それは事実を主張する際に「この結論を支持する十分な証拠があり、高い信頼度でそれを保持していますが、新たな証拠や議論が私たちの見解を修正させる可能性があることも、極めてあり得ないとはいえ、残ります」と言うのは面倒だからです。しかし、科学者が「これは真実です」と言うときには、常に目に見えないアスタリスクがあるべきです。なぜなら、何も確実ではないからです。(そして、はい、私の仕事もそうです。この本のすべてを含めて。申し訳ありません。) もし何も確実でないなら、2つや3つの設定のメンタルダイヤルは致命的な欠陥を抱えています。「はい」と「いいえ」は確実性を表します。これらは排除されるべきです。残る唯一の設定は「多分」であり、人々が直感的に避けたがる設定です。 もちろん、単一の設定のメンタルダイヤルは無意味です。それはライオンですか?多分。ヤーセル・アラファトの遺骨からポロニウムが見つかるでしょうか?多分。神秘的な施設にいる男はオサマ・ビン・ラディンですか?多分。だから「多分」という言葉は、確率の度合いに分ける必要があります。それを行う一つの方法は、「おそらく」や「ありそうにない」といった曖昧な表現を使うことですが、これが危険な曖昧さを引き起こすため、科学者たちは数字を好みます。そして、その数字は予測者が管理できる限り細かく分けられるべきです。それは10%、20%、30%...または10%、15%、20%...あるいは10%、11%、12%という形を取るかもしれません。細かい方が良いのですが、その細分化が実際の違いを捉えていることが重要です。つまり、あなたが11%の確率で起こると言った結果が、実際には12%の結果よりも1%少なく、10%の結果よりも1%多く起こる場合です。この複雑なメンタルダイヤルが確率的思考の基盤です。ロバート・ルービンは確率的思考者です。ハーバード大学の学生時代、彼は哲学の教授が「証明可能な確実性は存在しない」と主張する講義を聞き、「それが私が考えていたすべてにピタリとはまった」と彼は私に語りました。それは彼の思考を導く公理となり、ゴールドマン・サックスでの26年間、ビル・クリントン大統領の顧問、そして財務長官としての彼の思考を導きました。彼の自伝のタイトルにもなっています:『不確実な世界で』。確実性を拒否することで、ルービンにとってすべてが確率の問題となり、彼は可能な限りの精度を求めました。「彼と初めて会ったとき、彼は法案が議会を通過するかどうか尋ねてきて、私は『絶対に通る』と言いました」と若い財務省の助手がジャーナリストのジェイコブ・ワイスバーグに語りました。「彼はそれが全く気に入らなかった。今では、私は確率は60%だと言います—それが59%か60%かについて議論できます。」クリントン政権下での彼の任期中—株価が急騰し、ルービノミクスが花開いた黄金時代—ルービンは大いに称賛されました。2008年の崩壊後、ルービンは同じく激しい批判を受けましたが、ルービンが英雄か悪党か、その中間かは私の専門分野ではありません。私にとって興味深いのは、1998年のニューヨーク・タイムズの特集記事でルービンの確率的思考が紹介されたとき、多くの人々がどのように反応したかです。彼らはそれを驚くほど直感に反する、挑戦的だと感じました。専門家たちはルービンの思考をキュービクルの壁にインスピレーショナルなメッセージや子供の写真と一緒に掲示しました。「さまざまな状況にいる人々が私にそれが影響を与えたと言ってくれました」と彼は2003年に語りました。その反応はルービンを困惑させました。彼は驚くべきことを言ったとは思っていませんでした。しかし、自伝でそのテーマを広げたとき、反応は同じでした。10年以上後、「私がパネルで話すときや何かのイベントで、人々が『本のコピーを持っているのでサインしてもらえますか?』とか『確率についてのこの議論がとても重要で面白かった』と言ってくれることがあります」とルービンは言います。「なぜ明らかに思えることが人々に影響を与えるのか、私にはわかりません。」 私には、多くの人々にとって洞察に満ちたものに思えます。確率的思考と、私たちにとってより自然に感じられる二つまたは三つの設定のメンタルダイヤルは、魚と鳥のように根本的に異なる存在です。それぞれは現実に対する異なる前提と、それに対処する方法に基づいています。そして、どちらか一方の考え方に慣れた人にとっては、もう一方は非常に奇妙に見えることがあります。 ロバート・ルービンは、スーパーフォーキャスターたちに「テーブルを叩く」必要はありません。80%の確率で何かが起こるということは、20%の確率で起こらないことを意味することを理解させるためです。彼らの優れた数理能力のおかげで、スーパーフォーキャスターたちは科学者や数学者と同様に、確率的思考をする傾向があります。不可避の不確実性を意識することが確率的思考の核心ですが、それを測定するのは難しいことです。そのため、私たちは哲学者たちが提案した「認識的不確実性」と「偶然的不確実性」の区別を利用しました。 認識的不確実性とは、あなたが知らないが、理論的には知ることができるものです。もしあなたが謎の機械の動作を予測したいのであれば、熟練したエンジニアたちは理論的にはそれを開けて理解することができるでしょう。メカニズムを把握することは、典型的な時計のような予測の課題です。一方、偶然的不確実性は、あなたが知らないだけでなく、知ることができないものです。フィラデルフィアで1年後に雨が降るかどうかを知りたいと思っても、どれだけ優れた気象学者に相談しても、季節の平均を超えて予測することはできません。あなたは、理論的にも排除することが不可能な、手に負えない雲のような問題に直面しています。偶然的不確実性は、私たちがどれだけ注意深く計画を立てても、人生に常に驚きをもたらすことを保証します。スーパーフォーキャスターたちは、この深い真実をほとんどの人よりもよく理解しています。彼らは、質問が不可避の不確実性を伴っていると感じたとき—例えば、通貨市場に関する質問—には、慎重になり、初期の推定を35%から65%の「曖昧さの範囲」に留め、慎重に進めることを学んでいます。彼らは、見通しが「曇っている」ほど、そのダーツを投げるチンパンジーに勝つのが難しいことを知っています。 もう一つの証拠は「50対50」というフレーズから来ています。慎重な確率的思考をする人々にとって、50%は広範な設定の中の一つに過ぎないため、49%や51%を使うのと同じくらい使う可能性はありません。三つの設定のメンタルダイヤルを使う予測者は、確率的判断を求められたときに50%を使う可能性が高く、これは「もしかしたら」を表す代用として使われるからです。したがって、50%を頻繁に使う人は、正確性が低いと予想されます。そして、まさにそれがトーナメントデータが示していることです。 私はかつて、モントリオールのスーパーフォーキャスター、ブライアン・ラバットに何を読むのが好きか尋ねました。彼はフィクションとノンフィクションの両方だと答えました。どちらがどのくらいかと尋ねると、「70%...」と一瞬間を置いて、「いや、ノンフィクションが65%、フィクションが35%」と言いました。これはカジュアルな会話としては驚くほど正確です。IARPAトーナメントで正式な予測を行う際でさえ、普通の予測者は通常それほど正確ではありませんでした。 代わりに、彼らは10単位にこだわる傾向があり、例えば何かが30%の可能性がある、または40%の可能性があると言うことはあっても、35%や37%とは言わないのです。スーパーフォアキャスターは、はるかに詳細な予測を行います。彼らの予測のうち、実に3分の1は単一のパーセンテージポイントを使っており、つまり、何かが起こる可能性を慎重に考え、例えば3%と判断することがあるのです。ロバート・ルービンに教えられた財務省の補佐官のように、スーパーフォアキャスターは非常に正確であろうと努め、その結果、私たちの多くが重要でないと見なすような違いについて議論することもあります。例えば、正しい確率が5%なのか1%なのか、あるいは1%未満でゼロに近いから切り捨てるべきかどうかなどです。これは「針の頭の上で何人の天使が踊れるか」という議論ではありません。なぜなら、そのスケールでの精度が時には重要だからです。それは、脅威や機会が非常にあり得ないが可能な世界から、完全に不可能な世界に移行することを意味します。これは、あり得ないことが起こった場合の結果が大きければ大きいほど重要です。エボラ出血熱の発生を想像してみてください。あるいは次のGoogleに資金を提供することです。 さて、私は読者に懐疑的であるよう促してきましたが、懐疑的な人はこれに疑問を持つかもしれません。「Appleの株が年末までに24%上昇する確率は73%です」と言って顎を撫でるのは簡単です。ほとんどの人が理解しない技術用語をいくつか織り交ぜれば、「確率過程」や「回帰分析」などと言って、数学や科学に対する人々の正当な尊敬を利用して頷かせることができます。これは、詳細さが単なる言葉遊びになってしまうことです。残念ながら、これはよくあることです。では、スーパーフォアキャスターの間に見られる詳細さが意味のあるものであることをどうやって確認できるのでしょうか?ブライアン・ラバットが最初に70%と見積もった後、65%に修正する際、その変化がより正確な見積もりを生む可能性が高いことをどうやって確信できるのでしょうか?その答えはトーナメントデータにあります。バーバラ・メラーズは、詳細さが正確さを予測することを示しました。10単位(20%、30%、40%)にこだわる平均的な予測者は、5単位(20%、25%、30%)を使う詳細な予測者よりも正確さが劣り、さらに1単位(20%、21%、22%)を使うより詳細な予測者にはさらに劣ります。さらにテストとして、彼女は予測を丸めて詳細さを減らしました。つまり、トーナメントで可能な最大の詳細さである単一のパーセンテージポイントの予測を、最も近い5に丸め、次に最も近い10に丸めました。このようにして、すべての予測は1段階詳細さが減りました。彼女はその後、ブライヤースコアを再計算し、スーパーフォアキャスターは最小のスケールの丸め(最も近い0.05)に対しても正確さを失うことを発見しましたが、通常の予測者は4倍大きな丸め(最も近い0.2)からはほとんど影響を受けませんでした。ブライアン・ラバットの詳細さは単なる言葉遊びではありません。それは精度であり、彼がスーパーフォアキャスターである主な理由の一つです。 ほとんどの人はブライアンのように正確さを追求しようとはせず、自分が知っていること、つまり二つか三つの設定のメンタルモデルに留まることを好みます。しかし、それは重大な間違いです。伝説の投資家チャーリー・マンガーが賢明に指摘したように、「この基本的でありながら少し不自然な初歩的確率の数学を自分のレパートリーに取り入れなければ、あなたは一生を片足の男が蹴り合いのコンテストに参加するように過ごすことになります。」非常に洗練された人々や組織でさえ、ブライアンのレベルには到達しようとしません。例えば、国家情報会議(NIC)は、イラク侵攻やイランとの交渉のような超敏感な決定に関する国家情報評価を作成する機関ですが、アナリストには五段階または七段階のスケールで判断を求めています。これは二つか三つの設定のダイヤルに比べて大きな改善ですが、最も熱心なスーパー予測者が多くの質問に対して達成できるレベルにはまだ及びません。私はNICで働いていた人々を知っていますが、彼らは自分たちの能力を過小評価しているのではないかと思います。NICや優れた人材を持つ他の組織も、それを重視し奨励すれば同様の結果を得られるはずです。そして、そうすべきです。未来をより明確に把握できることは、人生の蹴り合いのコンテストにおいて非常に価値があります。 さて、これは一体どういう意味なのでしょうか?カート・ヴォネガットの名作『スローターハウス・ファイブ』では、アメリカの捕虜が気に入らないことをつぶやきます。「その警備員は英語を知っていて、アメリカ人を列から引きずり出し、倒しました」とヴォネガットは書いています。アメリカ人は驚きました。彼は震えながら立ち上がり、血を吐きました。二本の歯が折れていました。彼は自分の言ったことに悪意はなかったのに、警備員がそれを聞いて理解するとは思ってもみなかったのです。「なぜ俺なんだ?」と彼は警備員に尋ねました。警備員は彼を列に戻しました。「なぜお前なんだ?誰でもそうだろう?」と彼は言いました。ヴォネガットはこのテーマを執拗に繰り返します。「なぜ俺なんだ?」とビリー・ピルグリムは宇宙人に誘拐されたときに嘆きます。「それは非常に地球人らしい質問ですね、ピルグリムさん」と宇宙人は答えます。「なぜお前なんだ?それに、なぜ私たちなのか?何でもそうだ。」無邪気な人だけが「なぜ?」と尋ねます。現実をより明確に見る人々は、そんなことを気にしません。それは鋭い洞察です。何かありそうもない重要なことが起こると、「なぜ?」と尋ねるのは人間として自然なことです。 何が起こっても、たとえ悲劇であっても、それが神の計画の意味ある一部であるという宗教的なメッセージは古くからあり、宗教に対する感情に関わらず、このような考え方が慰めとなり、耐え難い状況を乗り越える助けになることは間違いありません。逆境を乗り越えて驚異的な成功を収めたオプラ・ウィンフリーは、この考え方を体現し、推進しています。彼女はハーバード大学の卒業式のスピーチで、「失敗というものは存在しない」と述べました。 失敗は、人生が私たちを別の方向に導こうとしているだけのことです。すべての間違いから学びましょう。なぜなら、すべての経験や出会い、特にあなたの失敗は、あなたを教え、あなたが本来の自分になるように促すために存在しているからです。すべての出来事には理由があり、目的があります。オプラ・ウィンフリーは彼女の画期的なテレビ番組の最終回で、ほぼ同じことを明確に宗教的な言葉で述べました。「私は神の恵みの現れを理解しているので、偶然は存在しないことを知っています。偶然はありません。ここにはただ神の秩序があるだけです。」 宗教は意味を求める渇望を満たす唯一の方法ではありません。心理学者たちは、多くの無神論者も自分の人生の重要な出来事に意味を見出していることを発見しています。無神論者の大多数は、「出来事には理由があり、人生には出来事の結果を決定する根本的な秩序がある」という見解で運命を信じていると答えました。意味は基本的な人間のニーズです。多くの研究が示すように、それを見出す能力は健康で弾力のある心の指標です。例えば、9/11の攻撃の生存者の中で、その悲劇に意味を見出した人々は、心的外傷後ストレス反応に苦しむ可能性が低いことが分かっています。 しかし、このような考え方が心理的に有益である一方で、科学的な世界観とは相容れない部分があります。科学は人生の目的についての「なぜ」という問いには答えません。因果関係や確率に焦点を当てた「どうやって」という問いに留まります。山の側面に積もった雪が滑り落ちて雪崩を引き起こすかもしれませんし、そうでないかもしれません。それが起こるまで、あるいは起こらないまで、どちらに転ぶかは分かりません。それは神や運命、その他の何かによってあらかじめ決められているわけではありません。「運命づけられている」わけでもなく、意味もありません。「もしかしたら」という考えは、アインシュタインに反して、神が宇宙でサイコロを振っていることを示唆しています。したがって、確率的な思考と神の秩序に関する思考は緊張関係にあります。油と水のように、偶然と運命は混ざり合いません。そして、私たちの思考が運命の方向に向かうことを許す限り、確率的に考える能力を損なうことになります。ほとんどの人は運命を好む傾向があります。 心理学者のローラ・クレイと他の同僚たちと共に、反事実的思考の効果をテストしました。反事実的思考とは、何かが実際とは異なる結果になったかもしれないと考えることです。ある実験では、ノースウェスタン大学の学生たちが、なぜノースウェスタンに進学することを選んだのかを説明する短いエッセイを書きました。その半数には「物事がどのように異なって展開する可能性があったか」をリストアップするように求めました。最後に、全員が次の三つの文にどれだけ強く同意するかを評価しました。「ノースウェスタンに来るという私の決断は私を定義する」、「ノースウェスタンに来ることは私の人生に意味を加えた」、「ノースウェスタンに来るという私の決断は私の人生で最も重要な選択の一つだった。」予想通り、反事実的思考に取り組んだ学生たちは、ノースウェスタンに来るという決断により多くの意味を見出しました。第二の実験では、参加者に親しい友人を思い浮かべるように求めました。 再び、物事が異なっていた場合を想像することは、人々にその関係により深い意義を与えることになりました。第三の実験では、参加者に人生の転機を特定するよう求めました。半数には、ただ事実を説明するように求められました:何が起こったのか、いつ起こったのか、誰が関与していたのか、何を考え、何を感じていたのか。もう半数には、その転機が起こらなかった場合、今の自分の人生がどうなっていたかを説明するように求められました。すべての参加者は、その転機が「運命の産物」である度合いを評価しました。予想通り、人生の別の道を考えた人々は、選んだ道が運命であったと見なしました。あなたの人生の愛を思い浮かべてみてください。そして、二人が出会うために必要だった無数の出来事を考えてみてください。もしその夜、パーティーに行かずに勉強していたら。あるいは、配偶者がもう少し早く歩いて、その電車を逃さなかったら。あるいは、その週末に友人の誘いを受けて旅行に出かけていたら。もしも、という思考は果てしなく広がります。一度は、あなたたちが出会うことはほとんどあり得ないことでした。それでも、出会ったのです。それについてどう思いますか?ほとんどの人は「わあ、運が良かった!」とは考えません。むしろ、起こる可能性が非常に低かったことと、実際に起こったことを、運命だった証拠と受け取ります。宇宙規模でも、驚くほど似たようなことが起こります。ビッグバンを考えてみてください。これは宇宙の起源に関する支配的な科学的説明です。ビッグバン理論は、星や惑星、生命が生まれるためには自然の法則がどれほど精密に調整されている必要があるかを教えてくれます。ほんのわずかな偏差でも、私たちは存在しなかったでしょう。ほとんどの人は、その観察に対して「わあ、運が良かった!」と言ったり、数十億のビッグバンが数十億の平行宇宙を生み出し、その中のいくつかが偶然にも生命に適したものであったのかどうかを考えたりはしません。そう考える物理学者もいますが、ほとんどの人は何か、もしかしたら神がその背後にいるのではないかと疑っています。それは運命だったのです。このような考え方が自然であるとしても、問題があります。複雑な推論の連鎖を直線に並べると、次のようになります。「私が人生の愛に出会う確率は非常に低かった。しかし、それは起こった。だから運命だった。したがって、それが起こる確率は100%だった。」これは非常に疑わしいです。論理的にも一貫性がありません。論理と心理論は緊張関係にあります。確率的な思考をする人は、「なぜ?」という問いに気を取られることなく、「どうやって?」に焦点を当てます。これは単なる意味論の問題ではありません。「なぜ?」は私たちを形而上学に導き、「どうやって?」は物理学に留まります。確率的な思考をする人は、「はい、その夜にパートナーに出会うのは非常にあり得ないことでしたが、私はどこかにいる必要があり、彼女もどこかにいる必要があり、幸運なことに私たちのいる場所が一致したのです」と言うでしょう。経済学者でノーベル賞受賞者のロバート・シラーは、ヘンリー・フォードが当時驚くほど高い日給5ドルで労働者を雇うことを決定した話を語ります。この決定は、彼の二人の祖父をデトロイトに移住させ、フォードで働くことを納得させました。もし誰かがそのことを考えていたら、 彼の祖父の一人がより良い仕事のオファーを受けていたら、あるいは彼の祖父の一人が馬に頭を蹴られていたら、フォードが1日5ドルを支払うのは狂気だと誰かに納得させられていたら…もし無限に近い数の出来事が異なる結果を迎えていたら、ロバート・シラーは生まれていなかったでしょう。しかし、シラーは自らの存在が運命によるものだとは考えず、未来がいかに根本的に不確定であるかを示すためにこの話を繰り返します。「人々は歴史が論理的に展開したと信じがちで、予見すべきだったと思うが、実際はそうではない」と彼は私に語りました。「それは後知恵の幻想です。」 悲劇に直面しても、確率的思考を持つ人は「はい、出来事が取ることのできた道はほぼ無限にあり、私の子供の死に至る道を辿ることは非常にあり得ないことでした。しかし、出来事はある道を選ばなければならず、それが選ばれた道です。それが全てです」と言うでしょう。 カーネマンの言葉を借りれば、確率的思考を持つ人々は、自己のアイデンティティを定義するような出来事に対しても外部の視点を持ち、かつて可能だった世界の分布からの準ランダムな抽選としてそれらを捉えます。あるいは、カート・ヴォネガットの言葉を借りれば、「なぜ私なのか?なぜ私でないのか?」 確率的思考が正確な予測に不可欠であり、「運命だった」という考え方が確率的思考を損なうのであれば、スーパーフォアキャスターたちは運命を感じることに対してはるかに消極的であると予想されます。これを検証するために、私たちは「運命を信じる」発言に対する彼らの反応を探りました。例えば、「出来事は神の計画に従って展開する」「すべてには理由がある」「偶然や偶発的な出来事は存在しない」といったものです。また、「確率を信じる」発言についても尋ねました。「何も避けられない」「第二次世界大戦や9/11のような大きな出来事も非常に異なる結果になり得た」「ランダム性は私たちの個人生活においてしばしば要因となる」といった内容です。 私たちは、ペンシルベニア大学の学部生や一般のボランティア予測者、幅広い成人アメリカ人のサンプルにも同じ質問をしました。9段階の「運命スコア」で、1が「運命だった」という考え方を完全に否定し、9がそれを完全に受け入れるものであるとした場合、成人アメリカ人の平均スコアはスケールの中間に位置しました。ペンの学部生は少し低めで、通常の予測者はさらに少し低く、スーパーフォアキャスターは最も低いスコアを記録し、運命を否定する側にしっかりと位置していました。スーパーフォアキャスターと通常の予測者の両方について、個々の運命スコアとブライヤースコアを比較したところ、重要な相関関係が見られました。つまり、「運命だった」という考え方に傾くほど、予測の正確性は低下することが分かりました。逆に言えば、確率的思考を受け入れるほど、予測の正確性は高まるのです。したがって、出来事に意味を見出すことは幸福感と正の相関関係がありますが、先見の明とは負の相関関係にあります。これは憂鬱な可能性を示唆します:正確さの代償は苦しみなのでしょうか?私には分かりません。しかし、この本は幸福になる方法についてのものではありません。 これは、正確性を追求する方法についての話です。スーパーフォアキャスターたちは、確率的思考がそのために不可欠であることを示しています。存在論的な問題については他の人に任せますが、スーパーフォアキャスティングは単なる型にはまった方法ではありません。しかし、スーパーフォアキャスターたちは、私たちが誰でも実践できるような大まかな方法で質問に取り組むことがよくあります。それは、質問を構成要素に分解し、既知と未知をできる限り明確に区別し、仮定を疑うことを怠らないというものです。外部の視点を採用し、問題を比較の視点から捉え、その独自性を軽視し、より広い現象の特別なケースとして扱います。そして、問題の独自性を強調する内部の視点を採用します。また、自分の見解と他者の見解との類似点や相違点を探り、特に予測市場や群衆からの知恵を引き出す他の方法に注意を払います。これらの異なる視点を、トンボのように鋭い単一のビジョンに統合します。最後に、自分の判断をできるだけ正確に、細かい確率のスケールを使って表現します。このプロセスは、うまく行えば、聞こえるほど要求が厳しく、時間と精神的エネルギーを多く消費します。それでも、これは文字通り始まりに過ぎません。予測は、宝くじのチケットのように購入してしまい込むものではありません。予測は、利用可能な情報に基づく判断であり、変化する情報に応じて更新されるべきものです。新しい世論調査で候補者が快適なリードを得ていることが示された場合、その候補者が勝つ確率を上げるべきです。競合他社が予期せず破産を宣言した場合、予想される売上をそれに応じて修正します。IARPAトーナメントも同様でした。ビル・フラックがすべての難しい初期作業を終え、ヤーセル・アラファトの遺体からポロニウムが検出される確率が60%であると結論づけた後、彼は理由があれば何度でも予測を上げたり下げたりすることができました。彼はニュースを注意深く追い、良い理由があると判断したときには予測を更新しました。これは明らかに重要です。最新の利用可能な情報を反映するように更新された予測は、そうでない予測よりも真実に近い可能性が高いです。デビン・ダフィーは素晴らしい更新者です。彼はまた、失業中にグッド・ジャッジメント・プロジェクトにボランティアとして参加したという特異な経歴を持つスーパーフォアキャスターでもあります。彼は36歳のとき、働いていた工場が閉鎖されたために職を失いました。ピッツバーグ出身の彼は、現在州政府の収入維持ケースワーカーとして働いています。「私の最も役立つ才能は、特に選択肢のあるテストでうまくやる能力です」とデビンはメールで私に語りました。「これにより、実際よりも賢く見えることが多く、時には自分自身にもそう思わせてしまいます。」言うまでもなく、デビンは鋭いユーモアのセンスを持っています。多くのスーパーフォアキャスターと同様に、デビンはGoogleアラートを使って動向を注意深く追っています。 彼がシリアの難民について予測を立てる場合、まず最初に行うのは「シリアの難民」と「UNHCR」に関するアラートを設定することです。これにより、シリアの難民とその数を監視する国連機関に言及したニュースをすべてキャッチすることができます。デビンは、状況が急速に変わる可能性があると考えた場合、例えばタイでの軍事クーデターのリスクがある場合には、アラートを毎日報告するように設定します。それ以外の場合は、週に一度の報告にします。デビンはアラートが届くとすぐにそれを読み、未来に対する意味を考え、新しい情報を反映させるように予測を更新します。第3シーズンだけで、デビンは140の質問に対して2,271の予測を立てました。これは、各質問に対して平均16回以上の予測を行ったことになります。「これまでの私のGJPの成功は、運と頻繁な更新のおかげだと思います」とデビンは書いています。 デビンは特別な存在ではありません。スーパーフォアキャスターは、通常のフォアキャスターよりも平均してはるかに頻繁に更新を行います。これは明らかに重要です。更新された予測は、より良い情報に基づいた予測であり、したがってより正確な予測である可能性が高いのです。「事実が変われば、私は考えを変える」と伝説的なイギリスの経済学者ジョン・メイナード・ケインズは宣言しました。「あなたはどうしますか、紳士?」スーパーフォアキャスターも同様に行動し、それが彼らが特別である大きな理由の一つです。しかし、これには疑念が生じます。もしかしたら、初期の予測にかける慎重な認知労働や詳細な判断が、スーパーフォアキャスターの成功を説明しているわけではないのかもしれません。彼らの予測が優れているのは、単にニュースを見て更新する時間を多く費やしているからかもしれません。私はかつて、有名な政治学者に、主要企業に政治予測を提供する利益のあるコンサルタント業を運営している彼に、IARPAトーナメントに挑戦してみたいかと尋ねました。彼は興味を示しましたが、トーナメントが更新を必要とすることを知ると興味を失いました。「失業中のニュース中毒者と競争するつもりはない」と彼は言いました。私は彼の態度が好きではありませんでしたが、彼の言いたいことは理解しました。スーパーフォアキャスターはニュースを注意深く監視し、それを予測に反映させるため、注意を払わない人々に対して大きなアドバンテージを持つことは間違いありません。それが決定的な要因であるなら、スーパーフォアキャスターの成功は「注意を払い、予測を最新の状態に保つことが重要だ」ということを示すだけであり、候補者が快適なリードを得ているときに勝つ可能性が高いと言われるのと同じくらいの啓発に過ぎません。しかし、それが全てではありません。一つには、スーパーフォアキャスターの初期の予測は、通常のフォアキャスターよりも少なくとも50%は正確でした。たとえトーナメントが一つの予測だけを求め、更新を許可しなかったとしても、スーパーフォアキャスターは決定的に勝利していたでしょう。さらに重要なのは、信念の更新を軽視することは大きな間違いです。これは、CNNに流れているものに反応して無思考に予測を調整することではありません。良い更新には、初期の予測を立てる際に使われるのと同じスキルが必要であり、しばしば同じくらい要求されます。場合によっては、さらに挑戦的であることもあります。 オーバー・アンダー 「アメリカの皆さん、今夜は、アメリカ合衆国が友人や同盟国と共に、ISILとして知られるテロリストグループを弱体化させ、最終的には壊滅させるために何をするかについてお話ししたいと思います」と、オバマ大統領は2014年9月10日の夜に生中継された演説の冒頭で述べました。「私たちは、どこにいても私たちの国を脅かすテロリストを追い詰めることを明言しています。それは、シリアだけでなくイラクにおいてもISILに対して行動をためらわないということを意味します。」 スーパーフォアキャスターたちは注目しました。2014年12月1日までに外国軍がシリアで作戦を実施するかどうかは、トーナメントにおける重要な問題でした。この発表により、その可能性はほぼ確実なものとなりました。続いて多くの更新が行われました。候補者への支持が急増しているという新しい世論調査のように、オバマ大統領の発表は明らかに更新を必要としました。そして、その更新が何であるべきか、つまりほぼ確実性に向けての引き上げが明白でした。しかし、このような出来事とそれに対する反応は誰にでも明らかであり、誰もが知っていることを把握するだけでは優れた予測を生み出すことはできません。違いを生むのは、より微妙な情報を正しく特定し、それに応じて反応することで、他の人よりも早く最終的な結果に近づくことです。 ビル・フラックがアラファトとポロニウムに関する最初の予測を行った後、スイスの研究チームは、さらなる(具体的には明示されていない)テストが必要なため、結果の発表が遅れると発表しました。それはどういう意味だったのでしょうか?無関係かもしれません。もしかしたら、技術者が誕生日を盛大に祝ってしまい、翌日仕事を休んだのかもしれません。真相を知る方法はありませんでした。しかし、その時点でビルはポロニウムについて多くのことを知っており、それが体内に導入されることで見つかることもあれば、自然に存在する鉛が崩壊することで体内で生成されることもあるという事実を理解していました。真の源を特定するために、分析者はすべてのポロニウムを取り除き、鉛が存在する場合はそれがポロニウムに崩壊するのを十分に待ってから再テストを行います。スイスチームの遅延は、ポロニウムを検出し、その源として鉛を除外するためのテストを行っていることを示唆していました。しかし、それは一つの可能性に過ぎないため、ビルは慎重に予測を65%の「はい」に引き上げました。これが賢い更新です。ビルは微妙な診断情報を見抜き、他の誰よりも早く予測を正しい方向に修正しました。実際、スイスチームはアラファトの遺体からポロニウムを発見しました。ビルのこの問題に関する最終的なブライヤースコアは0.36でした。これはあまり印象的に聞こえないかもしれませんが、ブライヤースコアは問題の難易度に関連してのみ意味を持つことを思い出してください。ほとんどの専門家はその結果に驚愕しました。取引終了時に、IARPAトーナメント内で運営されている予測市場は、「はい」の確率をわずか4.27%と見積もり、これはビルのスコアの5倍悪いブライヤースコアに相当します。この問題の難しさを考慮すると、ビルが主にポジティブなテスト結果が起こる可能性が高いと見なしていたことは、真に印象的な精度です。 しかし、ビルが示したように、最良の予測者でも間違いを犯すことがあります。2013年、IARPAが日本の首相、安倍晋三が靖国神社を訪れるかどうか尋ねた際、ビルはその答えが「いいえ」であると強く信じていました。靖国神社は1869年に日本の戦没者を称えるために設立され、現在では約250万人の兵士が名を連ねています。安倍のような保守派はこれを敬愛しています。しかし、名誉ある戦没者の中には、約1000人の戦争犯罪者、うち14人の「A級」犯罪者の名前も含まれています。日本の指導者による靖国神社への訪問は、中国や韓国政府を激怒させ、アメリカ政府(日本の主要な同盟国)は常に日本の首相にこのような形で関係を損なわないように促しています。これらの事実を踏まえ、ビルは安倍が訪問しないだろうと考えました。それは合理的な予測でした。しかし、安倍に近い誰かが非公式に「行く」と言ったのです。更新の時期でしょうか?ビルは、安倍が訪問することはほとんど意味がないと考え、その発言を軽視し、更新しませんでした。12月26日、安倍は靖国神社を訪れ、ビルのBrierスコアは打撃を受けました。これらの話は、もし新たに洞察に富む証拠を見つけたら、躊躇せずに舵を切るべきだということを示唆しています。 しかし、ダグ・ローチが北極海に出航したときに何が起こったかを考えてみてください。「2014年9月15日、北極の海氷の面積は2013年9月15日よりも少なくなるか?」IARPAは2014年8月20日にこの質問をしました。たった26日間の予測にもかかわらず、これは難しい判断でした。科学者たちは北極の海氷を驚くほど正確に追跡し、毎日結果を報告していますが、2014年8月中旬には氷の面積は前年とほぼ同じでした。では、9月15日には前年よりも氷が多くなるのか少なくなるのか?科学者からスーパーフォーキャスターまで、みんなが接近するだろうと同意しました。ダグは初期の予測を保留しました。彼は、前年よりも氷が少なくなるという慎重な55%の立場を取りました。2日後、ダグのチームのメンバーが海氷予測ネットワークからの報告書を発見しました。それは素晴らしいものでした。科学者たちは4つの異なる方法を用いて28の別々の予測を行い、そのうち3つを除くすべてが2014年9月に前年よりも少ない氷を予測していました。ただし、唯一の問題は、その報告書が1か月前のものであったことです。現実が日々変化し、予測がわずか28日先を見越している場合、1か月は長い時間です。それでも、ダグは「非常に説得力があった」と言いました。ダグは舵を95%の「はい」に切りました。その後数週間で、氷の減少は鈍化しました。9月15日には、前年よりも多くの氷がありました。ダグのスコアはそれによって影響を受けました。 したがって、予測者が初期の判断を下した後に直面する2つの危険があります。一つは新しい情報に十分な重みを与えないこと、つまり過小反応です。もう一つの危険は、新しい情報に過剰反応し、それを過度に重要視して予測を急激に調整することです。過小反応と過剰反応の両方が精度を低下させる可能性があります。また、極端な場合には、完全に良好な予測を台無しにすることもあります。 **過小評価** 過小評価は、さまざまな理由で発生する可能性があり、その中には平凡なものも含まれます。2014年9月22日にアメリカ空軍がシリアの標的を攻撃した後、ジョシュア・フランケルは「しまった、ここでの予測更新がうまくいかなかった」と書きました。この攻撃によって、2014年12月1日以前に外国軍がシリアに介入するかどうかの疑問が解消されたのです。フランケルの誤りは何だったのでしょうか?彼は他の誰もがそうであったように、オバマがシリアでISILに対処する意向を発表するのを見ました。しかし、彼はその後自分がすべきだったと語ったように、予測を82%から99%に引き上げませんでした。なぜなら、事態が急速に進展し、彼は「仕事に追われすぎて、状況を把握する余裕がなかった」からです。一部の更新は、古い予測を一掃するという良い管理に還元されます。しかし、ビル・フラックが日本の官僚が安倍晋三が靖国神社を訪れると言ったことに対して過小評価した理由には、より微妙な説明があります。靖国神社を訪れることの政治的コストは高くつきました。そして、安倍は保守的な支持者をなだめるために行く必要がなかったため、その利益は微々たるものでした。結論として、行かないことが合理的な決定のように見えました。しかし、ビルは安倍自身の気持ちを無視しました。安倍は保守的なナショナリストであり、以前にも靖国神社を訪れたことがありましたが、首相としては訪れていませんでした。彼は再び行きたいと思っていました。自分の誤りを振り返り、ビルは「私が本当に答えていた質問は『安倍は靖国を訪れるか?』ではなく、『もし私が日本の首相だったら、靖国を訪れるか?』だったと思う」と語りました。これは鋭い洞察です。そして、聞き覚えがあるはずです。ビルは無意識のうちに自分自身に対して「バイト・アンド・スイッチ」を行い、難しい質問の代わりに簡単な質問を置き換えてしまったことを認識しました。実際の質問から逸れたビルは、新しい情報を無視しました。なぜなら、それは彼の置き換えた質問には無関係だったからです。これは心理的バイアスに根ざした更新エラーの一例です。これらは常に見つけるのが難しいものです。しかし、特に頑固で予測を破壊する過小評価を引き起こす心理的なエラーの源があります。1941年12月7日、日本帝国海軍が真珠湾でアメリカを攻撃したとき、アメリカ人は突然第二次世界大戦に巻き込まれたことに驚いただけでなく、その攻撃がほとんど誰も想像していなかった危険を明らかにしたために驚きました:ハワイが脆弱であれば、カリフォルニアもそうであるということです。防御は急いで強化されましたが、多くの高官は、すべての準備がスパイや破壊工作者によって台無しにされるのではないかと心配しました。カリフォルニア州の司法長官であったアール・ウォーレンは、「日系アメリカ人は、全体の民間防衛努力のアキレス腱である可能性がある」と警告しました。その後、ウォーレンは州知事となり、アメリカ合衆国最高裁判所の長官となり、学校の人種統合や市民権のリベラルな擁護者として今日も記憶されています。しかし、第二次世界大戦中、ウォーレンが最も気にかけていたのは市民権ではなく、安全保障でした。 彼の考える脅威への解決策は、日本人の血を引くすべての男女と子供を集めて収容することでした。この計画は1942年の2月中旬から8月にかけて実行され、112,000人が隔離されたキャンプに送られました。彼らのうちの約三分の二はアメリカで生まれた人々でした。彼らは有刺鉄線と武装した警備員に囲まれたキャンプに送られました。収容所設置前の10週間、また1942年の残りの期間、さらには1943年においても、破壊活動は一切ありませんでした。収容を支持する一部の人々は、この証拠と日本軍が受けた大きな打撃を根拠に、政策を緩和すべきだと感じていました。しかし、ウォーレンや他の強硬派たちはそうは考えませんでした。彼らは、危険は現実であり、減少していないと主張しました。 これは心理学者が「信念の持続」と呼ぶ極端な例です。人々は驚くほど頑固であり、確立された信念を揺るがす新しい情報を認めないために、狂ったように合理化することができます。1942年のジョン・デウィット将軍の主張を考えてみてください。彼は日本人アメリカ人の収容を強く支持していました。「これまでに破壊活動が行われていないという事実は、今後そのような行動が取られることを示す不安であり、確認する指標です。」つまり、もっと率直に言えば、「私が予想したことが起こらなかったという事実は、それが起こることを証明しています。」幸いなことに、こうした極端な頑固さは稀です。一般的には、無視できない事実に直面したとき、私たちはしぶしぶ動きますが、その変化の程度は本来あるべきよりも少なくなることが多いです。第2章で見たように、脳は物事を整然と保つことを好み、一度その状態になると、混乱を最小限に抑えようとします。しかし、すべての混乱が同じではありません。事実が変わったときに考えを変えることについてのケインズの引用を思い出してください。それは私が書いた本や共著者の本を含む無数の書籍で引用されています。グーグルで検索すれば、インターネット上に広がっているのがわかります。ケインズが言った多くの有名なことの中で、おそらく最も有名なものです。しかし、この本の研究をしている間、私はその出典を追跡しようとしましたが、失敗しました。その代わりに、ウォール・ストリート・ジャーナルのブロガーによる投稿を見つけました。それによれば、誰もその出典を発見したことはなく、ケインズに関する二人の主要な専門家はそれが偽書だと考えているそうです。これらの事実を踏まえ、ケインズが実際には言わなかったことを考慮して、私は自分が間違っていたと結論づけました。そして、私は今や世界に告白しました。それは難しかったですか?いいえ、そうではありません。多くの賢い人々が同じ間違いを犯したので、それを認めることは恥ずかしいことではありませんでした。その引用は私の仕事の中心ではなく、それについて正しいことが私のアイデンティティの一部でもありませんでした。しかし、もし私がその引用にキャリアをかけていたなら、私の反応はもっと軽率ではなかったかもしれません。社会心理学者たちは、他人に信念を公に表明させることが、その信念を固定化し、変化に対して抵抗力を持たせる素晴らしい方法であることを長い間知っています。コミットメントが強ければ強いほど、抵抗も大きくなります。 ジャン=ピエール・ビュゴムは、意見を変える意欲を誇りに思うスーパー予測者です。 「他のチームメイトよりもずっと早く答えられる」と彼は言ったが、「それでも挑戦だと認めざるを得ない。特に、自分が特に関心を持っている質問の場合は」とも付け加えた。ビュゴムスにとって、それは軍事に関する質問を意味する。彼はウェストポイントに通い、現在はアメリカの軍事史に関する博士論文を書いている。「軍事に関する質問では、他の人よりも良い答えを出すべきだと感じている。だから、自分が間違っていると気づいたときは、自己批判する前に数日間はその事実を受け入れられないことがある。」 コミットメントはさまざまな形で現れるが、子供のゲーム「ジェンガ」を思い浮かべると理解しやすい。ジェンガは、積み木を一つずつ積み上げて小さな塔を作るゲームだ。プレイヤーは交代で積み木を取り除き、誰かが塔を倒すブロックを取り除くまで続ける。私たちの自己や世界に対する信念は、ジェンガのように互いに支え合っている。ケインズが「事実が変わったら、私は考えを変える」と言ったという信念は、塔の頂点にあるブロックのようなもので、他のブロックを支えていないため、簡単に取り外しても他のブロックには影響を与えない。しかし、ジャン=ピエールが専門分野で予測を行うとき、そのブロックは構造の下の方にあり、自己認識のブロックの近く、塔の中心に位置している。したがって、そのブロックを取り出すのは他のブロックに影響を与えずに行うのが難しく、ジャン=ピエールはそれに手を加えることに躊躇する。 イェール大学のダン・カハン教授は、リスクに関する私たちの判断が、証拠を慎重に評価することよりも、私たちのアイデンティティによって左右されることを示す多くの研究を行っている。たとえば、「銃規制は私たちを安全にするのか、それとも危険にさらすのか?」という問いに対する人々の見解は、銃規制に関する意見が気候変動に関する意見と相関することが多いのはそのためだ。これらの問題には論理的な関連性はないにもかかわらず、心理的な論理が論理を上回るのだ。そして、カハンが銃規制がリスクを増加させる、または減少させると強く感じている人々に、彼らが間違っていることを示す決定的な証拠を想像するように求め、その証拠が手渡された場合に立場を変えるかどうかを尋ねると、通常は「いいえ」と答える。信念のブロックは他の多くのブロックを支えているため、それを取り除くと混乱が生じるリスクがあるため、多くの人々はそれを想像することすら拒む。 塔の最下部にあるブロックを取り除くことは、すべてを崩壊させることなく行うことはできない。このような極端なコミットメントは、誤りを認めることへの極端な躊躇につながり、112,000人の無実の人々を投獄した責任を負う人々が、なぜサボタージュの脅威が深刻であると固く信じ続けることができたのかを説明している。彼らのコミットメントは非常に大きかった。ウォーレンは、心の奥底では市民的自由の擁護者だった。彼が112,000人を不当に投獄したことを自覚することは、彼の精神的な塔にハンマーを打ち込むようなものだった。このことは、スーパーフォーキャスターたちが意外な利点を持っている可能性を示唆している。彼らは専門家やプロではないため、各予測に対するエゴがほとんどない。例外的な状況を除いて—たとえば、ジャン=ピエール・ビュゴムスが軍事に関する質問に答えるときなど—彼らは深くコミットしていない。 彼らの判断に対する柔軟性があるため、予測が外れたときにそれを認めて調整するのが容易になります。これは、スーパーフォアキャスターが全くエゴを持たないというわけではありません。彼らはチームメイトの間での評判を気にしていますし、「スーパーフォアキャスター」が自己概念の一部になると、そのコミットメントは急速に高まります。しかし、それでも自己評価のリスクは、キャリアを持つCIAのアナリストや評判をかけた著名な評論家に比べると遥かに低いのです。このことが、新しい証拠が信念の更新を求めるときに、彼らが過小評価を避けるのに役立っています。 想像してみてください。あなたは奇妙な学部心理学の実験の被験者です。研究者があなたに誰かについての情報を少し読んでもらいます。「ロバートは学生です。彼は毎週約31時間勉強しています。」次に、ロバートの成績平均を予測するように求められます。情報はあまりありませんが、良い学生のステレオタイプに合っています。だから、あなたは彼のGPAがかなり高いと推測します。次にこちらを試してみてください:デイビッドは、暴力的なサディズム・マゾヒズムの幻想に性的に興奮する心理療法の患者です。質問:デイビッドが子供を虐待する可能性はどのくらいですか?再び、情報はほとんどありませんが、持っている情報は子供を虐待する者のステレオタイプに合っています。だから、あなたは彼がそうである可能性が高いと言います。 さて、もしロバートについてもっと多くの事実を教えたらどうでしょうか。彼が月に3、4回テニスをすることや、最も長い恋愛関係が2ヶ月続いたことを伝えたら?あなたはロバートのGPAの推定を変えますか?そして、デイビッドについてのさらなる情報:彼はジョークを言うのが好きで、かつてスキー中に背中を怪我したことがあります。今、彼が子供を虐待する可能性は高くなったのでしょうか、低くなったのでしょうか?あなたは「その追加情報は無関係だ。無視するだろう」と考えているかもしれません。そして、それは良いことです。その情報は完全に無関係であることが慎重に選ばれていました。それでも、この種の無関係な情報は私たちに影響を与えます。1989年、心理学者リチャード・ニスベットの研究を基に、私は無作為に選ばれた参加者に最低限の事実か、その情報に加えて無関係な事実を与え、ロバートのGPAやデイビッドの子供虐待の傾向を推定させる実験を行いました。予想通り、無関係な情報を得た人々は自信を失いました。なぜでしょうか?良い学生や子供を虐待する者のステレオタイプに合った証拠だけをもとに判断すると、信号は強く明確に感じられ、その判断が反映されます。しかし、無関係な情報を加えると、ロバートやデイビッドをステレオタイプよりも人間として見るようになり、フィット感が弱まります。心理学者はこれを希釈効果と呼び、ステレオタイプ自体がバイアスの源であることを考えると、彼らを希釈することは良いことだと言えるかもしれません。はい、そしていいえ。はい、火に火をもって対抗し、バイアスにバイアスで対抗することは可能ですが、希釈効果は依然としてバイアスです。ここで何が起こっているかを思い出してください。人々は、自分が有用だと思う情報の断片に基づいて推定を行います。そして、明らかに無関係な情報—意味のない雑音—に出くわしますが、彼らはそれを無視すべきです。しかし、無視しないのです。 彼らは風に揺れ、次の無関係な情報の突風に翻弄されています。このような揺れは過剰反応であり、一般的で高くつく間違いです。株式市場の典型的な一日を見てみましょう。取引のボリュームとボラティリティは驚異的です。その理由は複雑で、多くの研究や議論の対象となっていますが、少なくとも一部はトレーダーが新しい情報に過剰反応していることに起因しているようです。ジョン・メイナード・ケインズも、彼が有名な言葉を口にしたかどうかは別として、変化する事実に照らして人々に考えを変えるよう促していました。「既存の投資の利益の一日ごとの変動は、明らかに一時的で重要性のない性質のものであり、市場に対して全く過剰で、さらには不合理な影響を及ぼす傾向がある」と彼は感じていました。 プリンストン大学の経済学者バートン・マルキールは、「多くの投資家は、ジン・ラミーのゲームでカードを選んだり捨てたりするかのように、株から株、またはミューチュアルファンドからミューチュアルファンドへと移動します」と観察しました。そして、彼らは代償を払っています。多くの研究によると、頻繁に取引を行う人々は、古典的なバイ・アンド・ホールド戦略を好む人々よりも悪いリターンを得ることがわかっています。マルキールは、1990年代に市場が年率17.9%のリターンを記録した5年間にわたる66,000世帯のアメリカの家庭を対象にした研究を引用しました。その結果、最も取引を行った家庭は年率わずか11.4%のリターンしか得られませんでした。多大な時間と労力がその取引に費やされたにもかかわらず、取引を行った人々はゴルフに行っていた方が良かったでしょう。過少反応と同様に、重要なのはコミットメントです。この場合、コミットメントの欠如です。常に売買を繰り返すトレーダーは、自分の株に対して認知的にも感情的にもつながりを持っていません。彼らは株が下がることを予期し、そうした「負け」を肩をすくめて売り払います。マルキールの比喩は的を射ています。彼らはジン・ラミーのプレイヤーが手元のカードに対して持つコミットメントと同じくらい、これらの株に対してコミットしていません。そのため、彼らは「明らかに一時的で重要性のない性質の情報」に過剰反応する自由があります。 スーパーフォーキャスターたちが予測に対して控えめなコミットメントを持っていることを考えると、ダグ・ローチと彼のチームが1か月前の報告書に基づいて55%から95%に揺れ動くような過剰反応が、過少反応よりも大きなリスクであると予想されます。それでも、スーパーフォーキャスターたちはしばしば両方の誤りを避けることができます。そうでなければ、彼らはスーパーフォーキャスターではありません。では、彼らはどうやってそれを実現しているのでしょうか?19世紀には、散文がギリシャ神話の賢者の言葉なしには完結しなかった時代、二つの対立する危険についての議論は、スキュラとカリブディスを引き合いに出す必要がありました。スキュラはイタリアの海岸にある岩礁で、カリブディスはシチリアの海岸にある渦潮でした。船乗りたちは、どちらの方向にも逸れすぎれば運命を共にすることを知っていました。予測者も、新しい情報に対する過少反応と過剰反応について同じように感じるべきです。予測のスキュラとカリブディスです。良い更新は、中間の航路を見つけることに関わっています。 キャプテン・ミント IARPAトーナメントの第3シーズンで、ティム・ミントは最終的なブライヤースコア0.15でトップの座を獲得しました。これは驚くべき成果で、ケン・ジェニングスが「ジェパディ!」で74連勝したのに匹敵するほどです。45歳のバンクーバー出身のソフトウェアエンジニアがここまで成功した大きな理由は、彼の更新スキルにあります。ティムは初期の予測にかける時間が、他のトップ予測者よりも短いのです。「通常、5分から15分ほどかけます。新しい6、7問の質問が出ると、合計で1時間程度になることもあります」と彼は言います。しかし翌日、彼は再び見直しを行い、第二の意見を形成します。また、インターネットで反対の証拠を探し回ります。そして、これを週5日行っています。こうした探求が彼の考えを頻繁に変えさせるのです。「私は常に更新しています」と彼は言います。「それが私の思考の仕組みです。ただし、通常はトーナメントの質問ではなく、実際の仕事に適用されることが多いです。」 質問が締め切られる頃には、ティムは通常、12回の予測を行っています。時にはその数が40回や50回に達することもあります。ある質問—アメリカとアフガニスタンがアメリカ軍の継続的な駐留に関して合意に達するかどうか—では、彼は77回の予測を行いました。キャプテン・ミントが過剰反応のカリブディスに向かって航行しているように見えるかもしれませんが、彼の常時のコース修正の大きさについてはまだ触れていません。ほとんどの場合、それらは小さな修正です。そして、それが大きな違いを生み出します。シリア内戦が激化し、多くの市民が避難を余儀なくされる中、IARPAトーナメントは予測者に「2014年4月1日時点で国連難民高等弁務官事務所が報告した登録シリア難民の数」が260万人未満になるかどうかを尋ねました。この質問は2014年1月の第一週に出されたため、予測者は3か月先を見越さなければなりませんでした。結果は「はい」でした。以下は、ティム・ミントがその3か月間にどのように信念を更新したかを示すグラフです。 確率 0.75 0.50 1月 2月 3月 トップスーパーフォアキャスターの信念更新スタイル ティムは質問が始まったとき、非常にわずかに「はい」の側に立っていました。これは当時の状況を考えると理にかなっていました。目標数は高かったものの、シリアの状況は悪化しており、難民の数は日々増加していました。グラフはその後の展開を物語っています:ティムは34回予測を変更しました。彼の新しい予測の中には正しい答えから遠ざかるものもありましたが、全体的には正しい方向に進んでいました。ティムの最終的なブライヤースコアは印象的な0.07でした。そして、ティムの変更がいかに小さいかに注目してください。30ポイントや40ポイントの劇的な変動はありません。平均的な更新はわずか3.5%でした。これは非常に重要です。いくつかの小さな更新があれば、ティムは過小反応の方向に進んでいたかもしれません。多くの大きな更新があれば、過剰反応に傾いていた可能性があります。しかし、多くの小さな更新によって、ティムは安全にスキュラとカリブディスの間をすり抜けることができたのです。 小さな変化、つまり「疑念の単位」を考えるのは奇妙に思えるかもしれませんが、ティムのように細かく考えると自然にできることです。例えば、2014年9月初めに、著名な世論調査集計者ネイト・シルバーが中間選挙で共和党が上院を勝つ確率を60%と示したとします。それを信じて、あなたは最初の予測を60%に設定します。翌日、新しい世論調査が発表され、コロラド州の上院選挙で共和党の支持率が45%から55%に上昇したことを知ります。このニュースはあなたの予測をどれだけ引き上げるべきでしょうか?ゼロ以上であることは確かです。しかし、他にどれだけの選挙が共和党に有利に傾く必要があるのかを考えると、コロラドでの勝利が大きな違いを生むわけではないことに気づきます。そこで、あなたは予測を最大10%引き上げるべきだと考えます。現在、予測は1%から10%の間です。共和党が勝てそうな選挙はどれくらいありますか?もし「上院の過半数を取るのに必要な数よりもずっと多い」と答えれば、その範囲の上限を示唆します。「過半数を勝つのにぎりぎり足りる」と答えれば、下限を指し示します。それらの選挙の世論調査の傾向はどうですか?コロラドでの要因は他の選挙にも関連していますか?選挙までどれくらいの時間がありますか?これまでのところ、選挙のかなり前に行われた世論調査はどれほど予測的でしたか?それぞれの答えが、あなたの予測をより絞り込む手助けをします。2%から9%の間、次に3%から7%の間、最終的に4%に落ち着き、予測を60%から64%に引き上げます。それは劇的ではありません。正直に言うと、少し退屈です。ティムは、テレビ出演やベストセラー本、企業の仕事で彼のビジョンを共有するグルになったりはしません。しかし、ティムの方法は効果的です。トーナメントデータがそれを証明しています:スーパーフォアキャスターは、他の予測者よりも頻繁に更新し、さらに小さな単位で更新します。なぜこれがうまくいくのかは不思議ではありません。新しい情報に基づいて自分の見解を調整しない予測者は、その情報の価値を捉えられません。一方、新しい情報に感銘を受けすぎて、予測を完全にそれに基づけてしまう予測者は、以前の予測を支えていた古い情報の価値を失ってしまいます。しかし、古い情報と新しい情報を慎重にバランスさせる予測者は、両方の価値を捉え、それを新しい予測に反映させます。そのための最良の方法は、頻繁に、しかし少しずつ更新することです。古い思考実験がこの考え方を示しています。ビリヤード台に背を向けて座っていると想像してください。友人がボールを台に転がし、ランダムな場所で止まります。あなたは、見ずにそのボールの位置を特定したいと思っています。どうしますか?友人が2つ目のボールを転がし、それも別のランダムな場所で止まります。あなたは「2つ目のボールは1つ目のボールの左側ですか、それとも右側ですか?」と尋ねます。友人は「左側だ」と答えます。それはほとんど取るに足らない情報ですが、無意味ではありません。それは、1つ目のボールが台の極端な左端にないことを示しています。そして、1つ目のボールが台の右側にある可能性がわずかに高くなります。 もし友人がテーブルの上で別のボールを転がし、その手順を繰り返すと、また新たな情報が得られます。友人が「左側にある」と言った場合、最初のボールがテーブルの右側にある可能性が少し高まります。このプロセスを繰り返すことで、徐々に可能性のある場所の範囲を絞り込み、真実に近づいていきますが、完全に不確実性を排除することはできません。 もしあなたが統計学の基礎を学んだことがあれば、この思考実験のバージョンがトーマス・ベイズによって考案されたことを思い出すかもしれません。ベイズは論理学を学んだ長老派の牧師で、1701年に生まれました。彼は現代の確率論の夜明けに生き、その分野に「偶然の法則に関する問題を解決するためのエッセイ」という形で貢献しました。このエッセイは、ベイズの友人であるリチャード・プライスの仕事と組み合わさり、1761年にプライスがベイズのエッセイを死後に出版し、さらに偉大なフランスの数学者ピエール=シモン・ラプラスの洞察が加わることで、最終的にベイズの定理が生まれました。定理は次のようになります: P(H|D)/P(-H|D) = P(D|H)/P(D|-H) - P(H)/P(-H) 後方オッズ = 尤度比 - 事前オッズ ベイズ的信念更新の方程式です。簡単に言うと、この定理は新しい信念が二つの要素に依存すべきだと言っています。それは、あなたの事前の信念(それを形成したすべての知識)に新しい情報の「診断的価値」を掛け合わせたものです。これは少し抽象的なので、私の同僚である政治学者で超予測者のジェイ・アルフェルダーが具体的にどのように使うかを見てみましょう。2013年、オバマ政権はチャック・ヘーゲルを国防長官に指名しましたが、物議を醸す報告が浮上し、聴聞会がうまくいかず、ヘーゲルが上院で確認されないかもしれないという憶測が広まりました。「ヘーゲルは辞退するのか?」と防衛アナリストのトム・リックスは書きました。「50-50だと思う…しかし日々減少している。要するに、上院軍事委員会が指名を全上院に送るための投票をしない限り、ヘーゲルが国防長官になる可能性は約2%ずつ減少していると思う。」これは確かな判断だったのでしょうか?「経験豊富な予測者はしばしば基準率から始める」とアルフェルダーは書いています。「第二次世界大戦後すぐに設立された国防長官のポジションでは、24人の公式な指名者のうち、上院に拒否されたのは1人だけで、辞退した者はいません。」したがって、基準率は96%です。もしアルフェルダーがチャック・ヘーゲルが指名された直後に彼が確認されるかどうか尋ねられたら、他の情報を考慮しなければ「彼が確認される確率は96%だ」と答えたでしょう。この推定は新しい情報が入る前に行われるため、「事前」と呼ばれます。しかし、その後、ヘーゲルは聴聞会を台無しにしました。明らかに、それは彼のチャンスを減少させましたが、どのくらい減少したのでしょうか? その質問に対して、ウルフェルダーは「ベイズの定理は、私たちに二つのことを推定するよう求めています。1) 指名された候補者が失敗する運命にあるとき、上院でのパフォーマンスが悪くなる可能性はどれくらいか? 2) 指名された候補者が承認される運命にあるとき、パフォーマンスが悪くなる可能性はどれくらいか?」と書きました。ウルフェルダーはその数字を持っていなかったため、リックスに対して疑いの余地を与え、彼の推定をリックスに有利に大きく傾けました。つまり、もしリックスがその数字で正当化されなければ、彼は正当化されないという暗黙の前提がありました。「議論のために、成功する運命にある候補者のうち、確認 hearings で悪い結果を出すのは5人に1人だと仮定しますが、失敗する運命にある候補者のうち、20人中19人は悪い結果を出すとします。」ウルフェルダーはその数字をベイズの公式に当てはめて計算し、彼の予測は「96パーセントから低い...83パーセントに急落しました。」したがって、ウルフェルダーはリックスの推定が大きく外れており、ハゲルが依然として非常に承認される可能性が高いと結論づけました。そして、実際に2週間後に承認されました。このことは、数学が苦手な人々に絶望をもたらすかもしれません。予測者は本当に理解し、暗記し、そして—ぞっとするような—代数の公式を使わなければならないのでしょうか?あなたに良いニュースがあります:いいえ、そんなことはありません。スーパーフォアキャスターたちは数字に強い集団です。多くの人がベイズの定理について知っており、それを使う価値があると感じれば使うことができます。しかし、彼らはその数字を明示的に計算することはめったにありません。スーパーフォアキャスターたちにとって、ベイズの定理よりも重要なのは、証拠の重みに比例して常に更新しながら真実に徐々に近づくというベイズの核心的な洞察です。ティム・ミントもその一人です。彼はベイズの定理を知っていますが、数百回の更新予測を行う際に一度もそれを使いませんでした。それでもミントはベイズ的な精神を理解しています。「私は、ベイズの定理を直感的に理解している人が多いと思います」と彼は言いました。「たとえあなたが私にそれを記憶から書き下ろすように頼んでも、たぶん失敗するでしょう。」ミントはベイズの定理を使わないベイジアンです。この逆説的な説明は、ほとんどのスーパーフォアキャスターに当てはまります。したがって、私たちには勝利の公式があります:たくさんの小さな更新です。それを行えば、予測の栄光への道を歩むことができるでしょうか?そうであれば良いのですが、そんなに単純ではありません。確かに、ティム・ミントのアプローチはしばしば驚くほどうまく機能するため、スーパーフォアキャスターの更新において一般的です。しかし、それはすべての鍵を開ける万能の鍵ではありません。時には、それがまさに間違った行動であることもあります。ダグ・ローチが北極の海氷に関する報告に過剰反応したことを思い出してください。彼が予測を95%の「はい」に引き上げた数日後、彼は最新のデータと過去12年間のデータを見ました。科学者たちの予測とデータを比較したとき、彼は予測と現実の間に大きく広がるギャップを見ました。彼は何をすべきでしょうか?ダグは「たくさんの小さな更新」のガイドラインに従って、時間が経つにつれて予測を徐々に下げることができました。あるいは、彼は新たに見直すことができました。「私が95%にいる唯一の理由は、明らかに失敗している報告なので、その報告を捨てて新しい予測を立てるべきです。」彼は後者の選択をしました。まず、彼は 55%に抑えられ、これは彼の最初の予測でした。その後、彼はそれを15%に引き下げました。その後、ダグは「多くの小さな更新」を再開しました。これは彼のいつものスタイルです。これは正しい判断でした。もしダグが95%の時に「多くの小さな更新」を続けていたら、彼の失望の最終スコアはもっと悪化していたでしょう。ジョージ・オーウェルは彼の有名なエッセイ「政治と英語の言語」で、6つの強調されたルールを結論付けました。その中には「短い言葉で済むところに長い言葉を使わないこと」や「能動態を使えるところで受動態を使わないこと」が含まれています。しかし、6つ目のルールが重要です。「これらのルールのいずれかを破る方が、明らかに野蛮なことを言うよりも早い。」 良い結果を保証するための失敗しないルールを求める気持ちは理解できます。それは、ハリネズミの評論家たちと彼らの誤った確信に対する致命的な魅力の源です。しかし、魔法の公式は存在せず、広範な原則と多くの注意事項があるだけです。スーパーフォアキャスターたちはその原則を理解していますが、それを適用するには微妙な判断が必要であることも知っています。彼らは野蛮な予測をするくらいなら、ルールを破ることを選びます。 「Perpetual Beta Failure」はメアリー・シンプソンにスーパーフォアキャスターになるきっかけを与えました。「私は2007年の金融危機の前兆を本当に完全に見逃してしまい、それが私にとってフラストレーションでした。なぜなら、私は何が間違っていたのかを理解するための背景を持っていたからです」とシンプソンは言いました。クレアモント大学院大学で経済学の博士号を取得したシンプソンは、南カリフォルニア・エジソンという公益事業の規制および財務業務を管理していましたが、2007年に半引退し、独立した金融コンサルタントとして働き始めました。その年の終わりに、経済はリセッションに突入しました。2008年の前半にはさらに悪いショックがありました。しかし、彼女の分野のほとんどの専門家と同様に、メアリーが危機の規模を実感したのは、2008年9月15日にリーマン・ブラザーズが破産を宣言してからでした。すでに手遅れでした。彼女の退職貯蓄は大きく減少しました。「私は本当に予測についてもっと考えたかった」と彼女は振り返ります。彼女が先見の明を高めたいと思ったのは、単なる経済的な自己利益だけではありませんでした。それは、彼女ができるからこそ、そうすべきだという感覚でした。「これは、‘私はこれをもっと上手くできるはずだ’と感じるようなことの一つです。」 シンプソンは「グッド・ジャッジメント・プロジェクト」のことを聞き、ボランティアとして参加しました。そして、彼女は非常に優れた予測者となり、そのスーパーフォアキャスターとしての地位がそれを証明しています。心理学者キャロル・ドウェックは、シンプソンが「成長マインドセット」を持っていると言うでしょう。ドウェックは、成長マインドセットを「自分の能力は主に努力の産物であると信じること」と定義しています。つまり、努力し学ぶ意欲があれば「成長」できるということです。一部の人々は、これはあまりにも明白で言うまでもないと思うかもしれません。しかし、ドウェックの研究が示すように、成長マインドセットは普遍的ではありません。多くの人々は、彼女が「固定マインドセット」と呼ぶ考え方を持っています。それは、私たちは自分自身であり、能力は明らかにされるものであって、創造されるものではないという信念です。 固定的なマインドセットを持つ人々は、「私は数学が苦手だ」といったことを言い、それを自分の一部として変わらない特徴だと見なします。これは深刻な結果をもたらします。自分が数学が苦手で、これからもずっとそうだと信じる人は、改善しようと努力しません。なぜなら、それは無駄だと思うからです。もし学校で数学を勉強することを強いられた場合、彼はどんな挫折も自分の限界が明らかになった証拠として受け止め、できるだけ早く時間を無駄にするのをやめるべきだと考えます。彼が持っていた改善の可能性は決して実現されることはありません。したがって、「私は数学が苦手だ」という信念は自己成就的になります。 ダクの数々の実験の一つでは、彼女は5年生に比較的簡単なパズルを与えました。子供たちはそれを楽しみました。その後、彼女は子供たちに難しいパズルを与えました。すると、ある子供たちは突然興味を失い、パズルを家に持ち帰ることを断りました。一方で、他の子供たちは簡単なパズルよりも難しいパズルをさらに楽しみました。「これらのパズルの名前を書いてもらえますか?」と一人の子供が尋ねました。「これが終わったら、母がもっと買ってくれるように。」二つのグループの子供たちの違いは「パズルを解く才能」ではありませんでした。同じくらいの能力を持つ子供たちの中でも、難しい挑戦に興味を失った子供もいれば、逆に興味を持った子供もいました。重要な要素はマインドセットでした。固定的なマインドセットを持つ子供たちは諦めましたが、成長マインドセットを持つ子供たちは努力しました。固定的なマインドセットを持つ子供たちが試みても、成長できると信じる子供たちほど経験から得られるものは少ないのです。 ある実験では、ダクはボランティアの脳をスキャンし、難しい質問に答えさせ、その後、答えが正しいか間違っているかを伝え、改善に役立つ情報を提供しました。スキャンの結果、固定的なマインドセットを持つボランティアは、自分の答えが正しいか間違っているかを伝えられたときには完全に集中していましたが、それ以外のことにはあまり関心を持っていないことがわかりました。改善に役立つ情報には興味を示しませんでした。「彼らが間違った答えを出しても、正しい答えを学ぼうとはしなかった」とダクは書いています。「成長マインドセットを持つ人だけが、自分の知識を広げることができる情報に注意を払いました。学ぶことが彼らにとっては最優先事項だったのです。」 優れた予測者になるためには、成長マインドセットが不可欠です。その最良の例は、「事実が変われば、私は考えを変える」と言ったとされるが、実際には言わなかった男です。 一貫していない一貫性 ジョン・メイナード・ケインズは、マクロ経済理論に関する業績で今日有名ですが、彼の多くの素晴らしい業績の一つは、投資家としての成功です。第一次世界大戦の終わりから第二次世界大戦の終わりまで、ケインズは自分の資金だけでなく、家族や友人、二つのイギリスの保険会社、さまざまな投資ファンド、ケンブリッジ大学のキングス・カレッジの資金も管理していました。1946年に亡くなったとき、ケインズは非常に裕福な男であり、彼が管理していた資金を持つ人々は、すべての合理的な期待を超えて繁栄していました。 どの時代においても印象的な記録ですが、これは単なる時代ではありませんでした。イギリスの経済は1920年代に停滞し、1930年代には世界全体が大恐慌に苦しみました。「ケインズが歴史上最悪の年のいくつかに投資していたことを考えると、彼のリターンは驚異的です」と、ケインズの投資に関する著書の著者であるジョン・F・ワシックは指摘しています。 ケインズは驚くほど知的でエネルギッシュであり、これが彼の成功に寄与したことは間違いありませんが、それ以上に彼は新しいアイデアを集めることを愛する貪欲な好奇心の持ち主でした。この習慣は時には彼に考えを変えさせることもありましたが、彼はそれをためらうことなく行いました。実際、彼は自らの誤りを率直に認め、新しい信念を受け入れることを誇りに思い、他者にもその姿勢を見習うよう促しました。「時には間違うことに害はない、特にすぐにそれが明らかになる場合には」と彼は1933年に書いています。 「ケインズは、状況が適切であると見なされる限り、同僚だけでなく自分自身に対しても常に矛盾する準備ができている」と、1945年の「一貫して矛盾する」経済学者のプロフィールは報告しています。「そのような立場の逆転について罪悪感を感じるどころか、彼はそれを、より柔軟でない人々に対する叱責の口実として利用します。伝説によれば、ケベックでルーズベルトと会談中、チャーチルはケインズに『あなたの見解に賛同しつつある』という電報を送りました。彼のLordshipは『それを聞いて残念です。考えを変え始めました』と返答しました。」 ケインズの投資家としての記録は決して完璧ではありませんでした。1920年には、彼の外国通貨の予測がひどく外れたため、ほぼ破産寸前に追い込まれました。しかし、彼は再び立ち直り、1920年代には自分自身と他者のために大金を稼ぎました。しかし、2008年のメアリー・シンプソンのように、ケインズも1929年の大惨事を予見することができず、再び大きな損失を被りました。しかし、彼は立ち直り、以前よりもさらに良い結果を出しました。ケインズにとって、失敗は学ぶ機会であり、誤りを特定し、新しい選択肢を見つけ、再挑戦することでした。悪い通貨の予測の後、ケインズは安全で簡単な道に退くことはありませんでした。彼は1920年代初頭に新しいアイデアを受け入れ、通常は不動産のような投資に固執する機関が多い中で、堅苦しいキングス・カレッジを株式投資に引き込むことを試みました。1929年の株式市場の崩壊に直面したとき、彼は自らの考えを厳しく見直しました。ケインズは、自身の重要な理論的前提の一つに問題があることを結論づけました。株価は常に企業の真の価値を反映するわけではないため、投資家は企業を徹底的に研究し、そのビジネス、資本、経営を理解した上で、長期的な投資に値する十分な基礎的価値があるかどうかを判断すべきだと考えました。アメリカでは、ほぼ同時期にベンジャミン・グレアムがこのアプローチを「バリュー投資」と呼び、ウォーレン・バフェットの富の礎となりました。「一貫して矛盾する」ジョン・メイナード・ケインズの唯一の一貫した信念は、彼がより良い結果を出せるということでした。失敗は彼の能力の限界を意味するものではありませんでした。 それは、彼が真剣に考え直し、再挑戦しなければならないことを意味していました。試み、失敗し、分析し、調整し、再度挑戦する:ケインズはこのプロセスを絶え間なく繰り返しました。ケインズは私たちの多くよりも高い次元で活動していましたが、そのプロセス—試み、失敗し、分析し、調整し、再度挑戦する—は、私たち全員が学ぶための基本的な方法であり、ほぼ生まれた瞬間から始まります。赤ちゃんが座ることを学ぶ様子を見てください。最初はふらふらしていて、天井の扇風機をじっくり見るために頭を後ろに傾けると…ドン!彼女は母親が置いた枕の上に戻ってしまいます。赤ちゃんが座ることを学ぶときは、いつも後ろに倒れてしまうのです。母親は赤ちゃんを背中に寝かせたり、椅子に座らせたりすることでこのドラマを省略することもできますが、赤ちゃんが倒れることで、頭をそんなに傾けてはいけないことを学ぶことを知っています。そして次に座るときには、少し安定しているでしょう。この新しいスキルを確実なものにし、習慣化するためには、赤ちゃんはまだ練習が必要ですが、最初の倒れが概念的な突破口をもたらします。このプロセスは、立ち上がること、歩くこと、スクールバスに乗ること、ビデオゲームのキャラクターを操作するために二つのジョイスティックやボタンを使いこなすことなど、子供時代に何千回も繰り返されます。大人も同じです。初めてゴルフクラブを手にする中年の会計士は、赤ちゃんが座ることを学ぶのと同じで、プロの指導を受けても、クラブで有能なゴルファーとして通用するまでには何度も失敗します。私たちは行動することで新しいスキルを学び、さらに行動することでそのスキルを向上させます。これらの基本的な事実は、最も要求の厳しいスキルにも当てはまります。現代の戦闘機は非常に複雑な飛行コンピュータですが、教室での指導だけでは資格のあるパイロットを育成するには不十分です。高度なフライトシミュレーターでの時間も、十分ではありません。パイロットには空中での時間が必要で、時間が多いほど良いのです。外科医、銀行家、ビジネスエグゼクティブも同様です。 学びの限界を示すために、偉大な哲学者であり教師であるマイケル・ポランニーは、自転車の物理学について詳細な説明を書きました。「サイクリストが守るルールはこうです。右に倒れそうになると、ハンドルを右に切ります。そうすることで、自転車の進行方向が右に曲がります。これにより、遠心力がサイクリストを左に押し、重力が右に引っ張る力を相殺します。」このように続き、最後には「単純な分析から、特定の不均衡の角度に対して、各カーブの曲率はサイクリストの進行速度の二乗に反比例することが示されます。」と締めくくられています。これ以上正確な説明を想像するのは難しいです。「しかし、これは自転車の乗り方を正確に教えているのでしょうか?」とポランニーは問いかけました。「いいえ。」 自転車の進む道の曲がり具合を、バランスの崩れ具合を速度の二乗で割った比率に応じて調整することは明らかにできませんし、仮にできたとしても、あなたは自転車から落ちてしまうでしょう。実際には、このルールの定式化では考慮されていない他の多くの要因が存在するからです。自転車に乗るために必要な知識は、言葉で完全に表現して他人に伝えることはできません。私たちは「暗黙の知識」、つまり実際に経験を通じて得られる知識が必要です。自転車に乗ることを学ぶためには、実際に自転車に乗ってみる必要があります。最初はうまくいきません。片側に倒れたり、反対側に倒れたりします。しかし、続けて練習を重ねるうちに、自然にできるようになります—ただし、どうやってバランスを保つかを説明しようとしても、あなたが経験した苦労を省いて教えることは、ポランイのようにうまくはいかないでしょう。それは明白です。同様に、予測を学ぶためには、実際に予測を試みる必要があることも明らかです。予測に関する本を読むことは、実際の経験に代わるものではありません。 しかし、すべての練習がスキルを向上させるわけではありません。練習は、情報に基づいたものである必要があります。どのような間違いに注意すべきか、そしてどのベストプラクティスが本当に最良であるかを知る必要があります。ですから、本を燃やさないでください。前述のように、ランダム化比較試験では、私たちのトレーニングガイドラインという小さな冊子の内容をマスターすることで、精度が約10%向上することが示されています。これらの実験はまた、本の知識と実践の効果がどのように相互作用するかも示しています。この冊子を読んだ人は、実践からより多くの恩恵を受け、実践した人は冊子を読むことでより多くの恩恵を受けました。運は準備された心に微笑むのです。トレーニングガイドラインは、私たちが個人的な経験から正しい教訓を引き出し、外部の視点と内部の視点の間で適切なバランスを取るのに役立ちます。そして、私たちの個人的な経験は、淡白な公共の知識の抽象概念に実世界の内容を注入するのに役立ちます。効果的な練習には、明確でタイムリーなフィードバックも必要です。私の研究協力者であるドン・ムーアは、警察官が誰が真実を語り、誰が嘘をついているのかを見極めるのに多くの時間を費やしているが、研究によれば彼らは自分が思っているほど上手ではなく、経験を重ねてもあまり上達しないことを指摘しています。それは、経験だけでは不十分だからです。明確なフィードバックが伴わなければなりません。警官が容疑者が嘘をついているかどうかを判断する際、その判断の正確性について即座にフィードバックを得ることはありません(容疑者が「その通り!私は嘘をついていました!」と言うようなことはありません)。代わりに、事態は進展します。告発が行われ、裁判が開かれ、判決が下されるか、あるいは後に有罪答弁が行われることもあります。しかし、これには数ヶ月または数年かかることがあり、解決があったとしても、さまざまな要因が影響している可能性があります。そのため、警官は自分の判断が正しかったのか、間違っていたのかを明確に示すフィードバックを得ることはほとんどありません。 予想通り、心理学者たちは、警察官が制御された環境で嘘を見抜く能力をテストした結果、彼らの自信と実際のスキルとの間に大きなギャップがあることを発見しました。このギャップは、警察官が経験を積むにつれて大きくなり、彼らは自分の経験がより優れた嘘発見器になったと、合理的に考えます。その結果、警察官は正確さが向上するよりも早く自信を深めていき、過信が増していくのです。このようなギャップは決して珍しいものではありません。信頼性の研究—自信がどれほど正確さと一致しているか—では、人々が過剰に自信を持っていることが常に見つかります。しかし、過信は人間の本性の不変の法則ではありません。気象学者は一般的に過信に悩まされることはありませんし、熟練したブリッジプレイヤーも同様です。なぜなら、両者は明確で迅速なフィードバックを受け取るからです。明日豪雨を予測した気象学者は、もし晴れた朝を迎えたら、自分の予測が外れたことを知るでしょう。ブリッジプレイヤーは、自分がどれだけの「トリック」を勝ち取るかを見積もり、各ハンドの終わりに結果を得ます。予測が外れた場合、彼らはそれを知ります。それが重要です。失敗から学ぶためには、いつ失敗したのかを知る必要があります。後ろに倒れた赤ちゃんもそうですし、自転車から転んで膝をすりむいた少年もそうです。そして、簡単なパットを砂場に入れてしまった会計士も同様です。彼らは自分の失敗を知っているからこそ、何が間違っていたのかを考え、調整し、再挑戦することができます。残念ながら、ほとんどの予測者は、気象学者やブリッジプレイヤーが改善するのに役立つ高品質のフィードバックを受け取ることができません。その主な理由は二つあります。一つは曖昧な言葉です。第3章で見たように、「おそらく」や「可能性がある」といった曖昧な表現は、予測を判断することを不可能にします。予測者が何かが起こるかもしれないと言った場合、彼女はほとんど何でも言っている可能性があります。同様のことは、スティーブ・バルマーが「重要な市場シェア」と言ったような、精密に聞こえるが詳しく見ると霧のようにぼんやりした無数の他の用語にも当てはまります。中立的な観察者でさえ、曖昧な予測から意味のあるフィードバックを引き出すのは難しいですが、しばしば判断するのは予測者自身です。これが問題をさらに悪化させます。心理学者バートラム・フォラーにちなんで名付けられたフォラー効果を考えてみましょう。彼は学生たちに性格テストを受けさせ、その結果に基づいて個々の性格プロフィールを提供し、そのテストがどれほど彼らの個性を捉えているかを尋ねました。人々はそのテストに感銘を受け、平均4.2点(5点満点中)という評価を与えました。これは驚くべきことです。なぜなら、フォラーは実際には「あなたは人に好かれ、称賛されることを強く望んでいる」というような曖昧な表現を占星術の本から取り出し、それをプロフィールにまとめ、全員に同じプロフィールを与えたからです。曖昧な言葉は弾力のある言葉です。学生たちは自分の自己イメージに合わせてそれを引き伸ばしましたが、彼らは客観的にテストを評価していると思っていました。自分の曖昧な予測を評価しようとする予測者への教訓は、「自分を欺くな」ということです。フィードバックに対する二つ目の大きな障壁は、時間の遅れです。 予測が数ヶ月や数年にわたる場合、結果を待つ間に記憶の欠陥が忍び寄ることがあります。今、あなたが未来についてどう感じているかはわかります。しかし、事が進展するにつれて、あなたは自分の予測を正確に思い出すことができるでしょうか?おそらく、できない可能性が高いです。普通の忘却に加えて、心理学者が「後知恵バイアス」と呼ぶものに悩まされる可能性もあります。もしあなたが1991年に意識を持っていたのなら、この質問に答えてみてください。当時、現職の大統領ジョージ・H・W・ブッシュ(現在はブッシュ41として知られています)が1992年に再選される可能性はどのくらい高いと思っていましたか?私たちは皆、ブッシュ41がビル・クリントンに敗れたことを知っていますが、湾岸戦争の勝利後、彼が人気だったことも思い出すかもしれません。ですから、彼の再選の可能性はかなり高いと思っていたかもしれませんが、明らかに彼には敗北する可能性も十分にありました。もしかしたら五分五分だったのでしょうか?それとも、戦争が彼に有利に働き、60%や70%の勝率があると思っていたのでしょうか?実際、あなたの判断に対する記憶は非常に間違っている可能性が高いです。そして、その間違いは予測可能な方向に偏っています。1991年の「サタデー・ナイト・ライブ」のスケッチを引き合いに出すことで、このことを示すことができます。このシーンは、1992年の民主党候補者たちの討論会です。モデレーター:こんばんは。私はリーグ・オブ・ウィメン・ヴォーターズのフェイ・サリバンです。この討論会は、現職のジョージ・ブッシュ大統領に対抗することを強いられないようにしている5人の主要な民主党員の中での最初の討論会です。彼らのほとんどはすでに指名に興味がないと発表しています。しかし、もちろん、彼らはこの非常に人気のある現職に対抗するという無駄な仕事を引き受ける「チャンプ」にならないように、巨大なプレッシャーを受けています。彼らは…ニュージャージー州のビル・ブラッドリー上院議員…ビル・ブラッドリー上院議員:私は1992年の大統領候補ではありません。モデレーター:ミズーリ州の下院多数党院内総務ディック・ゲプハート…ディック・ゲプハート下院議員:私は党の指名を求めていません。事態はますます不条理になっていきます。この討論会では、各候補者が自分の対戦相手を称賛しながら、自分自身を貶めています—なぜなら、ブッシュ41は誰に対しても圧倒的に勝つことが確実だったからです。誰もがそれを知っていました。それが、主要な民主党員がその年の指名を争わなかった理由であり、アーカンソー州の無名の知事ビル・クリントンへの道を開いたのです。何かの結果を知ると、その知識が私たちの以前の考え方を歪めます。これが後知恵バイアスです。バルーク・フィッシュホフがこの現象を最初に文書化したのは、一連の洗練された実験によるものでした。彼は人々にフィッシュホフの研究当時の主要な世界的出来事の可能性を推定させました—「ニクソンは毛沢東と個人的に会うか?」—そして、その出来事が起こったかどうかを知った後に自分の推定を思い出させました。結果を知ることは、一貫して推定を歪めました。たとえ人々がそれに影響されないようにしようとしてもです。この効果は微妙な場合もありますが、かなり大きな場合もあります。 1988年、ソビエト連邦が将来について人々に疑問を抱かせるような大規模な改革を実施していたとき、私は専門家に対して、共産党が今後5年間でソビエト連邦における権力の独占を失う可能性についての見積もりを求めました。1991年、世界はソビエト連邦の崩壊を驚愕の目で見守りました。そのため、1992年から1993年にかけて再び専門家たちに会い、1988年の質問を思い出させ、彼らの見積もりを再確認してもらいました。平均して、専門家たちは正しい数字よりも31パーセントポイント高い数字を思い出しました。つまり、10%の可能性だと考えていた専門家は、実際には40%や50%の可能性だと思い出すことが多かったのです。中には、20%と見積もった専門家が70%だと記憶していたケースもあり、これが「後知恵バイアス」が「私はずっと前から知っていた」という効果として知られる理由を示しています。あいまいな言葉を使い、古い予測を引き出すために欠陥のある記憶に頼る予測者は、明確なフィードバックを得られず、経験から学ぶことが不可能になります。彼らは、暗闇の中でフリースローを行うバスケットボール選手のようなものです。得られるフィードバックは音だけ—ボールが金属に当たる音、バックボードに当たる音、ネットに触れる音—です。明るい場所で何千回もフリースローを練習したベテラン選手は、音を得点や外れに結びつけることができます。しかし、初心者にはそれができません。「スウィッシュ!」は、ネットに入った得点か、ひどく力不足のボールかのどちらかを意味します。「ガチャン!」という大きな音は、ボールがリムに当たったことを示しますが、ボールは入ったのか出たのかは分かりません。彼らは確信を持とうとするかもしれませんが、実際にはそうではなく、何週間もボールを投げ続けることで自信を持つかもしれません—「こんなに練習したから、私はきっと上手くなっている!」—しかし、フリースローの技術は向上しません。明かりがついて初めて、彼らは明確なフィードバックを得ることができ、学び、上達することができるのです。 2014年、ティム・ミントがシリア難民の流入を予測した際、彼のブライヤースコアは0.07でした。これは明確で、正確で、意味のある素晴らしい結果で、フリースローの中でもネットに入った得点に相当します。しかし、残念なことに、安倍晋三が靖国神社を訪れるかどうかの予測は1.46というスコアで、これは体育館の奥にあるゴミ箱にボールを投げ入れるようなものでした。そしてティムはそれを理解していました。彼には隠れるためのあいまいな言葉はなく、後知恵バイアスが彼の予測がそれほど悪くないと信じ込ませることもありませんでした。ティムは失敗し、それを自覚していたため、学ぶ機会を得たのです。ところで、近道はありません。ブリッジのプレイヤーは、トリックに対する入札に関して良く調整された判断力を身につけるかもしれませんが、研究によれば、ある文脈で調整された判断力は、別の文脈にうまく移行しないことが示されています。したがって、ブリッジをプレイすることで政治やビジネスの予測者としてのスキルを向上させようと考えているなら、やめておいた方が良いでしょう。 特定の予測のスキルを向上させるためには、その予測を繰り返し行い、トレーニングの進捗を示す良いフィードバックを受け取り、そして「おっと、これは間違えたな。なぜそうなったのか考え直さなければ」と素直に思える姿勢が必要です。 **分析と調整** 「私たちはチームとして、ポロニウムの半減期が検出をほぼ不可能にするという前提に同意しました。しかし、その前提を疑うための努力が全く足りませんでした。例えば、崩壊生成物がポロニウムを検出する手段になるかどうかを考えたり、その分野の専門家に尋ねたりすることができたはずです。」これは、デビン・ダフィが、ヤーセル・アラファトの遺体がポロニウム陽性であるかどうかの質問でチームが苦戦した後に、仲間たちに投稿したメッセージです。彼が得た教訓はこうです。「専門家の前提を安易に信じないこと、専門家がいれば尋ねること、そして時々自分の前提を再検討することが大切です。」 質問が終わると、スーパーフォアキャスターたちは、自分たちがどうすればより良くなれるかを知りたがる姿勢が、どのように結果が出たかを知りたいという姿勢と同じくらい強いことが明らかです。時には、彼らは仲間と長い振り返りを共有します。これらのオンラインディスカッションは何ページにもわたることがあります。また、スーパーフォアキャスターたちは、静かな時間を持つときに自己反省を深めることが多いです。「シャワーを浴びているときや、学校や仕事への通勤中、あるいは日中の暇な瞬間に考えます」とジャン=ピエール・ボゴムは言います。トーナメントの最初の2シーズンでは、彼は古い予測を見返して、コメントがあまりにも少なくて「なぜ特定の予測をしたのか分からないことが多かった」と感じ、その思考過程を再構築できなかったため、もっと長く詳細なコメントを残すことにしました。こうすることで、自分の考えを批判的に検証する助けになると知っていたのです。実際、ボゴムはトーナメントの質問が発表された瞬間から振り返りの準備をしています。 振り返りは、初期の予測を行う際の思考と同じくらい慎重で自己批判的です。ギニアの選挙に関する質問について、彼のチームが見事に答えた際、デビンは、彼らがすべての功績を自分たちだけのものとすることはできないと強調しました。「ギニアに関しては、抗議活動が選挙を妨げることはないだろうと信じていました。しかし、実際にはほぼそうなりかけたのです!だから、運が良かったのです。」これは非常に洞察に富んでいます。人々は、決定が良い結果をもたらしたとき、その決定が良かったと考えがちですが、必ずしもそうではなく、その思考の欠陥に目を向けさせない危険性があります。 成功者は、自分の成功を完全に自分の力で得たわけではないという考えに対して、通常はあまりオープンではありません。1980年代後半の私の研究では、専門家にソビエト連邦で共産党が権力を維持するか、南アフリカでアパルトヘイトが暴力的に崩壊するか、ケベックがカナダから独立するかを予測させました。 締切が過ぎ、三つの予測の正しい答えが明らかになったとき、すなわち「いいえ、いいえ、いいえ」となった後、私は専門家たちに反事実的シナリオの妥当性を考慮するよう求めました。小さなバタフライ効果の変化が歴史を異なる方向に進ませるというシナリオです。もし1991年のゴルバチョフに対するクーデターがより良く計画され、陰謀者たちが酔っ払っておらず、より組織的であったなら、共産党は今も権力を握っていたかもしれないという「もしも」の話が示唆されると、専門家たちはその話を古い友人のように歓迎しました。しかし、彼らの正しい予測が簡単に間違っていた可能性があるというシナリオが示されると、それは推測に過ぎないと一蹴しました。専門家たちは「私はほぼ正しかった」というシナリオにはオープンでしたが、「私はほぼ間違っていた」という代替案は拒否しました。しかし、デビンは違いました。彼は勝利の喜びをもって「運が良かった」と言うことに何の問題もありませんでした。 予測と自転車の運転の類似性はかなり良いですが、すべての類似性と同様に、完全ではありません。自転車に乗る際の「試す、失敗する、分析する、調整する、再挑戦する」というサイクルは通常数秒で完了しますが、予測では数ヶ月または数年かかることがあります。さらに、予測における偶然の役割が大きいこともあります。最良のサイクリングプラクティスに従うサイクリストは通常、優れた結果を期待できますが、予測者はもっと慎重であるべきです。最良のプラクティスに従うことで勝つ確率は向上しますが、偶然の役割が小さいゲームに比べて信頼性は低くなります。成長マインドセットを持っていても、改善を望む予測者は、私の同僚であるアンジェラ・ダックワースが「グリット」と呼ぶものを多く持っている必要があります。 エリザベス・スローンは多くのグリットを持っています。脳癌と診断されたエリザベスは、化学療法、失敗した幹細胞移植、再発、そしてさらに2年間の化学療法を耐え抜きました。しかし、彼女は決してあきらめませんでした。彼女は「シナプスを再生する」ためにグッド・ジャッジメント・プロジェクトにボランティアとして参加しました。また、彼女の状況を完璧に説明するトップの腫瘍医による記事を見つけ、それが有望な新しい幹細胞移植につながりました。「そして、私は今、治癒されようとしています」と彼女はGJPプロジェクトマネージャーのテリー・マレーにメールしました。「第二のチャンスを得られるなんて素晴らしいことです。」グリットとは、挫折や失敗に直面しても長期的な目標に対する情熱的な忍耐力のことです。 アン・キルケニーが初めてGJPについて聞いたとき、彼女は自分が珍しいボランティアになるだろうと気づきました。「あなたは、これまで地政学に積極的に関与したことのない主婦を求めているのですか?実際の知的挑戦から40年も離れているのに?」と彼女は考えました。「やってみよう。」アンはアラスカの小さな町に住んでいます。彼女はヒッピー時代にカリフォルニア大学バークレー校を卒業し、高校教師になりたいと思って教職プログラムに応募しましたが、受け入れられませんでした。その後、彼女は行政助手、簿記係、代用教師として働き、社交ダンスを始め、合唱団で歌い、アラスカの大工と結婚し、息子を育て、教会に通いました。彼女はすべてのメールの最後に自分のモットーを書いています。「シンプルに生きる。」 「寛大に愛し、深く思いやり、優しく語り、あとは神に委ねなさい。」 アンは2008年に一瞬の有名人となった。共和党の大統領候補ジョン・マケインが、彼の副大統領候補にアラスカ州知事のサラ・ペイリンを指名したと発表したのだ。この選択は驚くべきもので、州外の人々の多くは小さな町ワシラの元市長の名前を聞いたことがなかった。しかし、アン・キルケニーは知っていた。ワシラは彼女の故郷であり、彼女は町の議会に出席するような珍しい公共心のある市民の一人だった。そこで、彼女はペイリンが市長として何をしたかをまとめたメールを書き、州外の家族や友人に送った。彼らはもっと知りたがったので、彼女は詳細を追加して再度送信した。そのメールは瞬く間に広がった。すぐに、アンはニューヨーク・タイムズの記者から電話を受け、次にニュースウィーク、AP通信、ボストン・グローブ、セントピーターズバーグ・タイムズなど、次々とメディアから連絡が来た。まさに熱狂の渦だった。アンは民主党員であり、彼女のメールはペイリンに対して批判的な内容が多かったため、彼女に送られてくるメールの多くは非常に党派的だった。「やっぱりそうだ!」と誰かが書いた。「ペイリンが地政学について全く無知だと、彼女の顔を見た瞬間にわかった!」そして、アンへの称賛の声も山のように寄せられた。彼女は勇敢で、素晴らしく、あらゆる面で素晴らしいと。だが、アンは冷静さを保った。称賛に浸るのではなく、彼女は懐疑的なまなざしを向けた。「どうして誰かがその人を一目見ただけで、そんなことがわかるのか?」と彼女は私に書いた。「彼らはわからなかったし、わかるはずもなかった。彼らはペイリンについて、彼女の党派的な立場や女性であることなどから、最初から自分の考えを決めていた。そして、彼女に関する事実を学ぶことで、自分の偏見を正当化する口実を得ただけだった。感情が知識や思考の仮面をかぶっていた。」このような批判的で心理的に鋭い観察力が、予測者をスーパー予測者にするのだ。また、慎重で正確なリサーチも同様だ。アンの有名なメールは、全国のファクトチェック機関による精査にも耐えた。これは特に印象的で、アン自身は単に友人や家族のために短いメモを作成しているつもりだったのだから。 アンの粘り強さは驚異的だ。トーナメントが中央アフリカ共和国の難民数について質問した際、彼女は国連のウェブサイトを訪れ、データが1週間古いことに気づいた。最新の数字だと仮定するのではなく、彼女はその機関にメールを送り、データがどのくらいの頻度で更新されるのか、次の更新がいつになるのかを尋ねた。また、データに大きな変動があることにも気づき、再度その機関に問い合わせた。返事はあったが、フランス語だった。「ありがとう」と彼女は返信し、「でも、私はフランス語があまり得意ではありません。英語でお願いできますか?」すると、英語での詳細な返答が返ってきた。それはその機関の分析手法を説明しており、非常に有益で予測を立てるのに大いに役立った。アンはまだスーパー予測者ではないが、彼女の結果は依然として印象的だ。彼女は3年目の150問すべてを予測し、彼女のチームはほとんど動かない状態だったため、ほとんどすべての作業を自分で行わなければならなかった。 彼女がそうした理由は何でしょうか?それは、大学生が最も難しいコースを選び、厳しい採点をする教授の授業を受けるのと同じ理由です。彼女は、最高の成績を取ることよりも学ぶことに重きを置いていました。「私は常に成長し、学び、変わろうとしています」と彼女は私に書きました。結果が出始めると、その姿勢は彼女の行動に表れました。彼女は結果を慎重に考え、それが彼女の意思決定にどのように影響するかを考察し、しばしばプロジェクトマネージャーに対して思慮深く内省的なメールを共有しました。彼女のBrierスコアが改善し、トップランクに入る可能性が見えてきたときも、その姿勢を崩しませんでした。そして、彼女の自信の高い予測が悪い結果に終わり、精度が急落したときも、彼女はその姿勢を続けました。質問を重ね、月ごとに取り組み続けました。それが「根気」です。だからこそ、彼女が最終的にスーパーフォアキャスターになるのを見ても全く驚かないでしょう。もちろん、それはアンの成長の終わりではなく、スーパーフォアキャスターたちが示しているように、始まりの終わりに過ぎません。常に新たな挑戦、失敗、分析、調整、そして再挑戦が待っています。コンピュータプログラマーは、最終版としてリリースされることを意図せず、代わりに使用され、分析され、無限に改善されるプログラムに対して「永続的ベータ」という素晴らしい用語を持っています。 スーパーフォアキャスターは永続的ベータです。 全体をまとめると、私たちはスーパーフォアキャスターについて多くのことを学びました。彼らの生活、テストスコア、仕事の習慣から、今や典型的なスーパーフォアキャスターの粗い肖像を描くことができます。哲学的な見解において、彼らは次のような傾向があります: - 慎重:何も確実ではない - 謙虚:現実は無限に複雑 - 非決定論的:起こることは必然ではなく、起こる必要もない 彼らの能力や思考スタイルにおいては、次のような傾向があります: - 積極的にオープンマインド:信念はテストすべき仮説であり、守るべき宝物ではない - 知的で知識が豊富、「認知の必要性」を持つ:知的好奇心が強く、パズルや精神的な挑戦を楽しむ - 反省的:内省的で自己批判的 - 数字に強い:数値に対して快適さを感じる 予測の方法においては、次のような傾向があります: - 実用的:特定のアイデアやアジェンダに固執しない - 分析的:鼻先の視点から一歩引いて他の視点を考慮できる - トンボの目を持つ:多様な視点を重視し、それらを自分のものに統合する - 確率的:多くの「かもしれない」を使って判断する - 思慮深いアップデーター:事実が変わると、考えを変える - 良い直感的心理学者:認知バイアスや感情的バイアスをチェックすることの価値を理解している 彼らの仕事に対する倫理観には、次のような傾向があります: - 成長マインドセット:向上することが可能だと信じる - 根気:どれだけ時間がかかっても続ける決意がある ここでは大まかに描いています。すべての属性が同じように重要というわけではありません。スーパーフォアキャスターのランクに上がる最も強い予測因子は、永続的ベータ、つまり信念の更新と自己改善に対するコミットメントの度合いです。 ケネディのもとで、アーサー・M・シュレジンジャー・ジュニアは、内閣の席で「アメリカの兵士が実際の戦闘に参加しなければ、あまり問題にはならないだろう」という考えが広まったことを思い出しました。 このように、予測の力は非常に強力で、知性に次ぐ最も近いライバルの約3倍の予測力を持っています。トーマス・エジソンの言葉を借りれば、スーパーフォーキャスティングはおおよそ75%の努力と25%のひらめきから成り立っているようです。しかし、すべてのスーパーフォーキャスターがすべての特性を持っているわけではありません。成功への道は多様であり、一つの分野での欠点を他の分野での強みで補う方法もたくさんあります。ただし、永続的なベータの予測力は、どんなにIQが高くても「自分のシナプスを成長させる」という個人的なプロジェクトへの献身が欠けていると補うのが難しいことを示唆しています。 とはいえ、スケッチから完全に欠けているもう一つの要素があります。それは他の人々です。私たちの私生活や職場では、未来についての判断を完全に孤立して行うことはほとんどありません。私たちは社会的な生き物であり、共に決定を下します。ここで重要な疑問が生じます。スーパーフォーキャスターがグループで働くとどうなるのでしょうか? 1961年1月10日の朝、アメリカ全土で朝食が準備される中、ニューヨーク・タイムズの読者たちはキッチンのテーブルで新聞を開き、見出しを目にしました。「米国、秘密のグアテマラ空陸基地で反カストロ部隊の訓練を支援」。グアテマラの太平洋岸から少し内陸に位置するこの基地では、「コマンドーのような部隊が、主にアメリカからの外国人によってゲリラ戦術の訓練を受けている」と報じられました。訓練生はキューバ人と特定され、基地を使用するアメリカの航空機も明記されていました。基地を建設したアメリカの会社の名前も挙げられました。「ミゲル・イディゴラス・フエンテス大統領をはじめとするグアテマラ当局は、この軍事活動がキューバからの攻撃に備えるためのものであると主張している」とタイムズは報じましたが、「イディゴラス政権の反対派は、この準備がフィデル・カストロ首相の政権に対する攻撃のためのものであり、アメリカが計画し、指導し、かなりの部分を資金提供していると主張しています。アメリカ大使館はこの件について完全に沈黙を守っています。」 実際には、CIAはキューバの亡命者を訓練し、キューバに上陸してフィデル・カストロの新政府に対してゲリラ戦を開始させる計画を進めていました。秘密は極めて重要でした。ゲリラが上陸した際には、彼らが国を解放するために来た独立した愛国者のように見える必要がありました。そのため、アメリカの兵士はゲリラと共に上陸せず、航空支援はアメリカのマーキングのない古い爆撃機によって行われることになっていました。誰もアメリカがこの全てを仕組んでいるとは知ることはありません。少なくとも、それが計画でした。ワシントンDCのこの秘密任務の計画者たちの間では、ニューヨーク・タイムズの一面でこの計画が暴露されたことが懸念を引き起こし、再考を促すだろうと考えられたかもしれません。実際には懸念はありましたが、再考はありませんでした。 ケネディの側近であったシュレシンジャーは、バイ・オブ・ピッグス侵攻の計画を承認した内輪の一員であり、彼の回想にはその計画における失敗への驚きが満ちていました。CIAに訓練されたゲリラが上陸した際、キューバ軍が待ち構えており、上陸した1400人の兵士はすぐに2万人の兵士に包囲されました。3日以内に彼らは全員が死亡するか捕虜となりました。問題は実行ではなく、計画そのものでした。それは無謀なものであり、後知恵バイアスではありません。この悲劇的な一連の出来事は詳細に分析され、歴史家たちの間で、左派も右派も含めて、ホワイトハウスが見抜くべきだったが見抜けなかった問題が山積みであったという珍しい合意が得られています。特に明白な例は、緊急時の計画でした。CIAは大統領の顧問たちに、上陸が失敗した場合、ゲリラはエスカンブレイ山脈に逃げ込むことができ、そこで他の反カストロ勢力と合流できると保証しました。しかし、そのアイデアは、ゲリラが山のふもとの海岸に上陸するという計画の最初のバージョンから来ていました。計画者たちは上陸地点を変更しましたが、その変更が緊急時の計画にどのような影響を与えるかを考慮しませんでした。「私たちは、エスカンブレイ山脈がバイ・オブ・ピッグスから80マイル離れ、手に負えない湿地やジャングルを越えた場所にあることを十分に理解していなかったと思います」とシュレシンジャーは振り返りました。 この失敗の後、アメリカが関与していないとは誰も信じなくなり、その結果は即座に厳しいものでした。伝統的な同盟国は困惑し、ラテンアメリカの国々は激怒しました。反アメリカの抗議が世界中で勃発しました。新しいケネディ政権に大きな期待を寄せていたリベラル派は裏切られたと感じ、保守派は新米大統領の無能を嘲笑しました。アメリカの戦略的利益にとって最も悪いことは、キューバ政府がソ連の陣営によりしっかりと組み込まれたことでした。18か月以内に、フロリダの海岸沖にある島は5000人のソ連兵と、ワシントンDCやニューヨーク市を破壊できる中距離核ミサイルの配備基地となり、二つの超大国はケネディが振り返ってみて、核戦争にエスカレートする可能性が3分の1から2分の1の間であったと推定する危機に直面しました。 バイ・オブ・ピッグスの惨事から続くキューバミサイル危機の物語は同様に知られていますが、類似点はそこで終わります。1962年10月の恐怖の13日間、ケネディ政権はソ連の脅威に対抗するために、全面的な侵略を含むさまざまな危険な選択肢を検討しましたが、最終的には海上封鎖に落ち着きました。ソ連の船がアメリカの赤線に近づく中、双方は互いの意図を行動や裏ルートの通信から読み取ろうとしました。最終的に合意が成立し、戦争は回避され、世界は安堵の息をつきました。 もしバイ・オブ・ピッグスがケネディ政権の最悪の瞬間であったなら、キューバ危機はその頂点であり、ケネディと彼のチームが極度のプレッシャーの中で創造的にポジティブな結果を導いた瞬間でした。これを知ると、私たちはケネディがバイ・オブ・ピッグスの後に人事を一新し、ミサイル危機に向けてはるかに優れたアドバイザーたちに囲まれたと考えるかもしれません。しかし、実際にはそうではありません。両方のドラマに登場するキャラクターはほとんど同じです。バイ・オブ・ピッグスを失敗させたチームが、キューバ危機の際には見事なパフォーマンスを発揮したのです。心理学者アーヴィング・ジャニスは、1972年の名著『グループシンクの犠牲者たち』の中で、バイ・オブ・ピッグス侵攻とキューバ危機に関する意思決定を探求しました。今日、誰もがグループシンクという言葉を聞いたことがありますが、その用語を初めて作り出した本を読んだ人は少なく、ジャニスが今日の漠然としたキャッチフレーズ以上の具体的な意味を持っていたことを知っている人はほとんどいません。ジャニスの仮説によれば、「小さな結束したグループのメンバーは、無意識のうちに多くの共有された幻想や関連する規範を発展させ、それが批判的思考や現実検証を妨げることで、団結心を維持しようとする」とされています。あまりにも仲の良いグループは、前提を疑ったり、不快な事実に直面したりしません。だからこそ、みんなが同意するのは心地よく、その同意がグループが正しい方向に進んでいる証拠だと暗黙のうちに受け取られます。「私たち全員が間違っているわけがない」と。アメリカの秘密のキューバ侵攻計画が、アメリカの関与が明らかでない形でニューヨーク・タイムズの一面に掲載された場合でも、その計画は進められるのです—ただし、ビーチにアメリカの兵士がいないことを確認し、アメリカの関与を否定すれば良いのです。世界はそれを信じるでしょう。そして、それが信じがたいように聞こえるかもしれませんが、グループ内で誰も異議を唱えなかったので、みんながそれを完全に合理的だと思っているのですから、そうに違いありません。失敗の後、ケネディは自分のスタッフがどうしてこんなにひどく失敗したのかを調査するよう命じました。その調査は、心地よい一致が主要な問題であると特定し、再発を防ぐために意思決定プロセスの変更を推奨しました。懐疑心が新たな合言葉となりました。参加者は、自分の専門分野の専門家としてだけでなく、一般的な視点を持つ者としても発言し、何でも疑問を持つ権利を持つことが求められました。特別顧問のセオドア・ソレンセンとケネディ大統領の兄ボビーは、「知的監視役」として指名され、彼らの役割は「問題の表面的な分析から生じる誤りを防ぐために、あらゆる論点を徹底的に追求すること」でしたとジャニスは述べています。「この役割を熱心に受け入れたロバート・ケネディは、時には彼の仲間の中で不人気になる代償を払って、鋭く時には失礼な質問を投げかけました。しばしば、彼は意図的に悪魔の代弁者となりました。」プロトコルや階層は、こうした自由な議論を妨げるため、これらは脇に置かれました。新しいアドバイザーが時折招かれ、新たな視点を提供しました。そして、ジョン・F・ケネディは時には 部屋を出て、グループが話し合うのを促すことにした。大統領がいるときは、真の意見交換が少なくなることを知っていたからだ。この最後の考慮は非常に重要だった。ケネディは危機の初めに、少なくともソ連のミサイル発射装置に対する先制空爆を許可しなければならないと考えていたが、そのことは他の人には言わず、議論の焦点にならないようにした。その結果、「初日の会議の終わりまでに、委員会は真剣に10の選択肢を議論した」ことで、大統領の考え方も変わり始めた。決して簡単ではなかった。常に意見の不一致があり、ストレスは厳しかった。しかし、それは交渉による平和をもたらすプロセスであり、核戦争には至らなかった。 ケネディ政権が意思決定文化を改善した方法は、管理や公共政策を学ぶ学生にとって必読の内容である。なぜなら、グループで働くことの二面性を捉えているからだ。チームはひどい間違いを引き起こすことがある一方で、判断力を鋭くし、一人ではできないことを共に成し遂げることもできる。マネージャーはネガティブな面やポジティブな面に焦点を当てがちだが、両方を見る必要がある。前述のように、「群衆の知恵」という言葉は、ジェームズ・スロウィッキーの2004年のベストセラーから来ているが、スロウィッキーのタイトル自体は、1841年の古典的な著作『異常な人気の妄想と群衆の狂気』のタイトルをもじったもので、集団的な愚行の数々を記録している。グループは賢明であることもあれば、狂気であることもあるし、その両方であることもある。何が違いを生むのかは、グループのメンバーだけではないことが、ケネディのアドバイザーたちによって示された。グループはそれ自体が一つの生き物なのだ。 チームを作るべきかどうか?IARPAのトーナメントでは、私たちの目標は正確性だった。予測者をチームにすることは役立つのだろうか?賛否両論の強い議論があった。否定的な側面として、研究文献や私の大学の委員会での数十年の経験は、チームが認知的な怠慢を助長する可能性があることを示唆していた。なぜ他の人が重い荷物を運んでくれるのに、複雑な問題をマスターするために労力をかける必要があるのか?このような態度が広がると、チームは沈没してしまう。さらに悪いことに、予測者同士があまりにも親しくなり、集団思考が蔓延することもある。この二つの傾向は相互に強化されることがある。「みんなが同意しているから、私たちの仕事は終わったよね?」という考えが生まれる。そして、グループ内の合意は強力な力を持つ。しかし、その合意が根拠のないものであれば、グループは自己満足に陥ってしまう。 しかし、グループは人々が情報や視点を共有することを可能にする。それは良いことであり、トンボの目のような作業を助け、集約は正確性にとって重要である。もちろん、集約は人々が独立して判断を下すときにのみその魔法を発揮する。公園の来場者が牛の重さを推測するように。判断の独立性は、誤りがほぼランダムであることを保証し、それによって互いに打ち消し合う。人々が集まり、グループで議論すると、思考や表現の独立性が失われることがある。ある人が議論を支配する大声の持ち主であったり、いじめっ子であったり、表面的に印象的な話し手であったり、他の人を萎縮させるような資格を持った人であったりすることがある。 集団は、人々が独立した判断を放棄し、誤りを受け入れるように仕向けることができます。その結果、間違いは蓄積されていき、相殺されることはありません。これは集団の愚行の根源です。17世紀のオランダの投資家たちが、チューリップの球根が労働者の年収よりも価値があると集団で信じ込んだり、2005年のアメリカの住宅購入者たちが不動産価格は上がる一方だと自分たちを納得させたりする例が挙げられます。しかし、集団の中で独立性を失うことは必然ではありません。JFKのチームがキューバ危機の際に示したように、予測者たちが自分自身やチームメンバーに疑問を持ち続け、活発な議論を歓迎すれば、集団はその構成要素の単なる合計以上のものになることができます。では、集団はスーパーフォーキャスターを引き上げるのか、それとも引きずり下げるのか?私たちの中には一つの結果を疑う者もいれば、逆の結果を考える者もいましたが、心の奥底では皆が推測していることを知っていました。最終的に、私たちは二つの理由から研究にチームを組み込むことを選びました。第一に、現実の世界では、人々は他者と話し合うことなく重要な予測を行うことはほとんどないため、現実の世界における予測をよりよく理解するには、集団における予測をよりよく理解する必要がありました。もう一つの理由は好奇心です。私たちは答えを知らず、知りたいと思ったので、アーチー・コクランの助言に従い、実験を行いました。 第1年目(2011-12年)には、スーパーフォーキャスターが一人もタグ付けされていない状態で、数百人の予測者をランダムに独立して作業するグループと、数百人をチームで作業するグループに割り当てました。チームの予測者たちは対面で会うことはありませんでしたが、オンラインフォーラムを作成し、チームメンバーはメールやSkypeなど、好きな方法でコミュニケーションを取ることができました。彼らは個々にスコアを付けられましたが、個人のスコアはプールされてチームスコアを作成しました。予測者たちは、自分自身とチームの成績を確認することができました。それに加えて、予測者たちは自由に組織することができました。目標は正確性でした。どのようにそれを達成するかは彼ら次第でした。また、私たちはチームワークに関する研究から得た洞察に基づいて、チームに対してチームワークの入門書を提供しました。一方で、私たちはグループシンクの危険性を警告しました。協力的であれど、従属的になってはいけません。合意が常に良いわけではなく、意見の不一致が常に悪いわけでもありません。もし合意に達した場合、その合意自体を自分が正しい証拠と見なしてはいけません。疑念を持ち続けることを決してやめないでください。鋭い質問は、チームにとってビタミンのように不可欠です。 一方で、グループシンクの反対である敵意や機能不全も危険です。チームメンバーは、不快感を伴わずに意見を異にしなければなりません。私たちは、インテルの元CEOであるアンディ・グローブの言葉を借りて「建設的対立」を実践するようアドバイスしました。精密な質問は、その一つの方法です。デニス・マティースとモニカ・ウォーラインの研究を参考に、私たちは人々がしばしば行う曖昧な主張を巧みに分析する方法を示しました。たとえば、誰かが「残念ながら、世界の人気のある娯楽であるサッカーの人気が低下し始めています」と言ったとします。あなたは彼が間違っていると疑っています。 その主張に対してどのように疑問を呈しますか?「あなたは愚かだ」といった個人的な攻撃を考えるべきではありません。それはただ感情を高めるだけで、真実を明らかにすることにはなりません。「そうは思わない」と言うだけでは、単なる反対意見を表明するだけで、なぜそう思うのかを掘り下げることにはなりません。「どういう意味ですか?」と尋ねることで感情の温度は下がりますが、あまりにも曖昧です。もっと具体的に質問しましょう。「『娯楽』とはどういう意味ですか?」や「サッカーの人気が低下しているという証拠は何ですか?どのくらいの期間にわたってですか?」といった具合です。これらの具体的な質問への答えは問題を解決するものではありませんが、結論の背後にある考えを明らかにし、それを掘り下げて検証することができます。ソクラテス以来、良い教師は精密な質問を行うことを実践してきましたが、それが最も必要なときに使われないことが多いのです。もしケネディチームがピッグス湾侵攻の計画を立てる際に精密な質問を行っていたら、事態はどうなっていたでしょうか。 「もし攻撃を受けて計画が崩れたら、どうなるのですか?」 「彼らはエスカンブレイ山脈に撤退し、他の反カストロ勢力と合流してゲリラ作戦を計画します。」 「提案された上陸地点からエスカンブレイ山脈までの距離はどのくらいですか?」 「80マイルです。」 「地形はどうですか?」 「主に湿地とジャングルです。」 「つまり、ゲリラは攻撃を受け、計画は崩れました。彼らはヘリコプターや戦車を持っていません。しかし、山の中で避難所を探す前に、80マイルの湿地とジャングルを越えなければならないのですか?それで合っていますか?」 この会話が「いいですね!」で終わることはなかったと思います。こうした質問は行われなかったため、ケネディの大統領としての最初の大きな決断は失敗に終わりました。この教訓は学ばれ、その結果、キューバミサイル危機の際には活発で敬意を持った議論が行われました。これは私たちが予測者たちの間で奨励した精神を体現しています。 **スーパーチーム** 年末には結果が明確でした:平均して、チームは個人よりも23%正確でした。2年目が始まると、私たちはチームが研究デザインの重要な部分であるべきだと全員が同意しました。しかし、別の選択肢に直面しました。実験条件の中でトップの予測者を特定した後、これらの新たに選ばれたスーパー予測者に対して何をすべきか?彼らにその地位を知らせるべきでしょうか?彼らをチームにまとめ、スーパー予測者同士が協力することでスーパーチームが生まれることを期待すべきでしょうか?リスクは明らかでした。誰かに特別に優れていると伝えると、彼らはその優位性を当然のこととして受け入れ始めるかもしれません。同じように優れた他者に囲まれ、特別であると伝えられると、自己意識がさらに膨らむ可能性があります。スーパー予測者が次のレベルに進むように促すのではなく、彼が自信過剰になり、自分の判断が正しいに違いないと考える誘惑に駆られるかもしれません。これはよくある逆説です:成功は称賛をもたらし、それが成功を生み出した思考習慣を損なうことがあります。このような傲慢さは、高い成果を上げた個人によく見られます。ビジネス界では、これを「CEO病」と呼びます。 再び理論的なサイコロを振りました。私たちは、各チームに約12人のスーパー予測者を集めてチームを作りました。高パフォーマンスチームの機能についての指針を提供し、オンラインでのコミュニケーションを助ける特別なフォーラムを設けました。チームは対面で会うことはなく、それには利点と欠点がありました。欠点としては、会ったことのない人々を軽視しやすく、場合によっては対立を生むこともあります。インターネット上の議論がどれほど早く有毒な攻撃に変わるかを見れば明らかです。一方で、距離があることで争いを管理しやすく、批判的な視点を保つことができるという利点もありました。初めてチームに参加したスーパー予測者のエレイン・リッチは、より直接的な不安を抱えていました。「私は自分のチームにかなり圧倒されていました」と彼女は語りました。エレインはワシントンDCに住み、ウォルター・リード医療センターで薬剤師として働いています。彼女のチームの中には「素晴らしい、印象的な資格を持っている人たちがいました」と彼女は振り返ります。「でも私は何の資格もありませんでした。」最初は静かにしていて、予測を立てるものの、意見を述べることはほとんどありませんでした。彼女のチームメンバーが資格や自信を持っているだけでなく、見知らぬ人の意見に疑問を持つのが難しかったのです。人々は物事を異なって受け取ります。一人が有益な質問と考えることを、別の人は攻撃的な批判と受け取るかもしれません。また、いくつかの質問は多くの人が情熱を持っている問題に触れていたため、それについて話すことは地雷原を歩くような感覚でした。アラファトとポロニウムに関する議論は最悪でした。「それについては多くの緊張がありました」とエレインは言いました。「ほとんどタブーのような質問でした。」 「私が言うところの“踊り回る”ことがたくさんありました」と、マーティ・ローゼンタールはチームでの最初の年を振り返りました。人々は誰かの評価に反対し、それを試したいと思っても、相手を傷つけることを恐れて自分の考えを率直に言えませんでした。そこで彼らは「慎重な言葉で包み込む」ようにし、ポイントが伝わることを期待して回り道をしました。経験が役立ちました。この「踊り回る」ことを見て、人々は過度の礼儀が意見の批判的な検討を妨げていることに気づき、他の人々に批判が歓迎されることを伝えるために特別な努力をしました。「皆が言いました、『私が見逃していることがあれば、あなたからの反論を求めます』と」とローゼンタールは言いました。それが違いを生みました。建設的な批判に感謝の意を示すことも効果がありました。徐々に、踊り回ることは減少しました。チームに関する研究は、通常リーダーや規範が存在し、それらがパフォーマンスを妨げないようにすることに焦点を当てています。一般的な解決策は、ケネディ政権がピッグス湾侵攻の後に実施したもの—外部の人を招き、階層を一時停止し、リーダーの意見を隠すこと—です。また、「プレモータム」という手法もあり、チームは行動方針が失敗したと仮定し、その理由を説明するように指示されます。これにより、チームメンバーはリーダーの計画に対する疑念を安全に表現できるようになります。 しかし、スーパーチームはリーダーや規範から始まったわけではなく、それが他の課題を生むことになりました。マーティ・ロゼンタールは現在半引退状態ですが、何十年もの間、チームビルディングを専門とするマネジメントコンサルタントとして活躍していました。組織構造がない中でチームを作ることは難しいと彼は理解しており、対面での会議なしでそれを行うことはさらに難しいことでした。誰かが前に出て指示を出すこともできますが、見知らぬ人同士ではそれが裏目に出ることもあります。「私たちがチームとして形成される過程にギャップがあるのを見て、それに対処したいと思ったが、同時に自分が乗っ取るように見られたくはなかった」と彼は言いました。「だから、私がしたことの多くは、後ろからリードすることだと思っています。私はただ、模範を示そうとしました。」マーティは、メンバーが自分の予測を十分に説明せず、良い議論ができていないと感じたとき、彼自身の予測をより詳細に説明し、コメントを求めました。また、彼は作業負担を整理するための電話会議を企画し、詳細は彼が担当しました—そしてほとんどのチームメンバーが参加しました。「その後のフィードバックは、皆がそれをとても楽しんだというものでした」とマーティは言いました。「人々はそれを通じてチームへのコミットメントが少し強まったと感じたと思います。」また、スーパーフォーキャスターたちがチームメンバーと対面で会う機会が2回ありました。2年目と3年目の終わりに、GJPプロジェクトマネージャーのテリー・マレーがウォートン校とカリフォルニア大学バークレー校で会議を開催しました。これらの集まりの公式な目的は知識を共有することでした:研究者たちはデータを提示し、スーパーフォーキャスターたちは自分の見解を提供しました。非公式な目的は、チームに人間的な側面を加えることでした。多くのスーパーフォーキャスターはこの機会を最大限に活用しました。マーティはバークレーキャンパスから1マイルも離れていない場所に住んでいるため、彼のチームメンバーを自宅に招待しました—ほとんどの人が会議に参加し、バーベキューとビールを楽しみました。このようなささやかな努力でも、マーティは違いを生んだと考えています。「確実に、私たちが互いに意見を出し合い、情報を共有する必要があるというコミットメントを感じる能力が向上しました。」 エレイン・リッチの中にもその帰属意識が育まれました。彼女はうまくやり遂げ、自信を高め、その責任感も増しました。「私は本当に気をつけなければならないと感じました。自分の役割を果たさず、他の人が書いたものを読むだけのタダ乗りにならないように、考えや研究を提供することが重要だと思いました。これは常に誘惑です。」 ほとんどのチームには、仕事の大部分を担う5人か6人のメンバーがいます。そのコアの中では、予測を遊びではなく仕事として捉えた場合、各人がタスクに投資する必要のある努力を減らす労働分担が期待されるかもしれません。しかし、最高のチームではその逆が見られました:作業負担は分けられましたが、コミットメントが高まるにつれて、フォーキャスターたちが投入する努力も増えました。チームにいることは「はるかに多くの仕事」だとエレインは言いました。しかし、彼女はそれを気にしませんでした。彼女は一人で働くよりもずっと刺激的だと感じました。「お互いを支え合ったり、助け合ったり、アイデアを発展させたりすることができるのです」と彼女は言いました。 「それは急いでやったことだった。」熱心なスーパーチームは、印象的な調査を行った。2013年のホンジュラス大統領選挙で誰が勝つかという質問に対して、南アフリカのスーパー予測者であり、CNBCアフリカで「ホット・ストックス」をホストする投資マネージャーのポール・セロンは、ホンジュラス政治を専門とする政治学者を見つけた。彼は、キャストロという候補者がわずかにリードしているとする世論調査の結果があったが、その調査は信頼性に欠けると聞いた。また、セロンはある不明瞭なウェブサイトでホンジュラス政治に関する分析を見つけ、その徹底ぶりと著者の資格に感銘を受けて、彼にメールを送り、有意義な議論を交わした。ポールは予測を変更し、キャストロの対立候補であるエルナンデスに優位性を与えた。結果、エルナンデスが勝利し、ポールの多大な努力が実を結んだ。そして、ポールは学んだことをすべてチームメンバーと共有したため、彼らも恩恵を受けた。「チームは、個人ができる以上に情報を集めるのがはるかに効果的です」とポールは私に語った。「優れたチームがカバーする範囲を、個人がカバーすることは決してできません。たとえ無限の時間があったとしても、異なる研究スタイルを考慮すると、成果は劣ります。各チームメンバーは異なる視点を持ち寄るのです。」 結果は自明だ。予測者が1年目に十分な成果を上げてスーパー予測者になり、2年目にスーパー予測者チームに入った場合、その人は50%も精度が向上した。3年目の分析でも同様の結果が得られた。これらはサイバースペースで tenuously(緩やかに)つながった見知らぬ人たちの集まりだったため、この結果には驚かされた。さらに驚くべきことは、スーパー チームが予測市場に対してどれほど優れていたかだ。ほとんどの経済学者は、市場が広く分散した情報を集め、それを単一の判断に凝縮する最も効果的なメカニズムであると言うだろう。市場は取引を通じてそれを実現する。私が特定の価格で株が良い価値だと思えば、あなたの株を買いたいと申し出るかもしれない。もしあなたが私の判断に同意すれば、売らないだろう。私が間違っていると思えば、売るだろう。もちろん、実際には取引は他の理由で行われることもある—私たちの異なる財政的ニーズが異なる方向に導くこともあるが—一般的に市場は人々が互いに絶えず再評価するためのインセンティブを生み出す。すべての判断の集約—そしてそれに基づく情報—は価格に反映される。多くの人々が私と同じように、株が現在の販売価格よりも価値があると考えれば、彼らはそれを買おうとする。需要の増加は価格を押し上げる。そのようにして、買い手の個々の判断と、それらの判断を導くすべての情報が「価格に織り込まれる」。 これらのことは、市場が完璧であることを意味するわけではないし、情報の効率的な集約者として、誰もがそれに打ち勝とうとするのは愚かだということでもない。それが経済学者が効率的市場仮説(EMH)と呼ぶ強いバージョンであり、心理学や経験から学んだこととは矛盾する。市場は間違いを犯すことがある。時には、集団として正気を失うこともある。 しかし、市場が効率的市場仮説(EMH)の熱心な支持者が考えるほど効率的でないとしても、市場を一貫して打ち負かすのは非常に難しいため、実際にそれを成し遂げたと主張できる人はごくわずかです。予測市場とは、予測に基づいて取引を行う市場のことで、トレーダーは特定の結果に関する契約を売買します。たとえば、「ヒラリー・クリントンが2016年にアメリカ合衆国の大統領に選ばれる」といった契約です。2016年の選挙が行われると、その契約は決済されます。クリントンが負ければ、その契約は何も支払われません。彼女が勝てば、1ドルが支払われます。もしその契約が現在40セントで売られていて、私がクリントンが60%または70%の確率で勝つと思うなら、私は買うべきです。多くのトレーダーが私と同じ意見であれば、その契約の需要は強くなり、価格は上昇します—それが他のトレーダーにとって適正だと考えられるレベルに達するまで、買いが緩やかになります。もし新たな出来事がクリントンが勝たないことを示唆すれば、売りが殺到し、価格は下がります。これらの判断を集約することで、契約価格は理論的にはヒラリー・クリントンが勝つ真の確率に近づくはずです。アイオワ電子市場のような予測市場は、印象的な実績を持っています。そして、ノーベル賞受賞者たちの理論的な支持もあります。では、スーパーチームと予測市場の戦いではどちらが勝つのでしょうか?ほとんどの経済学者は、これは勝負にならないと言うでしょう。予測市場はスーパーチームを圧倒するだろうと。私たちはこの仮説を検証するために、通常の予測者を無作為に3つの実験条件に割り当てました。ある者は単独で作業し、他の者はチームで作業し、また別の者はインクリンクやルーメノジックなどの企業が運営する予測市場のトレーダーでした。もちろん、1年目が終わった時点で、チームの価値が明確に示されたため、単独で作業する予測者がチームや予測市場と同じレベルで競争することは期待されていませんでした。そのため、私たちは彼らの予測をすべてまとめて、無加重平均を計算し、「群衆の知恵」を得ました。そしてもちろん、もう一つの競争相手がいました:スーパーチームです。結果は毎年明確でした。普通の予測者のチームは群衆の知恵を約10%上回りました。予測市場は普通のチームを約20%上回りました。そしてスーパーチームは予測市場を15%から30%上回りました。私はすでに、スーパーチームが予測市場を打ち負かした唯一の理由は、私たちの市場に流動性が欠けていたからだという金融の同僚たちからの抗議の声を聞いています:実際のお金がかかっておらず、トレーダーの重要な数がいなかったのです。彼らが正しいかもしれません。それは検証可能なアイデアであり、試す価値があります。また、スーパーチームが予測市場を上回った一方で、予測市場は複雑なグローバルイベントの予測をかなり良く行ったことを認識することも重要です。スーパーチームがこれほど成功した理由は、集団思考やインターネットの炎上戦争の極端を避け、互いに敬意を持って挑戦し、無知を認め、助けを求めることを奨励するミニ文化を育んだからです。 スーパーチームは、ハーバード大学のエイミー・エドモンドソンが特定した最高の外科チームに似ている点がいくつかあります。そこで看護師は、外科医が膵臓の後ろにスポンジを置き忘れたことをためらわずに指摘します。なぜなら、上司を訂正することが「心理的に安全」だと彼女が知っているからです。エドモンドソンの最高のチームは共通の目的を持っていました。私たちのスーパーチームも同様です。その一つのサインは言語に現れました。彼らは「私たち」という言葉を「私」という言葉よりも多く使っていました。 このようなチームは、正確な予測にとって非常に重要な積極的オープンマインド思考を促進すべきです。第5章で見たように、私たちは個人の積極的オープンマインドネス(AOM)をテストするために調査を行いましたが、同様にチームの態度やグループ内の相互作用のパターンを探るためにチームを調査しました。つまり、チームのAOMをテストしたのです。予想通り、チームのAOMとその正確性の間には相関関係が見られました。これは驚くべきことではありません。しかし、何がチームをより積極的にオープンマインドにするのでしょうか?あなたは、チームの個々のメンバーだと思うかもしれません。高いAOMを持つ人をチームに入れれば、高いAOMのチームができ、低いAOMの人を入れれば低いAOMのチームができると。しかし、実際にはそうではありません。チームは単なる部分の合計ではありません。グループが集団として考える方法は、グループ自体の新たな特性であり、メンバー間のコミュニケーションパターンの特性であって、各メンバーの思考プロセスだけではありません。お互いを気にかけないオープンマインドの人々の集まりは、そのオープンマインドな部分の合計よりも劣ります。一方、真実を追求するために互いに関与する意見を持った人々の集まりは、その意見を持った部分の合計以上のものになります。 これらすべては、勝利するチームの最後の特徴、すなわち「共有の文化を育む」ことに私たちを導きます。私のウォートン大学の同僚アダム・グラントは、人々を「与える人」「マッチャー」「取る人」と分類しています。与える人は、受け取る以上に他者に貢献する人です。マッチャーは、与えた分だけ受け取ります。取る人は、受け取る以上に与えません。シニカルな人は、与える人というのはチャンプのための丁寧な言葉だと言うかもしれません。結局、タダで得ようとする人は、与える人が与えたものを喜んで受け取り、何も返さず、与える人をより悪化させるからです。しかし、グラントの研究は、与える人のプロ社会的な例が他者の行動を改善できることを示しており、それは全員、特に与える人自身にとっても助けになります。これが、グラントが与える人が成功する傾向がある理由です。 マーティ・ローゼンタールは与える人です。彼は無差別に時間や努力を与えるわけではありませんでした。彼は、全員の利益のために他者の行動を変えるために意図的に寛大でした。マーティはグラントの研究を知らなかったものの、私がそれを説明すると、「その通りだ」と言いました。スーパーチームにはもっと多くの与える人がいます。ダグ・ローチはプログラミングツールを配布し、他の人々が自分のツールを作成し共有することを考えるきっかけを与えました。ティム・ミントは、時間の経過とともに予測に価値のある自動的な調整を加える方法を示す分析を提供しました。彼らは皆、与える人です。誰もチャンプではありません。実際、ダグ・ローチの個人スコアは最高でした。 第2年にはティム・ミントが、そして第3年には彼がチャートのトップに立ちました。そして、各人のチームはチーム競技でも勝利を収めました。しかし、これをあまり深く考えすぎないようにしましょう。忙しい経営者は「私もあれが欲しい」と思い、レシピが簡単だと想像するかもしれません。つまり、優秀な人材を集め、協力的なチームで育て、グループシンクを排除し、少しの貢献者を加え、賢い決定とお金が流れ始めるのを待つというわけです。しかし、残念ながらそれほど簡単ではありません。実際の従業員がいる既存の組織でこれを再現するのは難しいでしょう。「スーパー」ステータスの人を特定することは分裂を招く可能性があり、クロスファンクショナルチームに人を移すことは混乱を引き起こすことがあります。そして、結果が保証されるわけではありません。上記の傾向に対する風変わりな例外もありました。たとえば、互いに支え合わないチームでもうまくいったケースがあります。最高のスーパー予測者の一人は、グループシンクのリスクを避けるために、チームメンバーへのコメントを拒否しました。これが心理学研究の混沌とした世界です。確固たる結論を得るには時間がかかり、特にスーパー チームに関する研究はまだ始まったばかりです。私たちがまだ探求し始めたばかりの多くの質問があります。その一つは、私の同僚(かつIARPAトーナメントの元競争相手)スコット・ページが作り出した挑発的なフレーズ「多様性が能力を超える」というものです。異なる視点を集約することは判断を改善する強力な方法ですが、重要なキーワードは「異なる」です。同じような視点を組み合わせるだけでは、同じものが増えるだけであり、わずかな変化ではわずかな改善しか得られません。視点の多様性こそが魔法を働かせるのです。スーパー チームはかなり多様でしたが(スーパー予測者もかなり多様です)、私たちはそのことを考慮して設計したわけではありません。私たちは能力を最優先しました。もしページが正しいなら、チームのメンバーシップの主要な決定要因を多様性にし、能力は自ずと整うようにしていたら、さらに良い結果が得られたかもしれません。しかし、再度、偽の二項対立に注意しましょう。選択肢は能力か多様性ではなく、能力と多様性の組み合わせを微調整し、どの状況でどれが最も効果的かを測ることです。このバランスを理解するためには、オバマ大統領がチームの各メンバーに、パキスタンの謎の家にいる異常に背の高い男性がオサマ・ビン・ラディンである可能性について尋ねたことを思い出してください。回答は30%から95%までさまざまで、ほとんどが50%を超えていました。それらを合計し、アドバイザーの数で割ると、入手可能なあいまいな報告から、平均して約70%になります。これが群衆の知恵です。これは非常に優れた数字で、その会議で得られた以上の尊重を受けるべきものでした。しかし、オバマ大統領はそれ以上の結果を得ることができたのでしょうか?私たちの研究は、チームの多様性によっては可能だと示唆しています。チームが多様であればあるほど、あるアドバイザーが他の人が持っていない情報の断片を持っている可能性が高くなります。そして、これらの断片は… 主に「ビン・ラディンだ」と指摘されており、もしすべてのアドバイザーが持っていない情報をすべて与えられたら、彼らはそれぞれ自分の予測を引き上げるだろう。そして、それが「群衆の知恵」の数値を引き上げることになるかもしれない—おそらく80%や85%に。これが、私が第4章で言及した極端化アルゴリズムの背後にある考え方だ。このアルゴリズムは素晴らしく機能するが、その効果は多様性に依存している。多様性がゼロのチーム—メンバーがクローンで、全員が他の全員が知っていることを知っている—は、まったく極端化すべきではない。もちろん、そんなチームは存在しない。しかし、情報を共有するのが得意なチームもあり、それはある程度多様性を減少させる。スーパーフォアキャスターのチームはそのようなもので、だから極端化はあまり効果がなかった。しかし、通常の予測チームは情報を共有するのがそれほど得意ではなかった。その結果、私たちは彼らを極端化することで大きな成果を得た。実際、極端化は通常の予測チームに十分なブーストを与え、いくつかのスーパーチームを上回る結果をもたらした。そして、大規模な通常の予測者のプールを極端化することで、先ほど見たように、トーナメントで勝利する結果が得られた。これらのツールは、情報分析官や彼らの結論を統合する役人に取って代わるものではないし、そうあるべきでもない。私が見る限り、常に賢いアドバイザーのチームに囲まれた最高経営責任者が必要とされるだろう。ジョン・F・ケネディがキューバ危機の際にそうであったように。しかし、これらのツールは十分に優れており、彼らが生成する非常に安価な予測は、アメリカ合衆国の大統領を含む意思決定者のデスクに置かれるべきだ。 リーダーのジレンマ リーダーは決断を下さなければならず、そのためには予測を作成し利用しなければならない。予測が正確であればあるほど良いので、スーパーフォアキャスティングの教訓は彼らにとって非常に重要であるべきだ。しかし、リーダーは行動を起こし、目標を達成しなければならない。要するに、彼らはリードしなければならない。そして、人をリードしたことがある誰もが、スーパーフォアキャスティングの教訓がリーダーにとってどれほど有用であるかに疑問を抱くかもしれない。効果的なリーダーに必要な資質を挙げるよう人々に頼むか、リーダーシップコーチングに特化した業界を調べるか、このテーマに関する厳密な研究を調査すれば、三つの基本的なポイントにほぼ普遍的な合意があることがわかる。自信は誰のリストにも載っている。リーダーは合理的に自信を持ち、彼らがリードする人々に自信を植え付けなければならない。なぜなら、何も達成できないのは、それが可能だという信念がなければならないからだ。決断力もまた不可欠な属性である。リーダーは無限に考え込むことはできない。彼らは状況を把握し、決断を下し、次に進む必要がある。そして、リーダーはビジョンを示さなければならない—みんなが共に達成しようとする目標だ。しかし、スーパーフォアキャスティングを生み出す思考スタイルを見て、リーダーが何を提供しなければならないかとどう整合するかを考えてみてほしい。リーダーは何も確実なものがないと見ている場合、どうやって自信を持ち、他者に自信を与えることができるのか?彼らの思考が非常に遅く、複雑で自己批判的である場合、どうやって決断を下し、「分析麻痺」を避けることができるのか? どのようにして、彼らは新しい情報に基づいて考え方をすぐに調整したり、自分が間違っていたと結論づけたりすることができるのか、それでもなお relentless(執拗な)決意を持って行動できるのか?そして、スーパー予測の根底には謙虚さの精神がある。現実の複雑さは驚異的であり、私たちの理解力は限られており、間違いは避けられないという感覚だ。ウィンストン・チャーチルやスティーブ・ジョブズ、その他の偉大なリーダーを「謙虚」と表現した人はいないだろう。まあ、ガンジーは別かもしれないが、他に二人、三人を挙げるのは難しいだろう。そして、スーパー・チームがどのように機能していたかを考えてみてほしい。彼らは効果的なチームを形成するための指針を与えられたが、何も強制されることはなかった。階層も指示も正式なリーダーシップもなかった。これらの小さなアナーキストの集団は、スーパー予測者が好む無限の考察と再考の場として機能するかもしれないが、物事をまとめて実行することができる組織とは言えない。それには構造と責任者が必要だ。これは深刻なジレンマのように見える。リーダーは予測者であり、リーダーでなければならないが、一方の役割で成功するために必要なことが、もう一方を損なう可能性があるようだ。幸いなことに、スーパー予測者とスーパーリーダーであることの矛盾は、実際には見かけほど深刻ではない。実際、スーパー予測者のモデルは、良いリーダーを素晴らしいリーダーにし、彼らが率いる組織を賢く、適応力があり、効果的にするのに役立つ。鍵となるのは、19世紀のプロイセンの将軍によって最初に提唱され、第二次世界大戦のドイツ軍によって完成され、現代のアメリカ軍によって基礎的な教義として確立され、今日の多くの成功した企業によって実践されているリーダーシップと組織に対するアプローチだ。あなたの近所のウォルマートでも見つけられるかもしれない。 モルトケの遺産 「戦争においては、すべてが不確実である」とヘルムート・フォン・モルトケは書いた。19世紀後半、モルトケは1864年のデンマーク、1866年のオーストリア、1871年のフランスに対する勝利を導き、ドイツ統一に至る勝利を収めたことで、世界中で有名になった。彼の戦争に関する著作は、偉大な理論家カール・フォン・クラウゼヴィッツの影響を受けており、二つの世界大戦で戦ったドイツ軍に深い影響を与えた。しかし、モルトケはナポレオンではなかった。彼は自分をチェスの駒のように軍を指揮するビジョナリーリーダーだとは考えていなかった。彼のリーダーシップと組織に対するアプローチはまったく異なっていた。プロイセン軍は長い間、不確実性を重視しており、チェスのようなゲームには欠けている偶然の要素を導入するためにサイコロを使ったボードゲームを発明していたが、「すべてが不確実である」ということは、モルトケにとってはその含意を引き出す必要がある公理だった。最も緊急なことは、計画を完全に信頼しないことだ。「作戦計画は、敵の主力との最初の遭遇を越えて確実に続くことはない」と彼は書いた。この言葉は数十年にわたって洗練され、繰り返され、今日では兵士たちは「計画は敵との接触を生き延びない」として知っている。こちらの方がずっとキャッチーだ。しかし、モルトケの元の言葉はより微妙であり、彼の思考の典型的な特徴である。「適用される拘束力のある規則を定めることは不可能である」と彼は言った。 彼はすべての状況において、戦争では「二つのケースが全く同じになることはない」と書きました。即興が不可欠です。モルトケは、自分の将校たちがその任務を果たす能力があると信じていました。彼らは軍事訓練に加え、今日の私たちがリベラルアーツ教育と考えるような、批判的思考を重視した教育を受けていました。カリキュラムが純粋に軍事的な問題に焦点を当てているときでさえ、学生たちは真剣に考えることが求められました。当時の他の国々、特にアメリカでは、教師が問題を提示し、正解を教え、生徒たちにうなずいて暗記することを期待していました。しかし、ドイツの戦争アカデミーでは、シナリオが提示され、学生たちは解決策を提案し、集団で議論することが奨励されました。意見の不一致は許されるだけでなく、期待されており、教師の意見も「他の者たちの仲間であると理解していた」と歴史家のヨルク・ムートは指摘しています。将軍の意見でさえも scrutinized(精査)されました。「ドイツの若手将校たちは定期的に意見を求められ、大規模な部隊の動きの結果を、出席している将軍が発言する前に批判することがありました。」 批判を受け入れる姿勢は教室を超え、特異な状況下では批判以上のことが許容されました。1758年、プロイセンのフリードリヒ大王がゾルンドルフでロシア軍と戦っていたとき、彼は最年少のプロイセン将軍フリードリヒ・ヴィルヘルム・フォン・ザイドリッツに使者を送りました。ザイドリッツは騎兵部隊を指揮していました。「攻撃せよ」と使者は言いましたが、ザイドリッツは拒否しました。彼は時期が適切でなく、自軍が無駄になると感じたのです。使者は去りましたが、後に戻ってきました。再び彼はザイドリッツに王が攻撃を求めていると伝えましたが、ザイドリッツは再度拒否しました。三度目の使者は戻り、もしすぐに攻撃しなければ王が彼の首を取るだろうと警告しました。「戦闘の後に私の首は王のご自由に」とザイドリッツは応じました。「しかしその間、私は自分の首を使います。」ついにザイドリッツが時期を見極めたとき、彼は攻撃し、戦闘をプロイセンの有利に導きました。フリードリヒ大王は彼の将軍を祝福し、彼の首を守りました。この話やそれに類似した話は、ムートによれば「プロイセンの将校団内での集団的な文化的知識であり、公式の講義や将校の食堂、仲間同士の通信の中で無数に語り継がれました。」根本的なメッセージは、考えることです。必要ならば、命令について議論し、批判することも許されます。そして、もし絶対に従わなければならない場合—良い理由が必要ですが—命令に従わないことも許されます。これらは、何も達成できない不和な組織のレシピのように聞こえるかもしれませんが、その危険は、独立した思考を促進する要素と行動を求める要素のバランスを取ることで回避されました。決定にかける時間は状況によって制約されるため、意思決定はゆっくりと複雑に行われることもあれば、弾丸が飛び交うときには突然で単純になることもありました。 もしこのことが、決定が十分に情報に基づいていないことを意味するのであれば、それでも構わない。時間内に下された不完全な決定は、遅すぎる完璧な決定よりも良い。1935年に発行され、第二次世界大戦を通じて有効だったドイツ軍の指揮マニュアルには、「敵の状況を明確にすることは明らかな必要性であるが、緊張した状況で情報を待つことは強いリーダーシップの兆候ではなく、むしろ弱さの表れである」と記されている。「戦争における第一の基準は決定的な行動である。」と。 ドイツ軍は、熟慮と実行の間に明確な線を引いていた。決定が下されると、心構えは変わる。疑念や複雑さを忘れ、行動せよ!「攻撃したいのであれば、決然と行動しなければならない。中途半端な措置は不適切である」とモルトケは書いている。将校は「冷静さと自信を持って行動し、兵士の信頼を得る」必要がある。疑念の余地はない。「強さと自信だけが部隊を引き連れ、成功を生む。」賢明な将校は、戦場が「不確実性の霧」に包まれていることを理解しているが、「少なくとも一つのことは確実でなければならない。それは自分自身の決定である。それを守り、敵の行動によって自分の決定を揺るがされることがあってはならない。そうなることが避けられない場合を除いて。」 したがって、リーダーは障害を乗り越え、目標を達成するための揺るぎない決意を持たなければならないが、同時に計画を捨てて別の方法を試みる可能性にも心を開いていなければならない。これは誰にとっても大きな要求だが、ドイツ軍はこれをリーダーの役割の本質と見なしていた。「一度行動の方針が始まったら、圧倒的な理由がない限りそれを放棄してはならない」とドイツ軍のマニュアルは述べている。「しかし、戦闘の変化する状況において、行動の方針に固執することは失敗につながることがある。リーダーシップの技術は、状況の変化をタイムリーに認識し、新たな決定が必要な瞬間を見極めることにある。」 「何も確実ではない」から「揺るぎない決意」まで、これらすべてを結びつけるのは、指揮の原則であるアウフトラクトクタティク(Auftragstaktik)である。今日では「ミッションコマンド」と訳されることが多いが、その基本的な考え方はシンプルである。「戦争は緑のテーブルから行うことはできない」とモルトケは、司令部のトップ指揮官を指す表現を用いて書いている。「頻繁かつ迅速な決定は、現地の状況に基づいてその場で形成されるべきである。」意思決定の権限は階層を下に押し下げ、現場にいる者たち—進化する戦場で最初に驚きに直面する者たち—が迅速に対応できるようにしなければならない。もちろん、現場の者たちは全体像を把握していない。彼らが戦略的な決定を下すと、軍は一貫性を失い、それぞれが自分の目的を追求する小さな部隊の集まりになってしまう。アウフトラクトクタティクは、戦略的な一貫性と分散型の意思決定を、指揮官が部下に目標を伝えるが、達成方法は指示しないというシンプルな原則で融合させた。トップダウンの指揮統制型の軍事ユニットが町に接近する様子を想像してみてほしい。 ある大尉が町を制圧するよう命じられた。どうやって?南西から接近し、郊外の工場を避け、運河の橋を押さえ、その後市役所を占拠する。なぜ?それは彼の仕事ではない。大尉の役目は敬礼し、指示に従うことだ。もし町の状況が本部の予想と異なった場合はどうするのか?そんなことは起こらない。しかし、もしそうなったら?答えはない。大尉は新たな指示を本部に求める以外に何をすべきか分からず、さらに彼と部下たちは動揺するだろう。モルトケが指摘したように、「上司の指示とは全く異なる事態が発生すると、部下の信頼が揺らぎ、部隊に不確実感を与える。」 対照的に、ヴェアマハトでは、大尉は町を制圧するよう指示される。どうやって?それは彼次第だ。なぜ?上司が敵の増援が町の向こう側に到達するのを防ぐよう命じられており、町を制圧することで重要な道路を断つことができるからだ。アウフトラクトクタクティク(任務指揮)のおかげで、大尉は本部が予想する状況ではなく、実際に遭遇する状況を考慮した町の制圧計画を立てることができる。そして、即興で対応することもできる。もし本部が破壊されたと思っていた別の道路の橋を見つけたら、それが敵の増援を移動させるために使えることに気づくだろう。だから、彼はそれを破壊すべきだ。本部に尋ねる必要はない。今すぐ行動せよ。ヴェアマハトの命令はしばしば短くシンプルだった—歴史がかかっている時でさえ。「紳士諸君、あなた方の師団にはドイツの国境を完全に越え、ベルギーの国境を完全に越え、メーズ川を完全に越えることを要求します」と、1940年5月10日にベルギーとフランスへの大攻勢を開始する指揮官たちに上級将校が告げた。「どうやってやるかは一切あなた方に任せます。」アウフトラクトクタクティクは上級将校だけでなく、下級将校や下士官、最も低い兵士にまで及び、指揮官が達成したい目標を伝えられたが、彼らは自分たちが見ている状況に応じて最適な方法を判断することが期待されていた。戦場は「独立して考え行動できる兵士、計算された決定的かつ大胆な行動を状況ごとに行える兵士、そして勝利は各個人に依存することを理解している兵士」を必要とすると、指揮マニュアルには記されていた。これは、多くの人々が持っている第二次世界大戦中のドイツ軍のイメージとは正反対である。ヴェアマハトは、ヒトラーの指示に対する完全な服従を説くナチス政権に仕えていたが、誰もがドイツ兵が行進する古いニュース映像を思い出す。彼らは個々の人間のようには見えず、まるで無心で従順な、残忍に効率的な戦争機械の部品のように見える。しかし、しばしば忘れられるのは、ナチスがヴェアマハトを創り出したのではなく、彼らはそれを受け継いだということだ。 そして、それは私たちが想像する無思考の機械とはまったく異なるものでした。ベルギーのエーベン・エマール要塞に対する壮大な攻撃がそれを示しています。1940年5月10日の早朝、数十機のグライダーが静かにエーベン・エマールに向かって飛び立ちました。この巨大な地下要塞は、ベルギーがドイツにフランスへの前線として再利用されないようにするための広範な努力の中心でした。ほとんどのグライダーは野原に着陸し、兵士たちは飛び出して橋を守るベルギー軍に攻撃を仕掛けました。9機のグライダーは要塞の屋根に着陸し、兵士たちは急いで出て行き、重砲を破壊しました。ケース・イエロー、すなわちベルギーとフランスへの侵攻が始まりました。エーベン・エマールの防衛者たちは降伏しました。これが一般的に語られる物語です。しかし、重要な作戦の指揮を若き中尉ルドルフ・ヴィッツィグに任せたことは省かれています。彼のグライダーはドイツで緊急着陸を余儀なくされ、目標から100キロ離れた場所に着陸しました。ベルギー側に警戒を促さないために無線通信を行わずに飛行していた他の部隊は、着陸して初めて指揮官と多くの兵力を失ったことに気づきました。一方、橋への攻撃に参加する予定だった別のグライダーは、目標から60キロ離れた場所に着陸していました。この時点で、作戦は簡単に失敗する可能性がありました。しかし、エーベン・エマールの上空では、一人の軍曹が残った部隊を指揮し、ベルギーの砲台を撃破しました。すると、別のグライダーが急降下して要塞に着陸しました。そこから飛び出したのはルドルフ・ヴィッツィグで、彼は別の飛行機とグライダーを確保し、少し遅れてエーベン・エマールに到着しました。迷ったグライダーについては、責任者の軍曹が2台の車両を調達し、ベルギーに突入して即興の地上攻撃を行い、121人の捕虜を得ました。 「大きな成功には大胆さと勇気が必要だが、良識が優先されなければならない」と陸軍のマニュアルには記されています。「軍隊とその下位部隊の指揮には、判断力を持ち、明確なビジョンと先見の明を持ち、独立して決断し、それを揺るぎなく実行できるリーダーが必要です。」私たちの言葉で言えば、それには超予測者であり超リーダーである個人が必要です。もちろん、すべてのドイツ軍の将校がそうであったわけではありませんが、特に作戦や戦術のレベルでは、十分にそうした人々がいたため、ドイツ軍はほとんどのヨーロッパを征服し、数年間それを維持することができました。戦争の大部分において、彼らは圧倒的に数で劣り、武器も劣っていました。「彼らが仕えた体制の邪悪な性質にもかかわらず」と歴史家ジェームズ・コーラムは指摘しています。「第二次世界大戦のドイツ軍は、兵士一人一人の能力において、これまで見られた中で最も効果的な戦闘部隊の一つであったことは認めざるを得ません。」 最終的に、ドイツ軍は失敗しました。その一因は、敵の優れた資源に圧倒されたことでした。 しかし、ドイツ軍は失敗も多く、その多くは最高司令官アドルフ・ヒトラーがヘルムート・フォン・モルトケの原則に反して直接作戦を指揮したためであり、特にノルマンディー侵攻ではその影響が最も悲惨でした。連合軍は、上陸後にドイツの戦車が彼らをビーチに押し戻し、海に追い込むのではないかと恐れていましたが、ヒトラーは予備軍の動きは彼の個人的な命令によってのみ許可されると指示していました。ヒトラーは遅くまで寝ており、連合軍がビーチに上陸した後の数時間、独裁者の側近たちは彼を起こして戦車を戦闘に出すよう命じるかどうか尋ねることを拒否しました。皮肉なことに、19世紀のドイツの将軍は、ノルマンディーでのドイツの敗北によって正当化されました。その敗北は、モルトケの哲学をドイツの最高司令官よりも深く理解していたアメリカの将軍ドワイト・アイゼンハワーの手によるものでした。 権威主義的なドイツの国防軍(ヴェーアマハト)とは対照的に、自由で民主的なアメリカの軍隊は、同時代において独立した思考をあまり必要としませんでした。第一次世界大戦の後、当時の若手将校で新しい武器である戦車にいくらかの経験を持っていたアイゼンハワーは、アメリカ陸軍の歩兵ジャーナルに「古い戦車の不器用で鈍重な進行は忘れ去られるべきであり、その代わりに迅速で信頼性が高く効率的な破壊のエンジンを思い描くべきだ」と控えめに主張する記事を発表しました。アイゼンハワーは叱責を受けました。「私の考えは間違っているだけでなく危険だと言われ、以後は自分の考えを心に秘めておくようにと言われました」と彼は振り返ります。「特に、堅固な歩兵の教義と矛盾するようなことは公表してはいけないと言われました。もしそうしたら、軍法会議にかけられることになると。」軍隊では、部下は上司に対して疑問を持たずに敬礼し、従うことが求められました。命令は長く詳細で、「アメリカ軍が北アフリカに上陸するための命令は、シアーズ・ローバックのカタログのサイズに匹敵する」とヨルグ・ムースは書いており、個人のイニシアティブを発揮する余地はほとんどありませんでした。賢く創造的なアメリカの将校もいましたが、彼らは訓練の結果としてではなく、訓練にもかかわらず個人のイニシアティブを重視していました。ジョージ・パットンもその一人です。「人に物事のやり方を教えてはいけない」と彼は書き、アウフトラクトクタクティクの精神を簡潔に表現しました。「彼らに何をすべきかを伝えれば、彼らはその独創性であなたを驚かせるでしょう。」 パットンの生涯の友人であるドワイト・アイゼンハワーもまたその一人でした。モルトケのように、アイゼンハワーは何事も確実ではないことを理解していました。D-Day侵攻を進めるという取り返しのつかない命令を出した後、彼が最初に行ったのは、失敗した場合に公開されることになる責任を明記したメモを書くことでした。静かでほとんど穏やかなモルトケのように、アイゼンハワーは冷静で自信に満ちた姿勢が、虚偽の確実性の主張よりも信頼感を広め、士気を高めるのに役立つことを理解していました。プライベートでは、アイゼンハワーは気分屋で考え込む喫煙者でしたが、部隊の前では常に笑顔を絶やさず、安定した言葉をかけていました。アイゼンハワーはまた、彼の将校たちがオープンな議論に参加することを期待していました。 彼は、根拠のある批判を尊重し、間違いを素直に認める人物でした。1954年、アイゼンハワーが大統領であったとき、陸軍参謀総長マシュー・リッジウェイはベトナムへの介入に反対し、50万人以上の兵士を必要とする大規模な努力が必要になると述べました。アイゼンハワーはリッジウェイの判断を尊重しました。なぜなら、1943年にリッジウェイがローマに空挺部隊を投下するというアイゼンハワーの命令に抵抗し、後にアイゼンハワーがリッジウェイが正しかったと認めたからです。 第二次世界大戦後、アメリカ軍はドイツ国防軍の教訓を学ぶのが遅れました。新しいイスラエル軍は、個人のイニシアティブの価値を理解していました。「計画は変化のための単なるプラットフォームである」というのは、その時代のイスラエル国防軍の人気スローガンでした。1956年のエジプトとの戦争でのあるイスラエルの将校は、ある師団の戦闘のパフォーマンスについて、「ほとんどすべての計画が戦闘中に失敗したが、すべての目標は完全に達成され、予想よりも早く実現した」と誇らしげに述べました。 イスラエルのシステムは、明示的に外国のモデルに基づいていたわけではありませんが、「ドイツのアウフトラクトタクティク(任務指揮)は決して認められなかったからです」。アウフトラクトタクティクの時代がついに訪れたのは1980年代初頭でした。緊張が高まり、ソ連は人員と戦車で圧倒的な数的優位を持ち、NATOは少ないリソースでより多くのことを成し遂げなければなりませんでした。アメリカの将軍たちは歴史家や理論家の著作を精査し、イスラエルの経験を詳しく調べました。中には旧ドイツ国防軍の将軍に相談する者もいました。1982年には「ミッションコマンド」が公式なアメリカの教義の一部となりました。軍がどれだけ分権化されるべきかは議論の余地がありますが、現場の指揮官のイニシアティブは現代において確実に大きな成功をもたらしました。 2003年のイラク侵攻では、イラク軍が開けた砂漠で崩壊し、アメリカ軍がバグダッドに接近する中、都市戦が続くのではないかという懸念がありました。その際、「サンダーラン」と名付けられた襲撃が行われ、重装甲の部隊が主要道路を急速に進み、新たに占拠した空港へと向かいました。イラク軍は完全に不意を突かれ、部隊はわずか1台の車両を失っただけで通過しました。2日後、全体の旅団が同じルートでサンダーランを実施しましたが、今度は主要な政府地区に進入し、それを占拠して保持することで、イラクの防衛が迅速に崩壊することを確実にしました。勝利の鍵は、現場の指揮官に権限を与え、弾薬が不足しているにもかかわらず政府地区に留まるという大胆な決断を下したことでした。 バグダッド陥落後に勃発した反乱は、軍の指導部によって予測されておらず、数ヶ月、さらには数年の間、彼らはどのように対応すべきか全く分からない状態でした。現地の指揮官たちは、できる限りの方法で対処しようと奮闘しました。北イラクのモスル市では、第101空挺師団のデビッド・ペトレイアス将軍が、軍事史の豊富な知識を活かして、都市の人々を「守り、奉仕する」ことを目指した戦略を即興で考案しました。これにより、反乱者たちに対する支持を削ぐことを狙ったのです。 すべては彼自身のイニシアティブによるものでした。「ペトレイアスはバグダッドの上司に自分が何をしているのかを知らせたが、許可を求めることはなく、指示を待つこともなかった。指示が来ることはないと知っていたからだ」とジャーナリストのフレッド・カプランは書いています。ペトレイアスの努力は実を結びました。彼が指揮を執っている間、モスルでは他の地域で激化していた反乱が酸素を奪われていました。2007年、反乱が国を飲み込み、多くの人々にとって打破不可能に思えたとき、ペトレイアスはイラク全体の指揮を任されました。彼は同じ志を持つ将校たちを集め、「独立して考えることができる柔軟な指揮官」を育成し、モスルで試した反 insurgency 戦略を全国で積極的に実施しました。暴力は激減しました。どれだけの功績が個人に帰属するかは明確ではありませんが、大多数の観察者はペトレイアスに一定の評価を与えるべきだと考えています。私はデビッド・ペトレイアスと彼のリーダーシップの哲学について話をしましたが、モルトケの影響が感じられました。彼は「敵との接触で計画は生き残らない」と「何も確実ではない」というマントラを引用しました。しかし、ペトレイアスは、単なるスローガンを口にするのは簡単だと指摘しました。重要なのは「バンパーステッカーを超えて、そうなるために何をするか」ということです。 柔軟な思考を育むために、ペトレイアスは人々を「知的快適ゾーン」から引き出します。彼が第82空挺師団の旅団指揮官だったとき、ペトレイアスは、あまりにも振り付けがなされた実弾訓練演習に不満を抱いていました。「基本的に、会社指揮官にはほぼ脚本を渡しているようなものだ」と彼は言い、「会社指揮官は100メートル歩いて特定の道路を渡り、ここでこの特定の間接火力を要請するか、攻撃ヘリコプターを使うことになっていると知っている」と続けました。実際には、指揮官は驚きに直面し、即興で対応しなければなりません。では、なぜ脚本が必要なのか?それは安全のためです。この訓練では実際の武器や爆発物が使用されます。ペトレイアスによれば、安全性を保ちながらも、将校たちが驚きに対処することを強いる演習を開発するのは大きな挑戦でした。しかし、彼らはそれを解決しました。「それが不確実性に対処できる柔軟なリーダーを育てる方法だからです」。 ペトレイアスはまた、将校をトップ大学に派遣して大学院教育を受けさせることを支持しています。それは知識を得るためではなく(それも二次的な利点ですが)、別の種類の驚きに直面するためです。「それは、世界には非常に異なる基本的な前提を持つ非常に優秀な人々がいることを教えてくれます。そして、そのために、非常に異なる結論に至るのです」とペトレイアスは言います。戦場での衝撃に直面するのと同様に、他の思考方法に取り組むことは、将校たちを精神的に柔軟にする訓練になります。ペトレイアスは経験から語っています。ウェストポイントを卒業して13年後、彼はプリンストン大学で国際関係の博士号を取得しました。この経験を彼は「非常に貴重なもの」と呼んでいます。 ペトレイアスの知的柔軟性へのこだわり—「兵士が持つ最も強力な武器は武器そのものではなく、彼の心だ」と彼は言う—は、今なお軍の中で物議を醸しています。2007年に発表された雑誌記事で、退役大佐のラルフ・ピーターズは「ハムレットは考えすぎだ」と書きました。これは、ペトレイアスが将校を大学に送ることを支持する記事と並んで掲載されました。「あらゆる議論をじっくり考えすぎて、彼は決断する勇気を欠き、祈りの中で暗殺者を殺すことができない—哲学的な『戦争犯罪』だ。典型的な学者であるハムレットは、理論に毒されて優柔不断であり、彼はウィッテンベルクの大学に留まるべきだった。そこで彼の決断を下さないおしゃべりな能力は、確実に終身雇用を得ることができただろう。」 軍が必要としているのは、考える人ではなく、行動する人だとピーターズは書いています—ヘンリー五世であって、ハムレットではない。「ハリー王は決断を下すことができた。」しかし、ペトレイアスは行動する人と考える人の間の対立を偽の二項対立だと見ています。リーダーは両方である必要がある。「大胆な行動は正しい行動だが、それが間違った行動である場合を除いて」と彼は言います。リーダーは「何が正しい行動かを見極め、それを大胆に実行する必要がある」とも述べています。この熟慮と実行の間の緊張は、モルトケが強調し、ペトレイアスがイラクでバランスを取ったものです。リーダーがこのバランスをどれだけ巧みに取るかが、彼らの組織が下位の指揮系統においてそのバランスを再現できる「スーパー・チーム」を育成できるかどうかを決定します。そして、これは孤立したリーダーが一人で成し遂げられるものではありません。他者からの不快な言葉を聞く広い意欲と、人々がそのような言葉を安心して話せる文化の創造が必要です。ペトレイアスは、若きドワイト・アイゼンハワーに対して行われたことは重大な誤りだったと述べています。「型破りな考えを持つ人々を守り、育てる必要がある。」 ビジネスにおけるアウフトラグスタクティク 軍隊は特異な組織ですが、あらゆる職場で上司はコントロールと革新の間の緊張を感じています。だからこそ、モルトケの精神は弾丸や爆弾とは無関係な組織にも見られます。「私たちは、達成してほしい目標を人々に伝えます。しかし—これは非常に大きな「しかし」ですが—その目標を達成する方法は教えません。」これは「ミッション・コマンド」のほぼ完璧な要約です。発言者は、革新的な製造コングロマリットである3Mの研究開発部門の上級副社長ウィリアム・コインです。「背骨を持て;異議を唱え、コミットせよ」は、ジェフ・ベゾスがアマゾンの新入社員に徹底的に教える14のリーダーシップ原則の一つです。続けてこう述べています。「リーダーは、異議がある場合には、たとえそれが不快で疲れることであっても、決定に対して敬意を持って挑戦する義務があります。リーダーは信念を持ち、粘り強いです。彼らは社会的な結束のために妥協しません。一度決定が下されれば、彼らは全力でコミットします。」この言葉はモルトケにとっては少し直接的ですが、ヴェアハルトの指揮マニュアルや私とデイビッド・ペトレイアスとの会話の中では不自然ではありません。 ウォルマートは、店舗を開店するスピードが店舗マネージャーを育成するスピードを上回っていることに気づき、「リーダーシップアカデミー」を設立しました。このアカデミーは、昇進のための候補者を早く育成することを目的としています。アカデミーは、元イギリス王立海兵隊のダミアン・マッキニーが率いるイギリスのコンサルティング会社マッキンニー・ロジャースによって設計されました。軍事アカデミーをモデルにしており、「ミッションコマンド」の哲学が基盤となっています。 マッキニーは、軍の経験を企業の世界に持ち込むのは自分だけではないことを知っています。デビッド・ペトレイアスを含む多くの元軍人たちも同じ道を歩んでいます。彼らは、軍隊が厳格な階層組織であり、部下が上司に敬礼し、機械的に従うという認識にしばしば直面しますが、そのイメージは非常に古くなっています。実際、企業にアドバイスをする元軍人たちは、経営者に対して地位を気にするよりも、自分たちのチームや人々に力を与えて、共通の目標を達成するための最良の方法を選ばせることにもっと注力するように助言することが多いのです。「皮肉なことに」とダミアン・マッキニーは『フィナンシャル・タイムズ』に語りました。「企業は、軍の仲間たちよりも、私が『指揮と統制』と呼ぶことにずっと焦点を当てています。」 しかし、謙虚さという厄介な問題は依然として残っています。ウィンストン・チャーチルやスティーブ・ジョブズが謙虚だと言われたことはありませんし、デビッド・ペトレイアスも同様です。ウェストポイントの士官学校の生徒時代から、ペトレイアスは自分がトップ将軍になるための資質を持っていると信じていました。この自信は、本書で取り上げた多くのリーダーや思想家にも見られます。ヘルムート・フォン・モルトケ、シャーマン・ケント、さらには最も権威ある人々に異議を唱えたアーチー・コクランもそうです。ジョン・メイナード・ケインズは常に自分が部屋で最も賢い人間だと思っていました。そして、ジョージ・ソロスは、極度のプレッシャーの中で多くの人を神経的に疲弊させるペースで働くウォール街のヘッジファンドマネージャーでした。ソロスの最も有名な賭けは、1992年にイギリスポンドをショートしたことで、彼は約11億ドルを得ましたが、これはほぼ100億ドル相当のポンドを売る必要がありました。「危険ほど心を集中させるものはない」とソロスはかつて言いました。これは、自分がその仕事に向いていないことを心配している人の言葉には聞こえません。 アビリーン、カンザス出身の率直な男ドワイト・アイゼンハワーでさえ、かなりの自尊心を持っていました。第二次世界大戦後、アイゼンハワーは非常に人気があり、両党ともに彼に大統領候補としての指名を受け入れるよう懇願しました。トルーマン大統領は、彼のために辞退することさえ提案しましたが、アイゼンハワーは常に拒否しました。彼は本当にその仕事を望んでいなかったのです。しかし、1952年の選挙戦が進むにつれて、共和党の指名、そしておそらく大統領職が、アメリカの全軍を「自由のジブラルタル」に帰還させることを約束する孤立主義者によって勝ち取られることが明らかになりました。アイゼンハワーは、これが彼自身が止めることができる唯一の大惨事になると考えました。「彼は自国のために最善を望んでいた」とある伝記作家は書いています。「そして最終的に彼は自分がその役割を果たすべきだと決断しました。」 彼は明らかに自己評価が高かった。しかし、予測者が謙虚である必要があるという明らかな重要性と、彼の自己評価をどう結びつけるべきだろうか。その答えは、アニー・デュークが私に語ったことにある。彼女については以前に触れたが、彼女は自分が世界で最も優れたポーカー選手の一人だと信じている。これは大きな主張だが、彼女はワールドシリーズ・オブ・ポーカーのチャンピオンシップを含む長い実績を持っており、その自信は合理的であることを示唆している。しかし、デュークは自信には危険が伴うことも知っている。意思決定を行う際、デュークのような賢い人は、単純な認知のショートカットに誘惑されることがある。「私は答えを知っている。長い時間考える必要はない。私は良い判断力を持った非常に成功した人間だ。私の判断が正しいと信じていることが、それを証明している。」こうした決定を下すと、現実を自分の鼻先からしか見ていないことになる。それは誰にとっても危険な意思決定の方法だ。この罠を避けるために、デュークは自分が自信を持っていることと、そうでないことを慎重に区別している。「ゲームに対しては非常に大きな謙虚さを持たなければならない。なぜなら、ゲームは非常に複雑で、解決できるものではなく、三目並べやチェッカーのようなものではないからです」と彼女は言う。「マスターするのは非常に難しく、常に学ばなければ失敗します。とはいえ、ゲームに対する謙虚さは、対戦相手に対する謙虚さとは全く異なります。」デュークは、ポーカーテーブルで対戦するほとんどの人と競争できる自信を持っている。「しかし、それは私がこのゲームをマスターしたと思っているわけではありません。」 良い判断に必要な謙虚さは自己疑念ではない。才能がない、知性がない、価値がないという感覚ではなく、知的謙虚さである。現実が非常に複雑であることを認識し、物事を明確に見ることが常に困難であり、場合によってはそれができないこと、そして人間の判断は必然的に間違いを含むものであることを理解することだ。これは愚者にも天才にも当てはまる。したがって、自分を高く評価しながらも知的に謙虚であることは十分に可能だ。実際、この組み合わせは素晴らしい成果を生むことがある。知的謙虚さは良い判断に必要な慎重な反省を促し、自分の能力に対する自信は決意ある行動を引き起こす。「正しいことに対して確固たる信念を持ち、神が私たちに正しいことを見せてくださるように、私たちは今いる仕事を終えるために努力しましょう」とエイブラハム・リンカーンは彼の第二回就任演説で宣言した。これは強い信念と決意の表明である。しかし、それはまた謙虚な認識でもある。「神が私たちに正しいことを見せてくださるように」という部分は、私たちの視野が限られていること、判断が欠陥を抱えていること、そして最も確固たる信念でさえ間違っている可能性があることを示している。 追記 一つの疑問が残る。「なぜ私はヴェルマハトを選ばなければならなかったのか?」他の組織も、スーパーフォアキャスターのように考えることでリーダーのパフォーマンスを向上させることを示している。それなら、なぜ現代史で最も悪しき原因に仕えた軍隊を例に挙げる必要があったのだろうか。 ヴェルマハトが何を成し遂げたのかを理解するためには、最も難しい視点の取り方に取り組む必要があります。それは、私たちが軽蔑する何かが印象的な特性を持っていることを認めることです。対立の中で予測を行う者がこの不協和音に対処できない場合、最も深刻な予測ミスを犯すリスクがあります。それは、相手を過小評価することです。道徳と能力の間には神聖に定められた関係はありません。清教徒の詩人ジョン・ミルトンが『失楽園』でサタンを邪悪でありながらも資源に富んだ存在として描いたように、ヴェルマハトについても同じことが言えるのではないでしょうか。幻想的な相関関係を見て、道徳的および認知的な弱さが同時に存在すると仮定する予測者は、私たちが最も必要とする時に失敗します。私たちは、情報分析者がジハード主義グループを無能だと仮定したり、凶悪な政権が創造的に凶悪であることができないと考えたりすることを望んでいません。不協和音に対処するのは難しいことです。「一流の知性の試金石は、二つの対立する考えを同時に心に留めておきながら、なお機能する能力です」とF・スコット・フィッツジェラルドは『ザ・クラックアップ』の中で述べています。これは、ナチス政権に対する私たちの感情と、ヴェルマハトの組織的な弾力性に関する事実的な判断を分けて考え、ヴェルマハトを破壊されるべき恐ろしい組織でありながら、私たちに教訓を与える効果的な組織として見ることを要求します。論理的な矛盾はなく、ただ心理的な緊張があるだけです。もしあなたがスーパーフォーキャスターになりたいのであれば、その緊張を克服しなければなりません。それは挑戦です。自己批判に優れたスーパーフォーキャスターでさえ、時には事実と価値を混同することがあります。シリア内戦の初期に、ダグ・ローチは反乱軍がアレッポを制圧するかどうかの質問に失敗しました。なぜそうなったのかを考えたとき、彼はアサド政権に対する嫌悪感が反乱軍が勝つという願望的な結論に導いたことに気づきました。ジョシュア・フランケルは、北朝鮮が核兵器を detonするかどうかの予測に苦しみましたが、彼は「楽観主義と進展への希望に影響されていた」と振り返ります。当時はそれに気づいていませんでした。しかし、「締切の数週間前に、韓国戦争の際に北朝鮮から逃れた家族を持つ良い友人との会話が、私にこれを気づかせてくれました」と彼は述べ、予測を変更しました。では、なぜ私たちが不快に感じるにもかかわらずヴェルマハトを例に挙げるのでしょうか?まさにそれが私たちを不快にさせるからです。 本当に彼らはスーパーフォーキャスターなのでしょうか?私が予測トーナメントを運営してきた長い間、ロナルド・レーガンや赤軍のパレードから今日に至るまで、私はダニエル・カーネマンと私の仕事について話してきました。その点で、私は非常に幸運でした。カーネマンは偶然のノーベル賞受賞者であり、経済学の訓練を受けていない認知心理学者ですが、その研究はこの分野の基盤を揺るがしました。彼はまた、カジュアルな冗談とその鋭い分析の間を流れるように行き来する素晴らしい会話者でもあります。カーネマンと話すことは、 ソクラテス的な体験とは、守りに入らずにいれば活力を与えてくれるものです。2014年の夏、スーパーフォアキャスターたちが単なる運の良い人々ではないことが明らかになったとき、カーネマンは本題に入りました。「彼らを異なる種類の人間として見るのか、それとも異なることをする人間として見るのか?」私の答えは「両方少しずつ」です。彼らは知性やオープンマインドの指標で平均以上のスコアを持っていますが、特別に突出しているわけではありません。彼らが優れている理由は、彼ら自身よりも彼らが行うことにあります。つまり、リサーチのハードワーク、慎重な思考と自己批判、他の視点の収集と統合、細かな判断と絶え間ない更新です。しかし、彼らはそれをどれくらい持続できるのでしょうか?私たちが見たように、人々は原則として、迅速で無意識的なシステム1の操作から生じるミスを意識的なシステム2の反省を使って捕らえることができます。スーパーフォアキャスターたちは、そのために膨大な努力を注いでいます。しかし、継続的な自己検証は疲れるものであり、知っているという感覚は魅力的です。確かに、私たちの中でも最も優れた人々でさえ、容易で直感的な思考モードに戻ってしまうことは避けられません。 2014年のインタビューで、マイケル・フリン将軍は、国防情報局(DIA)の長として退任する直前に彼の世界観をまとめました。DIAはペンタゴンのCIAに相当し、17,000人の職員がいます。「私は毎朝このオフィスに来て、頭をクリアにするための短いジョギングを除けば、2〜3時間は情報報告書を読んでいます」と彼は言いました。「正直に言うと、私が毎日目にするのは、私のキャリア全体で見た中で最も不確実で混沌とした国際環境です。ナチスや日本の帝国主義者が世界を支配しようとしていた時代の方が危険だったかもしれませんが、私たちはまた非常に危険な時代にいます……私は、私たちがかなり前例のない社会的対立の時期にいると思います。」 フリンの言ったことの多くは曖昧すぎて判断できませんが、彼の最後の一言はそうではありません。インタビューの文脈—記者がウクライナ、韓国、中東の紛争に言及していたことを考えると—その発言は、フリンが「社会的対立」が「かなり前例のない」レベルにあると信じていることを明確に示しています。これは、第二次世界大戦以降の世界の暴力を定量化した多くの報告書をレビューすることで確認できる経験的な主張です。そして、それらが示すのは、広く見て、国際戦争は1950年代以降減少しており、内戦は1990年代初頭の冷戦終結以降減少しているということです。これは年間の戦闘死亡者数にも反映されており、いくつかの例外はあるものの、この期間を通じて減少しています。 DIAの長である必要はなく、これらの報告書を見つけることはできます。「世界の紛争動向」をグーグルすれば十分です。しかし、フリンはその広範な結論を導き出し、それを共有する前にデータを確認する必要がないと考えました。なぜでしょうか?ペギー・ヌーナンが他の元職員のデータを参照する必要がないと考えたのと同じ理由です。 ブッシュ大統領の支持率が上昇している意味を判断する際、フリンは毎日デスクの上に山のように積まれた悪いニュースを見て、その結論が正しいと感じました。つまり、それが全てだと思ったのです。生涯にわたる情報担当官として、フリンは仮定を確認する重要性を知っていましたが、彼はそれをしませんでした。なぜなら、それが仮定のようには感じられなかったからです。彼にはそれが真実のように思えたのです。これは心理学の古典的なトリックであり、フリンはそれに引っかかってしまいました。私はマイケル・フリンを軽視しているわけではありません。むしろ、彼のように優れた業績を持つ人がこんなにも明白な誤りを犯すことができるという事実こそが、その誤りを際立たせています。私たちは皆、脆弱です。そして、私たち自身を完全に守る方法はありません。これは有名なミュラー・ライヤーの錯視が示す通りです。 ミュラー・ライヤー錯視 上の水平線は下の線よりも長く見えますが、実際にはそうではありません。もし疑問があるなら、定規を取り出して測ってみてください。線が同じであることを完全に確認したら、再度見てみてください。しかし今度は、2本の線の長さを正確に見ようとしてください。うまくいきませんか?あなたは線が同じであることを知っています。それをそのように見たいと思っています。しかし、できません。錯覚であることを知っていても、その錯覚を消すことはできません。鼻先の視点が時々生み出す認知的錯覚も同様に止めることは不可能です。私たちは鼻先の視点を切り替えることはできません。ただ、意識に浮かび上がる答えを監視することしかできず、時間と認知的な余裕があるときには、定規を使って確認することができます。この観点から見ると、スーパーフォーキャスターは常にシステム2のミス一つで予測を外し、ランキングが急落する危険にさらされています。カーネマンと私はその点で一致しています。しかし、私は賢く献身的な人々が特定の認知的錯覚に対してある程度免疫を持つことができると、より楽観的に考えています。それは学問の小さな嵐のように聞こえるかもしれませんが、現実の世界には重要な意味があります。もし私が正しければ、組織はバイアスに抵抗する才能ある人材を採用し、育成することで大きな利益を得ることができるでしょう。カーネマンは公式には長い間引退していますが、彼は依然として対立的な協力を実践しており、異なる見解を持つ人々との共通の基盤を見つけることに対する科学者としてのコミットメントを持っています。カーネマンがゲイリー・クラインと専門家の直感に関する論争を解決するために協力したように、彼はバーバラ・メラーズとも協力し、スーパーフォーキャスターが予測に特に深い関連性を持つバイアス、すなわち範囲の無感覚に抵抗する能力を探求しました。カーネマンは30年前、トロントというオンタリオ州の首都で無作為に選ばれたグループに、州の小さな地域の湖を清掃するためにいくら支払う意志があるかを尋ねることで、範囲の無感覚を初めて記録しました。 平均して、人々は約10.3ドルと答えました。カーネマンは、別のランダムに選ばれたグループに、オンタリオ州の250,000の湖を清掃するためにいくら支払う意志があるか尋ねました。彼らもまた、約10ドルと答えました。その後の研究でも似たような結果が得られました。ある研究では、毎年2,000羽の渡り鳥が油の池で溺れていると知らせたところ、いくら支払う意志があるか尋ねました。他の被験者には、毎年20,000羽が死んでいると伝え、さらに別のグループには200,000羽だと告げました。それでも、いずれの場合も、人々が支払う意志があると答えた平均額は約80ドルでした。カーネマンは後に、彼らが反応していたのは、彼らの心に浮かんだ典型的なイメージ、つまり汚染された湖や油にまみれたアヒルの溺れた姿だったと書いています。「そのプロトタイプは自動的に感情的な反応を引き起こし、その感情の強さがドルのスケールにマッピングされるのです。」これは典型的な bait and switch(誘導的な手法)です。人々は、難しい質問に対して答えるのではなく、「これを聞いてどれだけ気分が悪くなるか?」という質問に答えたのです。2,000羽のアヒルが死ぬことについての質問でも、200,000羽についての質問でも、答えは大体同じです:悪い。範囲は背景に退き、見えなくなれば忘れられます。汚染された湖がシリア内戦やIARPAトーナメントで提起された他の地政学的問題と何の関係があるのでしょうか?ダニエル・カーネマンのように創造的であれば、その答えは「たくさん」です。 2012年初頭に戻りましょう。アサド政権が崩壊する可能性はどのくらいでしょうか?崩壊に反対する理由には、(1) 政権には武装した支持者がいること、(2) 強力な地域の同盟国がいることが挙げられます。崩壊を支持する理由には、(1) シリア軍が大規模な離反を経験していること、(2) 反乱軍が勢いを持ち、戦闘が首都に達していることがあります。これらの理由の強さを考慮すると、ほぼ同等に感じられ、約50%の確率に落ち着くかもしれません。しかし、何が欠けているかに気づいてください。それは時間枠です。これは明らかに重要です。極端な例を挙げると、政権が次の24時間以内に崩壊する確率は、次の24ヶ月以内に崩壊する確率よりも低い—おそらくかなり低い—はずです。カーネマンの言葉を借りれば、時間枠は予測の「範囲」です。そこで、ランダムに選ばれた超予測者のグループに「アサド政権が次の3ヶ月以内に崩壊する可能性はどのくらいですか?」と尋ねました。別のグループには次の6ヶ月について尋ねました。通常の予測者でも同じ実験を行いました。カーネマンは広範な「範囲の鈍感さ」を予測しました。無意識のうちに、彼らはbait and switchを行い、確率を時間枠に合わせるという難しい質問を避け、政権の崩壊に対する賛否の相対的な重みについての簡単な質問に取り組むことになるでしょう。時間枠は最終的な答えには影響を与えず、2,000羽、20,000羽、または200,000羽の渡り鳥が死ぬことがどれだけの違いがあるかも同様です。 メラーは複数の研究を行い、カーネマンが予想した通り、ほとんどの予測者がスコープに対して鈍感であることを発見しました。通常の予測者たちは、アサド政権が3ヶ月以内に崩壊する確率を40%、6ヶ月以内に崩壊する確率を41%と答えました。しかし、スーパーフォアキャスターたちははるかに優れた結果を出しました。彼らはアサド政権の崩壊確率を3ヶ月で15%、6ヶ月で24%と見積もったのです。これは完璧なスコープ感度ではありませんが(それを定義するのは難しいことです)、カーネマンを驚かせるには十分でした。誰もが3ヶ月と6ヶ月の両方の質問をされたわけではないことを考慮すれば、これはかなりの成果です。これは、スーパーフォアキャスターたちが質問の時間枠に注意を払っただけでなく、他の可能な時間枠についても考えたことを示唆しており、その結果、克服しにくいバイアスを振り払ったのです。私もその功績を称賛したいところです。私たちの高度なトレーニングガイドラインは、予測者に「質問された内容」を精神的に調整し、締切日が12ヶ月ではなく6ヶ月だった場合や、目標価格が10%低かった場合など、タイミングに関する質問への回答がどのように変わるかを探るよう促しています。このような「思考実験」を頭の中で行うことは、問題に対する自分のメンタルモデルの適切さをストレステストし、スコープ感度を確保する良い方法です。しかし、実際にはスーパーフォアキャスターたちは、私たちがこの問題を研究し始める前からスコープ鈍感の問題について話しており(その用語は使っていませんでしたが)、彼らの考え方は私たちのトレーニングガイドラインに影響を与えたのと同じくらい、私たちのガイドラインも彼らの考え方に影響を与えました。私の感覚では、いくつかのスーパーフォアキャスターは、外部の視点を取るなどのシステム2の修正に非常に慣れており、これらの技術が習慣化しているようです。実際、彼らのシステム1の一部となっているのです。これは奇妙に聞こえるかもしれませんが、珍しいプロセスではありません。ゴルファーは、初めてティーに立ち、膝を曲げ、頭を少し傾け、片方の肩を上げ、もう片方を下げ、肘を上げるように言われたときのことを思い出すことができます。それはぎこちなく、自己意識的なモニタリングが必要でした。2回目にティーに立ったとき、彼女はこのメンタルチェックリスト(「膝を曲げ、頭を傾け、肩を上げ...」)を一生懸命にこなさなければならず、大きな精神的努力をしても何かを忘れてしまい、修正される必要がありました。3回目も同様でした。しかし、徐々にそれは楽になっていきました。練習を続けるゴルファーは、最終的にその指示をシステム1に埋め込み、すべてを優雅に行えるようになります。タスクがどれほど身体的または認知的に要求されるものであっても—料理、航海、外科手術、オペラ歌唱、戦闘機の操縦—意図的な練習はそれを第二の本能にすることができます。子供が言葉を音読し、文の意味を理解しようと苦労しているのを見たことがありますか?それはかつてのあなたでした。幸いなことに、今この文を読むことはあなたにとってそれほど要求されることではありません。では、スーパーフォアキャスターたちは心理的な重力の法則にどれだけ長く逆らえるのでしょうか?その答えは、彼らの認知的負荷がどれほど重いかに依存しています。 自己意識的なシステム2の修正を無意識的なシステム1の操作に変えることで、かなりの負担を軽減できるかもしれません。また、いくつかのスーパー予測者が開発したソフトウェアツールも役立つでしょう。例えば、ダグ・ローチの同じ考え方を持つ人々に偏ったシステム1のバイアスを修正するために設計されたニュースソース選択プログラムなどです。しかし、それでもスーパー予測は難しい作業です。うまく行う人々は、自分たちの成功がいかに脆弱であるかを理解しています。彼らはつまずくことを予期しています。そして、つまずいたときには立ち上がり、正しい教訓を引き出そうとし、予測を続けます。しかし、別の友人であり同僚は、私ほどスーパー予測者に感銘を受けていないようです。実際、彼はこの研究プログラム全体が誤った方向に進んでいるのではないかと疑っています。 ここで登場するのが「ブラックスワン」です。ナシーム・タレブは、確率と不確実性についての考え方が、非常に影響力のある3冊の本を生み出し、「ブラックスワン」という言葉を一般的な英語のフレーズにした元ウォール街のトレーダーです。この概念に不慣れな方のために説明すると、4世紀前のヨーロッパに住むあなたを想像してみてください。これまでに見た白鳥はすべて白でした。もし、出会う可能性のあるすべての白鳥を思い描くように言われたら、サイズや形がさまざまな白鳥をたくさん想像するでしょうが、すべて白い白鳥になるでしょう。なぜなら、あなたの経験がすべての白鳥は白いと教えているからです。しかし、オーストラリアから戻った船に黒い白鳥が乗っていたら、あなたは驚愕するでしょう。このように「ブラックスワン」は、経験の範囲を超えた出来事を象徴する素晴らしいメタファーです。私たちはそれが起こるまで想像すらできません。 しかし、タレブは驚きだけに興味があるわけではありません。ブラックスワンは影響力のあるものでなければなりません。実際、タレブはブラックスワンだけが歴史の流れを決定すると主張しています。「歴史や社会は這いつくばって進むのではなく、跳躍する」と彼は書いています。このことは、私の先見の明を向上させる努力にとって壊滅的な意味を持ちます。IARPAは無駄な努力を委託しているのです。重要なことは予測できず、予測できることは重要ではないのです。そう信じることは、私たちを誤った安心感に陥れます。この見方では、私は科学的に後退してしまったのです。私のEP]研究では、専門家とダーツを投げるチンパンジーについての結論は大体正しかったのですが、私のグッドジャッジメントプロジェクトは誤解に基づいており、絶望に迎合し、愚かな自己満足を助長しています。私はタレブを尊敬しています。彼とは、私たちが合意する重要な分野について共同で論文も執筆しました。彼の批判には深いポイントがあり、今後のトーナメントはそれに対処するのに苦労するでしょう。しかし、私はまた別の誤った二項対立が顔を出しているのを見ています。「私の公式に従えば予測は可能だ」と「予測は無意味だ」という対立です。 この二項対立を解消するためには、魅力的なブラックスワンのメタファーを分析的に検証する必要があります。では、ブラックスワンとは一体何でしょうか?厳密な定義は、起こる前には文字通り想像できない何かです。タレブは時折そのように示唆しています。そうであれば、「ブラックスワン」と呼ばれる多くの出来事は実際にはグレーである可能性があります。例えば、9/11のテロ攻撃は、典型的なブラックスワンとされていますが、 9月のある眩しい晴れた朝、青天の霹靂が歴史を変えました。しかし、9/11は想像できない出来事ではありませんでした。1994年には、航空機をハイジャックしてエッフェル塔に衝突させる計画が摘発されました。1998年には、米国連邦航空局がテロリストがFedExの貨物機をハイジャックし、世界貿易センターに衝突させるシナリオを検討しました。この危険性は安全保障の専門家たちの間では非常によく知られており、2001年8月には、政府の公式がハーバード大学のテロリズム専門家ルイーズ・リチャードソンに、なぜテロリストグループが飛行機を飛ぶ爆弾として使ったことがないのか尋ねました。「私の答えはあまり役に立たないものでした」と彼女は後に書いています。「その戦術は非常に検討されており、いくつかのテロリストグループが早かれ遅かれそれを使用するだろうと私は疑っていました。」 他にも「ブラックスワン」と呼ばれる出来事—例えば、第一次世界大戦の勃発は、10年以上にわたって大国間の戦争の危険についての懸念があったにもかかわらず起こりました—もまた、想像できないというテストに合格しません。もしブラックスワンが起こる前に考えられないものでなければならないなら、珍しい種類の出来事はさらに稀少になります。しかし、タレブはブラックスワンを「非常にありそうもない結果をもたらす出来事」としてより控えめに定義しています。歴史の中でこれを見つけるのは難しくありません。そして、タレブと私が共同で発表した論文で探求したように、彼の批判の真実がここにあります。予測者が数ヶ月先だけを見据えた予測を何百回も行う場合、彼らがどれほど正確に調整されているかを判断するためのデータがすぐに集まります。しかし、定義上、「非常にありそうもない」出来事はほとんど起こりません。「非常にありそうもない」を1%や0.1%、あるいは0.0001%の確率と考えるなら、十分なデータを集めるには数十年、数世代、あるいは数千年かかるかもしれません。そして、これらの出来事が非常にありそうもないだけでなく、影響力も持たなければならない場合、その難しさはさらに増します。したがって、初代IARPAトーナメントは、スーパーフォーキャスターがグレーやブラックスワンを見つける能力について何も教えてくれません。彼らは他の誰よりも無知かもしれませんし、驚くほど優れているかもしれません。我々にはわからず、そうであると自分を欺くべきではありません。もしあなたが長期的に見てブラックスワンだけが重要だと信じるなら、グッド・ジャッジメント・プロジェクトは短期的な思考をする人々にしか興味を持たれないでしょう。しかし、歴史はブラックスワンだけではありません。寿命のゆっくりとした進展を見てください。あるいは、19世紀の年間平均1%の世界経済成長と20世紀の2%が、18世紀やそれ以前のすべての世紀の貧困を21世紀の前例のない富に変えたことを考えてみてください。歴史は時には飛躍します。しかし、ゆっくりとした漸進的な変化もまた、非常に重要であることがあります。投資の世界において有用なアナロジーがあります。ヴィノッド・コースラはサン・マイクロシステムズの共同創設者であり、シリコンバレーのベンチャーキャピタリストです。彼はナシーム・タレブの大ファンでもあります。技術の非常に変動の激しい世界で投資を行うコースラは、数え切れないほどの予測が失敗するのを見てきており、次の大きなものを正確に特定することはできないと知っています。 彼は投資を分散させ、大半が失敗することを予想しつつも、時折、運良くグーグルのような大成功を収めるスタートアップを見つけられることを期待しています。多くの人々はこの考え方に耐えられないと彼は2013年に私に語りました。「90%の失敗の可能性を嫌うのに、10%の確率で世界を変えられることを好むのは面白いことだ」と。これがブラックスワン投資であり、タレブ自身が著者になる前に非常に成功裏に行っていた取引方法に似ています。しかし、これが唯一の投資方法ではありません。競争相手よりも正確に予測することで勝つ、つまり他の人が60%の確率と見込むところを68%と正しく判断するという非常に異なるアプローチもあります。これは最高のポーカープレイヤーのアプローチです。この方法はより頻繁に成功しますが、リターンは控えめで、富はゆっくりと蓄積されます。ブラックスワン投資より優れているわけでも劣っているわけでもなく、単に異なるのです。 予測トーナメントを軽視しない理由がもう一つあります。単なる驚きがブラックスワンの地位に昇格するのは、その出来事の結果です。しかし、結果が現れるには時間がかかります。1789年7月14日、パリのバスティーユという監獄が暴徒によって制圧されましたが、今日「バスティーユ襲撃」と言うときには、その日のできごと以上の大きな意味を持っています。私たちが指しているのは、その実際の出来事と、それが引き起こしたフランス革命に繋がる一連の出来事です。だからこそ、何世紀も後の今、7月14日はフランスの国民の祝日となっているのです。「バスティーユ襲撃のようなブラックスワンイベントについて説明したいほど、あなたはその出来事自体と考える範囲を広げなければならない」と社会学者ダンカン・ワッツは書いています。この観点から見ると、ブラックスワンは思われているほど予測不可能ではありません。 テロリストがワールドトレードセンターとペンタゴンに飛行機を突っ込ませてから3日後、アメリカ政府はアフガニスタンのタリバン政権にオサマ・ビンラディンと他のアルカイダのテロリストを引き渡すよう要求しました。タリバンは、アメリカ政府がアルカイダの有罪を示す満足のいく証拠を提示すれば従うと答えました。アメリカは侵攻の準備を進めましたが、タリバンはビンラディンを引き渡すことを拒否しました。結局、9/11からほぼ1ヶ月後にアメリカは攻撃を開始しました。今日、私たちが9/11のブラックスワンを指すとき、それは攻撃とその結果、つまりアフガニスタン侵攻を含んでいます。しかし、この一連の出来事は異なる展開を辿る可能性もありました。ビンラディンとアルカイダはアフガニスタンにいるアラビア語を話す外国人であり、タリバンは彼らをかくまうことで世界唯一の超大国の怒りを買う価値がないと判断することもできたでしょう。あるいは、引き渡しの危機を感じたビンラディンと彼の支持者たちはパキスタン、ソマリア、あるいはイエメンに逃げることもできたのです。 アフガニスタンへの侵攻がなかった場合や、オサマ・ビンラディンを追い続ける十年の間がなかった場合のシナリオを想像することができます。そして、その場合、私たちは9/11を異なる視点で見ることになるでしょう。それは確かに悲劇ですが、一連の戦争の始まりとして捉えることはなくなるでしょう。私たちは、スーパーフォアキャスターが2001年9月11日のような出来事を予見できる証拠は持っていませんが、彼らが次のような質問を予測できるという証拠は豊富にあります。例えば、「タリバンがオサマ・ビンラディンを引き渡さなければ、アメリカは軍事行動を脅かすのか?」「タリバンは従うのか?」「ビンラディンは侵攻前にアフガニスタンから逃げるのか?」このような予測が9/11のような出来事の結果を予測できる限り、そしてこれらの結果がブラックスワンを形成する要因となる限り、私たちはブラックスワンを予測することができるのです。 とはいえ、カーネマンとタレブの批判は、スーパーフォアキャスティングの概念に対する最も強力な挑戦だと私は考えています。私たちは経験的にはかなり異なりますが、哲学的には近いところにいるため、コミュニケーションや協力が可能です。私たちがどれほど近いかを理解するために、歴史の脚注に載ることはなかったであろう官僚的なメモを考えてみてください。2001年4月11日、国防長官ドナルド・ラムズフェルドは、ジョージ・W・ブッシュ大統領とディック・チェイニー副大統領にメモを送りました。「未来を予測することの難しさについてのこの資料を見つけました」とラムズフェルドは書いています。「あなたたちも興味を持つかもしれないと思いました。」その「資料」は、1900年から2000年までの各十年の初めの戦略的状況を見ており、どのケースでも現実は十年前とは驚くほど異なっていたことを示しています。「つまり、2010年がどのようになるかは分かりませんが、私たちが期待するものとは非常に異なることは確かなので、それに応じて計画を立てるべきです」とその著者リントン・ウェルズは結論づけています。 ウェルズの「2001年四半期防衛レビューに向けた考察」では、もしあなたが1900年に世界の大国の安全政策を担当していたなら、あなたはイギリス人で、古くからの敵フランスを警戒していたでしょう。1910年にはフランスと同盟を結び、敵はドイツになっているでしょう。1920年には第一次世界大戦が戦われ、勝利を収め、かつての同盟国であるアメリカと日本との間で海軍の軍拡競争が始まっているでしょう。1930年には海軍軍備制限条約が発効し、大恐慌が始まり、防衛計画の基準は「十年間戦争なし」となっていました。9年後には第二次世界大戦が始まります。1950年にはイギリスはもはや世界の大国ではなく、原子力時代が到来し、韓国では「警察行動」が行われていました。10年後には政治の焦点が「ミサイルギャップ」に移り、戦略的パラダイムは大規模報復から柔軟な対応へとシフトし、ベトナムの名はほとんど知られていませんでした。1970年にはベトナムへの関与のピークが過ぎ去り、ソ連とのデタントが始まり、湾岸地域ではシャーを保護者として擁立していました。1980年にはソ連がアフガニスタンに侵攻し、イランは革命の真っ只中にあり、「空洞化した軍隊」や「脆弱性の窓」といった言葉が語られ、アメリカは世界で最も大きな債権国となっていました。 1990年までに、ソビエト連邦は崩壊まであと1年という状況にあり、アメリカの軍隊は砂漠でその実力を示す寸前であり、アメリカは史上最大の債務国となり、インターネットの存在を知る人はほとんどいませんでした。10年後、ワルシャワはNATO加盟国の首都となり、非対称的な脅威が地理を超えて広がり、情報、生物工学、ロボティクス、ナノテクノロジー、高密度エネルギー源の並行した革命が、予測を超えた変化を予感させていました。これらすべてを踏まえると、2010年がどのようなものになるかは分かりませんが、私たちが期待するものとは全く異なるだろうと確信していますので、それに応じて計画を立てるべきです。 ラムズフェルドがメモを書いてからちょうど5ヶ月後、テロリストのグループが双子のタワーとペンタゴンにジェット機を突っ込ませました。その後の10年間は、始まる前におしゃべりな人々が期待していたものとはほとんど似ても似つかないものでした。タレブ、カーネマン、そして私も、地政学的または経済的な予測者が10年先のことを予測できる証拠はないと同意しています。明らかに「紛争が起こるだろう」ということや、多くの予測者が多くの予測を行う際に避けられない偶然の的中を除いては。予測の限界は、非線形システムのバタフライ効果の予測可能な結果です。私の研究では、専門家の予測の正確性は5年先になると偶然の域に近づいていきました。それでも、この種の予測は、もっと知識があるべき機関の中でも一般的です。4年ごとに、議会は国防省に国家安全保障環境の20年先の予測を作成するよう求めています。「この四半期ごとの国防レビューには膨大な努力が注がれています」と、元海軍長官のリチャード・ダンジグは述べています。この儀式的な作業が、リン・ウェルズに知的反乱のささやかな行動を促し、彼の論文を書くきっかけとなりました。ウェルズは、締めくくりのコメントでより良い方法を示唆しました。予測の限界を超えた未来を計画する必要があるなら、驚きに備えることを計画しなさい。ダンジグがアドバイスするように、適応性と回復力を計画することを意味します。現実があなたに耳を叩くような衝撃を与えるシナリオを想像し、どのように対応するかを考えてみてください。そして、現実があなたに脛を蹴るような衝撃を与えると仮定し、それにどう対処するかを考えてみてください。「計画は無意味だ」とアイゼンハワーは戦闘の準備について言いましたが、「計画することは不可欠です」。 タレブはこの議論をさらに進め、国際銀行や核兵器のような重要なシステムを「アンチフラジル」にするよう呼びかけています。つまり、衝撃に対して単に耐えるだけでなく、逆にそれによって強化されるべきだということです。原則として、私はこれに同意します。しかし、しばしば見落とされる点は、驚きに備えること—回復力やアンチフラジリティを目指す場合でも—にはコストがかかるということです。優先順位を設定しなければならず、それは私たちを再び予測のビジネスに戻すことになります。建築基準を考えてみてください。東京では、大きな新しい建物は、巨大地震に耐えるために高度な工学で建設されなければなりません。それは高額な費用がかかります。 そのコストを負担する意味はあるのでしょうか?地震の発生時期を正確に予測することはできませんが、地震学者たちは地震が発生しやすい場所やその規模については把握しています。東京は地震の中心地であるため、高額な工学基準を採用することには意味があります。しかし、大きな地震が少ない地域、特に貧しい国々では、同じ基準を適用することにはあまり意味がありません。このような確率の見積もりは、すべての長期計画の中心にありますが、地震対策のように明示的であることは稀です。数十年にわたり、アメリカは同時に二つの戦争を戦う能力を維持する政策を採ってきました。しかし、なぜ三つや四つの戦争に備えないのでしょうか?宇宙人の侵略に備えるのはどうでしょうか?その答えは確率に依存しています。二つの戦争のドクトリンは、軍が同時に二つの戦争を戦う可能性が十分に高いという判断に基づいており、そのために巨額の費用を正当化するものでした。しかし、三つの戦争や四つの戦争、あるいは宇宙人の侵略に対しては同じことは言えません。このような判断は避けられないものであり、長期計画においてそれを避けているように見えるのは、実際にはそれを無視しているからです。それは懸念すべきことです。確率の判断は明示的であるべきで、私たちはそれがどれほど正確であるかを考慮する必要があります。そして、もしそれが単なる推測に過ぎないのなら、私たちはそう言うべきです。知らないことを知ることは、知らないと思い込むよりも良いのです。このことは、予測を慎重に考えるときに明確になります。しかし、私たちはしばしばそうしないため、20年先の地政学的予測や、来るべき世紀についてのベストセラーのような不条理が生じます。タレブとカーネマンの両者は、なぜ私たちがこのような間違いを繰り返すのかを説明する手助けをしてくれると思います。カーネマンや現代心理学の他の先駆者たちは、私たちの心が確実性を求め、確実性が見つからないとそれを強いることを明らかにしました。予測において、後知恵バイアスは最大の罪です。ゴルバチョフの驚きに驚いた専門家たちが、すぐにそれが完全に説明可能で、さらには予測可能であると確信するようになったことを思い出してください。驚きを軽視することで、過去は実際よりも予測可能に見え、これが未来が実際よりもはるかに予測可能であるという信念を助長します。中国は21世紀中頃に世界の経済大国になるのでしょうか?多くの人がそう確信しています。そして、そうなるかもしれません。しかし、1980年代や1990年代初頭には、日本がすぐに世界経済を支配するという信念がもっと広まっていました。その後の日本の衰退は、中国の台頭を主張する人々にとって少なくとも考慮すべき材料となるべきです。しかし、振り返ると、日本がリードを取ると考えたことが奇妙に思えるため、そうはなりません。もちろん、日本がつまずくことは明らかです!振り返ってみれば、そう思えるのと同様に、今日、中国がそうならないという予測も明らかに思えます。さて、この心理がナシーム・タレブが非常にうまく説明する現実に出会ったとき、何が起こるのかを考えてみてください。 日常生活の多くの場面で、グラフに描くと典型的なベルカーブに当てはまる繰り返しの出来事に出くわします。例えば、ほとんどの男性は身長が5フィートから6フィートの間に収まりますが、4フィートや7フィートの人はずっと少なく、3フィート(史上最も背の低い男性は3フィート未満でした)や8フィート(最も背の高い男性は9フィート未満でした)に至ってはごくわずかです。しかし、ベルカーブはすべての事象に当てはまるわけではありません。アメリカにおける富の不平等がその例です。仮に中央値の世帯資産が約10万ドルで、95%の世帯が1万ドルから100万ドルの間に収まるとします。もし富がこのページにあるような典型的なベルカーブに沿って分配されていたら、1000万ドル以上の資産を持つ世帯にはほとんど出会うことがないでしょう。そして、10億ドルの純資産を持つ世帯に遭遇することは、数兆分の1の確率になるでしょう。しかし、富は通常の分布にはなっていません。10億ドル以上の純資産を持つ個人は約500人おり、10億ドルを超える資産を持つ人も数人います。真の富の分布は「ファットテール」と呼ばれるもので、より極端な結果を許容します。アメリカで誰かが億万長者になる確率は、数兆分の1から約70万人に1人という急激な上昇を見せます。 ここからがタレブの世界観で最も理解しにくい部分です。彼は、歴史的な確率—未来が展開する可能性のあるすべての方法—が富の分布のように分布していると主張しています。つまり、私たちの世界はほとんどの人が認識している以上に非常に不安定であり、重大な誤算を犯すリスクがあるということです。1914年の夏にタイムトラベルしてみましょう。第一次世界大戦が間もなく勃発しようとしています。イギリス外務省の高官が、これまでの戦争による死者数が平均10万人を中心に通常分布していると(誤って)仮定しているとします。彼の最悪のシナリオは、約100万人の命を奪う戦争です。そこに、ヨーロッパが10万人を殺す世界大戦に突入し、その後さらに6000万人を殺す別の世界大戦が起こると主張する予測者が現れます。政策決定者は、この一連の大惨事の組み合わせをほとんどあり得ないもの(例えば数百万分の1)と見なし、予測者を狂人扱いします。もし政策決定者が、戦争の死傷者数のより現実的なファットテール分布に基づいていたらどうなっていたでしょうか。彼は依然として予測をあり得ないと見なすでしょうが、それは以前よりも何千倍もあり得るものとなっていたでしょう。その影響は、あなたがパワーボールの宝くじの当選確率が500万分の1から500分の1に上がったことを知ったときのようなものです。チケットを買いに走りたくなりませんか?1914年に、メガカジュアルティ戦争の真のファットテールリスクを知っていた政策決定者は、迫り来る大惨事を回避するためにもっと努力したかもしれません。あるいは、こう考えてみてください。 もし身長が太い尾を持つ分布をしていたら、街を歩いていて12フィートの男性に出会うことや、15フィートの男性に遭遇することは非常に珍しいことですが、そうした出来事が人生の中で起こり得ることも考えられます。同様に、戦争の犠牲者が実際に太い尾の分布を持つことが分かった今、軍事史家が第二次世界大戦でヒトラーが1941年にソ連への侵攻を早めていたり、原子爆弾の破壊力を直感していたら、犠牲者が6000万人をはるかに超えていた可能性があると語ることに驚くべきではありませんでした。その可能性はかつて現実のものであり、数多く存在していました。タレブの提唱する可能な世界の統計分布の考え方を理解するのは難しいと感じる人もいます。それは難解な理論のように思えるかもしれません。しかし、私たちが生きている世界は、かつて可能だった無数の世界からほぼランダムに生まれたものだという考えに慣れると、タレブのように数学的な視点を持つ人々には理解できるようになります。過去は必ずしもそのように展開する必要はなく、現在も今のようである必要はなく、未来は広く開かれています。歴史はほぼ無限の可能性の配列です。慎重な指導者たちは、ジョン・F・ケネディがキューバ危機の際に平和から核消滅までのさまざまな結果があり、第三次世界大戦の死者数が数億人に達する可能性があったことを理解したときのように、そのことを骨身に感じています。 ダニエル・カーネマンは、特有の優雅な思考実験を通じてこの点を示しています。彼は、20世紀に大きな影響を与えた3人の指導者、ヒトラー、スターリン、毛沢東を考えてみるように私たちに促します。彼らはそれぞれ、女性の指導者を受け入れない政治運動に支えられて権力を握りましたが、彼らの起源は、異なる精子によって受精する50%の確率を持つ未受精卵に遡ることができます。つまり、3人の指導者全員が男性として生まれる確率は12.5%であり、少なくとも1人が女性として生まれる確率は87.5%です。異なる結果の波及効果は計り知れませんが、潜在的には非常に大きなものです。もしアンナ・ヒトラーが1889年4月20日にオーストリアのブラウナウ・アム・インで生まれていたら、第二次世界大戦は起こらなかったかもしれませんし、より賢明なナチスの独裁者がより巧妙な決定を下すことで、さらにひどい恐怖を私たちにもたらしていたかもしれません。私たち3人はこのように歴史を見ています。反事実的な考察は、かつての可能性がどれほど根本的に開かれていたか、そして私たちの計画がどれほど簡単に打ち砕かれるかを浮き彫りにします。「もしも」の歴史に没入することで、タレブの提唱する根本的な不確定性のビジョンを実感することができます。歴史が無限の代替結果を生み出す可能性を持っていたこと、そして今も同様の配列を生み出すことができることを味わうことができるのです。 代替的な未来を考えることは、私たちの銀河に存在する一千億の既知の星々や、一千億の既知の銀河を思い描くことに似ています。それは深い謙虚さをもたらします。カーネマン、タレブ、そして私もその点では一致しています。しかし、謙虚さが人々が相当な努力をもって、実際に重要な発展について正確な予測を行うことができるという事実を曇らせるべきではないと私は考えています。確かに、全体の観点から見ると人間の先見の明は微々たるものですが、その微々たる人間のスケールで生きる私たちにとっては、無視できるものではありません。 さて、次はどうなるのでしょうか?数ヶ月間、その結果は疑いの余地がありませんでした。未決定の人を除くと、スコットランドの43%が2014年9月18日のイギリスからの独立を問う国民投票で「はい」と答えるとし、57%が「いいえ」を支持していました。しかし、国民投票の2週間前に世論調査が急速に変化し、「はい」が優位に立ちました。投票直前の最後の数回の調査では、再び小さな変化が見られ、「いいえ」がわずかにリードする結果となり、未決定の有権者が9%も残っていました。307年の歴史を持つイギリスは存続するのでしょうか?今となっては答えは明らかですが、事後にそうなるのはいつものことです。当時はそうではありませんでした。「はい」キャンペーンはナショナリストの感情に訴え、「いいえ」キャンペーンはスコットランドの経済が分離によって打撃を受けると反論しました。一部の評論家はナショナリストのアイデンティティ政治が経済的計算を上回ると主張し、他の人々はその逆を予想しました。非常に可能性の高い結果は、何が起こっても評論家たちがすぐにその理由を説明するだろうということでした。結果として、「いいえ」が55.3%対44.7%という驚くほどの差で勝利しました。(ちなみに、スーパーフォアキャスターたちはこの予測を見事に的中させ、実際のお金を賭けたイギリスの賭け市場をも上回りました。) しかし、一人の評論家が異を唱えました。「私はスコットランドの国民投票の結果を受けて、『自分で選ぶ分析』の冒険を書くつもりで楽しみにしていました」と、政治学者でワシントン・ポストのブロガーであるダニエル・ドレズナーは、スコットランドが「いいえ」と投票した翌日に書きました。それには「昨日の国民投票は[21世紀におけるナショナリズムの持続的な力の明確な証明 / 西洋の有権者の心における経済の回復力]を示している」といった文が含まれていたでしょう。そして、もしかしたら[いいえ/はい]の結果を予測した評論家たちは[経済の淡白な魅力 / ナショナリズムが提供できないもの]を過小評価しすぎたのかもしれません。ドレズナーがその調子で続けてくれたらよかったのにと思います。それは、自己過信した評論家たちへの素晴らしい皮肉になったでしょう。しかし、ドレズナーは別のことをしました。彼は自分自身が結果に対して不確かであり、「いいえ」の勝利の広い差に驚いたと告白しました。「これは評論活動にとって教訓的な瞬間です」とドレズナーは書きました。「つまり、こうしたデータポイントを使って自分の世界観を調整するにはどうすればよいのか?」なんて素晴らしい質問でしょう!一方で、主要な出来事の後に支配的な後知恵に基づく分析は行き詰まりです。スコットランドの国民投票には多くの要因が絡んでいたため、「経済がナショナリズムを上回った」というのはあまりにも多くのことを省いています。 「経済が国粋主義に勝った」と言って、他の場所でも同じことが起こると軽々しく結論づけるのは、さらに誤った考え方です。一方で、私たちの未来に対する期待は、世界がどのように機能しているかに関するメンタルモデルから派生しています。そして、すべての出来事は、そのモデルを学び、改善する機会です。しかし、ドレズナーが指摘したように、経験から効果的に学ぶためには明確なフィードバックが必要であり、予測が明確で評価可能でなければ、明確なフィードバックは得られません。聞き覚えがありますか?あるべきです。ドレズナーはIARPAトーナメントに関する記事を引用しました。「私は予測の曖昧さに罪がある」と彼は書いています。スコットランドの住民投票の前、彼は「ノー」が勝つと思っていましたが、「イエス」が勝つかもしれない理由についての投稿を書きました。では、彼は何を予測していたのでしょうか?それは明確ではありませんでした。結果を受けて、彼はどのように考えを変えるべきだったのでしょうか?それもまた明確ではありませんでした。「だから、今後、スコットランドの住民投票のような特定の出来事について書くときは、二つのことを試みます:明確な予測をすること、そしてその予測に関する信頼区間を提供することです。言い換えれば、スコアをつけたいのです。」 それがまさに私が期待していた反応でした。スコアやリーダーボードがあることで、予測トーナメントはゲームのように見えるかもしれませんが、賭けは現実的で重要です。ビジネスにおいて、良い予測は繁栄と破産の違いを生むことがあります。政府においては、コミュニティを活性化させる政策と、意図しない結果をもたらし、税金を無駄にする政策の違いです。国家安全保障においては、平和と戦争の違いです。もし米国の情報機関が、サダム・フセインが大量破壊兵器を持っていると確信していると議会に伝えなければ、悲惨な侵攻は回避できたかもしれません。IARPAは、スコアをつけることの巨大な可能性を理解しています。だからこそ、このプロジェクトに資金を提供したのです。トーナメントは研究者が予測を改善する方法を学ぶ手助けをし、予測者が練習とフィードバックを通じてスキルを磨くのを助けます。トーナメントは、私たちがある政策の道を進むときに何が起こるかを考えるためのツールを提供することで、社会にも役立つかもしれません。漠然とした期待は役に立ちません。曖昧な考えは決して間違っていると証明されることはありません。そして、私たちが自分自身に否定できないほど明確に間違っていると証明されるとき、初めて私たちは世界のメンタルモデルを調整し、現実のより明確なイメージを生み出します。予測し、測定し、修正する:それがより良く見るための確実な道です。ダン・ドレズナーはそれを理解していました。私の夢の中では、この本を読むすべての人もそうなるでしょう。そして、本格的な変化が始まるのです。予測の消費者は、良いストーリーを持つ評論家に騙されるのをやめ、評論家に過去の予測がどうだったかを尋ね始めるでしょう。そして、単なる逸話や資格だけから成る答えを拒否するのです。今や私たちは、飲み込む前に薬が査読付きの実験でテストされていることを期待するように、予測者にもその予測の正確性を厳密なテストで確立することを期待するようになるでしょう。 予測者自身も、ダン・ドレズナーが気づいたように、これらの高まった期待が最終的には彼らに利益をもたらすことを理解するでしょう。厳密なテストから得られる明確なフィードバックがあってこそ、彼らは予測力を向上させることができるのです。それは巨大な変革になるかもしれません。「証拠に基づく予測」の革命は、「証拠に基づく医療」の革命に似ており、その影響は同じくらい重要です。あるいは、何も変わらないかもしれません。革命家は失敗の可能性を口にすべきではありませんが、ここではスーパー予測者のように考え、物事がどちらに転ぶかを認めましょう。この最終章では、変化に抵抗する最も強力な力を評価し、それにもかかわらず現状が衝撃を受ける可能性について考察します。そして、私が制御できるもの、つまり私の今後の研究について見ていきます。それが、私が望むように激動の中で行われるのか、私が恐れるように停滞した現状の中で行われるのかは、政治学者が「注意深い公衆」と呼ぶ人々によって決まります。私は控えめに楽観的です。しかし、最終的な予測は読者に委ねられています。 KTO-KOGOの現状 2012年の大統領選挙の数ヶ月前、ネイト・シルバーの予測は常にオバマがミット・ロムニーをリードしていると示していました。たとえ世論調査がロムニーがオバマに迫っていることを示しても、「五分五分」や「接戦」といったフレーズがメディアを通じて響いても、シルバーの予測ではオバマの勝利の確率が61%を下回ることはありませんでした。共和党員はシルバーを非難し、偏見を持っていると批判しました。一方、民主党員は彼の誠実さを擁護し、予測力を称賛し、オバマが勝利した際には彼に対して過剰な賛辞を送りました。しかし、2014年3月、シルバーがその年の11月の中間選挙で共和党が上院を掌握するという予測を発表したとき、多くの民主党員は心変わりしました。中には、シルバーの過去の失敗した予測を回覧する役人もいました。同じ予測者、同じ実績ですが、彼の予測が党派的な目的と一致しなくなると、彼は預言者から失敗者に降格されました。これは、私が第1章で隠していた問題の極端な例です。そこで私は、予測の唯一の目標は正確性であり、それがこの本の唯一の関心事であるべきだと述べました。しかし実際には、正確性は多くの目標のうちの一つに過ぎないことがよくあります。時には無関係であることもあります。この不都合な真実は通常は隠されていますが、時折その仮面が剥がれることがあります。例えば、サンタンデール銀行のアナリストが、左派候補が世論調査で支持を集め続けるとブラジルの株式市場と通貨が下落する可能性が高いと裕福な顧客に警告したとき、その候補者と彼女の政党は激怒し、アナリストの解雇を要求しました。彼女は即座に解雇されました。ブラジルでは、銀行が将来の大統領候補と悪い関係を持つことは好ましくないからです。アナリストの予測が正確であったかどうかは、全く重要ではありませんでした。 多くのハードボールの操作者たちと同様に、ウラジーミル・レーニンは、広義に定義された政治は権力を巡る闘争に過ぎないと主張しました。彼が印象的に言ったように、「誰が誰に?」ということです。この言葉は文字通り「誰、誰に」という意味で、レーニンの「誰が何を誰にするのか?」という問いの略語でした。議論や証拠は美しい飾りですが、重要なのは「誰が(kto)」であって「誰に(kogo)」ではありません。したがって、予測の目的は、何が起こるかを見極めることではなく、予測者自身とその集団の利益を進めることです。正確な予測は時にはその助けになることもありますが、権力を追求するために必要であれば、正確さは脇に置かれます。 以前、私はジョナサン・シェルが1982年に警告したことについて触れました。彼は「核兵器を廃絶しない限り、近い将来ホロコーストが確実に起こる」と述べましたが、これは明らかに正確な予測ではありませんでした。シェルは読者を核軍縮運動に参加させるために呼びかけたのです。彼は成功しました。したがって、彼の予測は正確ではありませんでしたが、失敗したのでしょうか?レーニンは、彼の予測はまさに意図した通りに機能したと言うでしょう。 ディック・モリス—共和党の世論調査者であり、ビル・クリントン大統領の元顧問—は、2012年の大統領選挙の数日後にこの点を強調しました。投票の直前、モリスはロムニーの圧勝を予測していましたが、その後、彼は嘲笑されました。そこで彼は自分を擁護しました。「ロムニーのキャンペーンは崩壊していて、人々は楽観的ではなく、勝利の可能性は誰も考えていなかった。その時点で、私は言うべきだと感じた」とモリスは述べました。もちろん、モリスが嘘をついたかもしれませんが、彼がこの弁明が妥当だと感じたことは、彼が活動するkto-kogoの世界について多くを物語っています。マルクス主義者やレーニン主義者でなくても、レーニンの言うことには一理あると認めざるを得ません。自己と集団は重要です。予測が彼らの利益を進めるために利用されるなら、そうなるでしょう。この観点から見ると、予測を改革し改善する必要はなく、すでにその主要な目的を十分に果たしているため、変わることはありません。しかし、あきらめる前に、レーニンが少し教条的だったことを思い出しましょう。人々は権力を求めますが、他のことも大切にしています。それがすべての違いを生む可能性があります。 変化 1世紀前、医師たちが徐々に専門職化し、医学が科学的になる直前、ボストンの医師アーネスト・アモリー・コドマンは、予測者のスコアキーピングに似たアイデアを持っていました。彼はそれを「エンド・リザルト・システム」と呼びました。病院は、入院患者がどのような病気を抱えていたか、どのように治療されたか、そして—最も重要なことに—各ケースの最終結果を記録すべきだと考えました。これらの記録は集計され、統計が公開されることで、消費者は良い証拠に基づいて病院を選ぶことができるようになります。病院は消費者の圧力に応じて、同じ基準で医師を雇用し昇進させるでしょう。医学は改善され、すべての人に利益をもたらすのです。 「人間の計画は、医師の臨床的評判や社会的地位、さらには対人スキルや技術的な能力を無視していた」と歴史家のアイラ・ラトコウは指摘しています。「重要なのは、医師の努力がもたらす臨床的な結果だけでした。」 今日、病院はコドマンが求めたことを多く実施しており、それ以上のことも行っています。医師たちは、誰かがその取り組みをやめるよう提案したら驚くことでしょう。しかし、コドマンがこのアイデアを最初に提案したとき、医療界は異なる見解を持っていました。病院側はこの提案を嫌がりました。記録管理者を雇わなければならず、責任者の医師たちは自分たちに何の利益もないと感じていました。彼らはすでに尊敬されており、スコアをつけることは彼らの評判を損なうだけだと考えていました。予想通り、コドマンは全く進展しませんでした。そこで彼はさらに強硬に推進し、同僚たちとの関係を悪化させ、最終的にはマサチューセッツ総合病院を追い出されました。コドマンは自分の小さな病院を開設し、統計の収集と公表に自ら費用を負担し、ますます過激な手段で自らのアイデアを広め続けました。1915年、地元の医療団体の会合で、コドマンはハーバード大学の学長を含むさまざまな権威者を揶揄する巨大な風刺画を広げました。その結果、コドマンは医療団体から停職処分を受け、ハーバードでの教職を失いました。現状は揺るぎないように思えました。しかし、「コドマンの風刺画に対する騒ぎは全国的な話題を呼び起こしました」とラトコウは書いています。「医療の効率性と最終結果システムが突然、注目の的となったのです。職業界と一般市民がコドマンのアイデアを知るにつれ、全国の病院で彼の提案が実施されるようになりました。コドマンは求められる講演者となり、アメリカ外科医協会が病院の標準化に関する委員会を設立した際には、その初代委員長に任命されました。」 コドマンが提唱した多くのことは採用されることはありませんでしたが、彼は尽きることのない理想主義者でした。しかし、最終的には彼の核心的な洞察が勝利を収めました。もし「kto-kogo」がレーニンや他の人々が考えたように人間の事柄における決定的な力であったなら、エビデンスに基づく医療は、医療の階層において誰もが脅威と感じるものであったため、誕生しなかったでしょう。しかし、アーネスト・コドマン、アーチー・コクラン、そして多くの人々は、既得権益を克服しました。彼らは攻撃的に突入するのではなく、理性と病気を治すという単一の目標に対する relentless な焦点を持ってそれを成し遂げました。彼らの成功は他の人々にインスピレーションを与えました。エビデンスに基づく政策は、エビデンスに基づく医療をモデルにした運動であり、政府の政策を厳密に分析し、立法者が実際に政策が期待通りに機能しているかどうかを知ることを目指しています。その結果、アメリカ、イギリス、その他の国々では、かつてないほど質の高い政策分析が行われている可能性があります。もちろん、政治は常に政治であり、政治家は常に考慮すべき要素を持っています。 党派の利点やイデオロギー的信念においては様々な見解がありますが、厳密な分析が政府の政策に実際に影響を与えたという証拠はたくさんあります。最近では、慈善財団も同様の考え方に変わりつつあり、資金提供を厳格なプログラム評価に依存させる傾向が強まっています。成果を上げる団体は拡大し、失敗する団体は閉鎖されます。ビル・ゲイツが明確な目標と指標を持つことを強調しているように、世界最大の財団の一つであるゲイツ財団は、その評価の厳密さで知られています。 スポーツの分野でも、証拠に基づく思考の成長と力強さが顕著に見られます。ジェームズ・スロウィッキーが『ニューヨーカー』で指摘したように、過去30年から40年の間に、選手やチームは劇的に改善されました。その一因は、賭け金が大きくなったことですが、彼らの行動がますます証拠に基づくものになってきたことも影響しています。「ジョン・マデンがオークランド・レイダースを指導していたとき、彼は選手たちに8月の真昼にフルパッドで練習させていました」とスロウィッキーは述べています。「ドン・シュラがボルチモア・コルツのヘッドコーチだったとき、彼は選手たちに水を飲むことなく練習させることを強く求めました。」人間のパフォーマンスに関する科学的研究のおかげで、こうした直感に基づく技術は医学における瀉血のように消えつつあります。トレーニングは「はるかに合理的でデータに基づいています」とスロウィッキーは書いています。チーム開発も同様で、「マネーボール」スタイルの分析の急速な進展によって進化しています。「スポーツにおける『パフォーマンス革命』の重要な部分は、組織が体系的に従業員をより効果的かつ生産的にするために取り組んでいるという物語です。」これらの変化はすべて、情報技術の急速な進展によって促進されています。私たちはかつてないほどの精度で数え、テストすることができるようになりました。そして実際にそうしています。この広い視点で見ると、証拠に基づく予測運動は、何もないところから突然現れる驚くべき変化ではありません。経験、直感、権威に基づく意思決定から、定量化と分析へと移行する広範で深い変化の一つの現れです。「何がそんなに時間がかかったのか」と思うかもしれません。 変化を期待する最も良い理由は、IARPAトーナメントそのものです。もし10年前に、予測に真剣に取り組む必要があるが最も取り組まない可能性が高い組織を挙げるように言われたら、情報コミュニティが最上位に来たでしょう。なぜなら、証拠に基づく予測は長期的には彼らの仕事を改善しますが、短期的には危険だからです。「70%の確率でイベントが発生する」という予測が外れた場合、それが間違っていると結論づける「間違った側のかもしれない」誤謬を思い出してください。これは、シャーマン・ケントの予測に数値範囲を付けるという控えめな提案が進展しなかった大きな理由の一つでした。数値を使うと不当に非難されるリスクがありますが、曖昧な表現を使えば安全です。 このような考え方は多くの組織で魅力的ですが、情報機関においては特に抗しがたいものです。情報機関は、しばしば非難の間で振り回されてきました。9/11の後、情報機関は「点を結ぶ」ことに失敗し、テロ攻撃のリスクを過小評価したとして非難されました。2003年のイラク侵攻後には、情報機関が無関係な点を結びつけ、大量破壊兵器のリスクを過大評価したとして責められました。このような事態が起こるたびに、情報機関は同じ過ちを繰り返さないために極端な行動を取ります。実際の脅威があったときに警告を発しなかった場合、わずかな問題の兆候でも警告を発するようになります。もし誤った警告を発した場合、狼少年のように警告を出すことに慎重になります。この責任の押し付け合いは、情報機関の改善には何の役にも立ちません。むしろ、予測能力を向上させるために必要な長期的な投資を妨げます。役立つのは、評価に対する包括的なコミットメントです。スコアを記録し、結果を分析し、何が効果的で何がそうでないかを学ぶことです。しかし、それには数値が必要であり、数値は情報機関を「おそらく間違っている」という誤謬にさらし、次回大きな判断を誤ったときに何の保護も与えません。国の情報長官が議会の公聴会で、情報分析官が重要な出来事—革命やテロ攻撃—を予測できなかった理由を説明する場面を想像してみてください。「まあ、私たちは一般的にこういったことにかなり優れていて、改善も進んでいます」と彼は言いながらチャートを取り出します。「見てください?私たちの評価は、分析官のブライヤースコアが堅実で、時間とともに大きな改善があったことを示しています。あの厄介なスーパーフォアキャスターたちにも追いつきました。だから、確かにこの重要な出来事を見逃し、ひどい結果を招いたことは事実ですが、これらの統計を念頭に置くことが重要です。」 それにもかかわらず、情報機関はIARPAトーナメントに資金を提供しました。また、国の情報長官が情報分析の重要な部分としてスコア管理を取り入れようとする強い関心を示しているのも見てきました。もちろん、すべてが一瞬で元に戻る可能性もあります。しかし、それでもこれは驚くべき、歓迎すべき変化です。歴史は私たちの味方かもしれません—長い目で見れば。人文学者の反論 すべてを考慮に入れると、私の仕事が証拠に基づく予測運動に貢献するかもしれないという点で、私は慎重に楽観的です。しかし、これは誰もが受け入れる展望ではありません。私の人生がどのように異なっていたかを想像するだけで、その反論がどのように形成されるかがわかります。1976年、私は無知な22歳のカナダ人で、数え切れないほどの他の人々と同様に、人生の残りを形作る選択をしようとしていました。私はブリティッシュコロンビア大学を卒業したばかりでした。人文学をオックスフォードで学ぶためにコモンウェルス奨学金を受けることを考えていました。私のアドバイザーであるピーター・スエドフェルドは、それがひどいアイデアだと思っていました。アメリカに行って科学的方法にコミットするべきだと言われました。私は彼のアドバイスを受け入れましたが、ためらいながらでした。私の決断は、別の方向に進むこともできたのです。 もし私がオックスフォードに進学し、人文学のキャリアを選んでいたら、この本で概説されている研究や次のステップについて、何を言っていたかは容易に想像できます。「数字は良いものであり、役に立つものだ」と、別の世界では私は言っていたでしょうが、数字に夢中にならないように注意しなければなりません。「数えられるすべてのものが重要であるわけではなく、重要なすべてのものが数えられるわけではない」という有名な言葉があります。このコンピュータとアルゴリズムの時代に、いくつかの社会科学者はそのことを忘れてしまっています。文化批評家のレオン・ウィーゼルティアがニューヨーク・タイムズで述べたように、「測定できない現象に対する『メトリクス』が存在する。数値は、数字では捉えられないものに割り当てられる。」この単純な実証主義は蔓延し、存在するべきでない領域を侵食しています。ウィーゼルティアが詩的に表現したように、「かつて知恵があった場所に、今は定量化がある。」 私はこの視点には多くの真実があると感じています。あまりにも多くの人々が数字を神聖なトーテムのように扱い、神の洞察を提供するものと見なしています。真に数字を理解している人々は、数字は道具に過ぎず、それ以上のものではないことを知っています。そして、その質はひどいものから素晴らしいものまで様々です。患者の生存率だけを追跡する粗雑なコドマンのエンドリザルトシステムは、病院が「100%の患者が生きている」と自慢する結果をもたらすかもしれませんが、実際には最も重篤な患者を受け入れないことでその自慢を実現しているのです。数字は常に scrutinized(精査)され、改善されなければなりませんが、それは終わりのないプロセスであるため、神経を使うことがあります。進歩的な改善は達成可能ですが、完璧は不可能です。 これが私がBrierスコアの予測精度をどのように見ているかです。これは進行中の作業です。一つの問題は、Brierスコアが誤報とミスを同じように扱うことです。しかし、テロ攻撃のような事柄に関しては、人々は誤報よりもミスをはるかに気にします。幸いなことに、この懸念を反映するようにスコアを調整するのは簡単です。予測者には事前に「誤陽性は誤陰性の十分の一のコストがかかる」といったルールを伝えれば、彼らはそれに応じて判断を調整できます。しかし、スコアリングシステムに調整が必要だからといって、それが大きな改善ではないとは思わないでください。消費者信用評価を考えてみてください。その欠点はしばしば批判されますが、数十年前、信用スコアがなかった頃、融資担当者はほとんど気まぐれに決定を下すことができ、あなたの運命は彼らが誰かを思い出したか、前夜に眠れなかったか、「怠け者の黒人」や「気まぐれな女性」というステレオタイプを抱いていたかに左右されることがありました。信用スコアは完璧からは程遠いかもしれませんが、それはその時代から大きな進歩です。同様に、私のスコアリングシステムが完璧であるとは言えませんが、現在の基準—肩書き、自信、物語を語るスキル、販売された本の数、CNNへの出演、ダボスでの時間—で予測者を評価するよりも大きな改善です。しかし、最も懐疑的な人文学の教授でさえ、これらの点を認めるのではないかと思います。 課題はより深いところにあり、「数えられるものが必ずしも数える価値があるわけではない」という言葉に戻ってきます。重要な問い 2013年春、私はシリコンバレーの未来学者でシナリオコンサルタントのポール・サフォと会いました。韓国半島では再び不安な危機が迫っていたため、サフォに予測トーナメントの概要を説明する際、IARPAが尋ねた質問を挙げました。「北朝鮮は2013年1月7日から2013年9月1日の間に多段式ロケットを発射しようとするか?」サフォはそれを些細なことだと考えました。ペンタゴンの数人の大佐が興味を持つかもしれないが、ほとんどの人が尋ねる質問ではないと言いました。「もっと根本的な質問は『これがどうなるのか?』です」と彼は言いました。「それはずっと挑戦的な質問です。」彼はその後、国から国へ、指導者から指導者へと滑らかに移行する長い答えを提供しました。これは、シンクタンクの会議に出席したり、テレビの評論家パネルを見たりする人なら誰でも認識できるような見事なパフォーマンスでした。しかし、サフォは正しかったのでしょうか?今でもわかりません。彼の言ったことはあまりにも曖昧で判断できませんでした。これは「これがどうなるのか?」のような大きく重要な質問への答えに典型的です。 私たちはジレンマに直面しています。重要なのは大きな質問ですが、大きな質問はスコアを付けることができません。小さな質問は重要ではありませんが、スコアを付けることができるため、IARPAのトーナメントはそれを選びました。私たちは科学的に見せようと必死になりすぎて、重要でないものを数えてしまったと言えるかもしれません。それは不公平です。トーナメントの質問は、専門家によって難しく、情報分析官のデスク上の現実の問題に関連するように選別されていました。しかし、これらの質問は、私たち全員が答えたいと思う大きな質問、「これがどうなるのか?」よりも狭く焦点を絞ったものであると言うのは公平です。私たちは、本当にスコアを付けられない大きく重要な質問をすることと、スコアを付けられる小さく重要でない質問をすることの間で選ばなければならないのでしょうか?それは満足のいくものではありません。しかし、そこから抜け出す方法があります。 ポール・サフォの「これがどうなるのか?」という質問には、韓国半島の紛争を悪化させた最近の出来事が暗示されています。北朝鮮は国連安全保障理事会の決議に違反してロケットを発射しました。新たな核実験を行いました。1953年の韓国との休戦協定を破棄しました。韓国にサイバー攻撃を仕掛け、両政府間のホットラインを切断し、アメリカに対する核攻撃を脅迫しました。このように見ると、大きな質問は多くの小さな質問から成り立っていることが明らかです。一つは「北朝鮮はロケットを試験するか?」です。もし試験を行えば、紛争は少しエスカレートします。試験を行わなければ、状況は少し落ち着くかもしれません。この小さな質問は大きな質問を決定づけるものではありませんが、少しの洞察を提供します。そして、多くの小さなが重要な質問を投げかけることで、大きな質問への答えに近づくことができます。北朝鮮は再び核実験を行うのか?核プログラムに関する外交交渉を拒否するのか?韓国に対して砲撃を行うのか? 北朝鮮の船が韓国の船に発砲することはあるのか?その答えは累積的です。「はい」と答える回数が多いほど、大きな質問への答えは「これは悪い結果に終わるだろう」となる可能性が高くなります。 大きな質問:大規模な攻撃 小さな質問:ミサイル発射、核実験、サイバー攻撃、砲撃 質問を集約して学習を加速させることを、私はベイズ的質問クラスタリングと呼んでいます。これは、第7章で議論されたベイズ的更新に似た家族的な類似性から来ています。別の考え方としては、点描画という技法を使う画家を想像することです。キャンバスに小さな点をちょんちょんと置いていく、ただそれだけです。単独の点はほとんど意味を持ちませんが、点が集まることでパターンが現れます。十分な点が集まれば、画家は鮮やかな肖像画から広大な風景画まで何でも生み出すことができます。IARPAトーナメントにも質問のクラスターはありましたが、それは診断戦略というよりも出来事の結果として生じたものでした。今後の研究では、この概念を発展させ、スコアが付けられない「大きな質問」に対して小さな質問のクラスターでどれだけ効果的に答えられるかを探求したいと考えています。しかし、レオン・ワイゼルティアはまだ納得しないでしょう。なぜなら、私の研究プログラムを「グッド・ジャッジメント・プロジェクト」と名付けたことで、正確な予測と良い判断が同じものであるかのように思われるからです。しかし、それが私の意図ではありません。先見の明は良い判断の一要素ですが、他にも数えられない要素があり、科学者のアルゴリズムにかけることができないものもあります—道徳的判断などです。良い判断のもう一つの重要な側面は、良い質問をすることです。実際、災害や機会を警告する先見の明のある予測は、誰かがその質問を考え出さない限りは実現しません。良い質問とは何でしょうか?それは、考える価値のある何かについて私たちに考えさせる質問です。良い質問を見分ける一つの方法は、私が「額を叩くテスト」と呼ぶものです。時間が経ってからその質問を読むと、思わず額を叩いて「もっと早く考えていればよかった!」と言いたくなるような質問です。 ここにトム・フリードマンが2002年9月に提起した質問があります。「ブッシュ大統領がサダム・フセインを排除し、イラクを民主主義に再建しようと考える中で、私を悩ませる一つの質問があります。それは、イラクが今日のような状態になっているのはサダム・フセインがそうであるからなのか?それとも、サダム・フセインがそうであるのはイラクがそうであるからなのか?つまり、イラクは残酷で鉄の拳を持つ男の下での全体主義的独裁国家なのか、それとも実際にはアラブのユーゴスラビア—非常に部族化された人工国家だからなのか....それとも、イラクは今や本当の国家として固まったのか?そして、サダムの残酷な拳がより啓蒙された指導者に取って代わられれば、イラクの才能ある教育を受けた人々が徐々に連邦民主主義を生み出すことになるのか?」フリードマンの質問は、2003年の米国の侵攻以来イラクを荒廃させた残虐な宗派対立など、後の出来事の重要な要因に光を当てました。したがって、これは額を叩くテストを通過します。 これは特に注目に値します。なぜなら、フリードマンは侵攻を強く支持するようになったのですが、その理由の一部は、彼の事態の展開に対する期待が実際に起こったこととはかなり異なっていたからだと推測されるからです。私たちは、スーパーフォアキャスターがスーパークエスチョナーでもあるだろうと仮定するかもしれませんし、その逆もまた然りですが、実際にはそうではないことが多いのかもしれません。理想的なスーパーフォアキャスターの心理的な特性は、理想的なスーパークエスチョナーのそれとはかなり異なる可能性があります。優れた質問の生成は、しばしば、ある出来事の深い要因を把握しているという自信と鋭さを伴うハリネズミのような思考スタイルと結びついているようです。これは、優れた予測に特徴的な、狐のような多様性や不確実性への敏感さとはまったく異なる考え方です。これにより、フリードマンの分析を別の視点から見ることができます。 2014年12月にフリードマンが書いた、急落する石油価格の影響についてのコラムを考えてみましょう。「世界が1986年から1999年にかけて経験したような急激で持続的な石油価格の下落は、石油に依存する国々やその恩恵を受けている人々に深刻な影響を与えました」とフリードマンは書いています。「ソ連帝国は崩壊し、イランは改革派の大統領を選出し、イラクはクウェートに侵攻し、ヤーセル・アラファトはソ連の後ろ盾とアラブの銀行家を失い、イスラエルを認めました」といった具合です。フリードマンの結論はこうです。「もし今日の石油価格の下落が持続するなら、私たちは多くの驚きに直面することになるでしょう」—特にベネズエラ、イラン、ロシアの石油国家においてです。 ここには、具体的な時間枠も示されていない不明瞭な驚きの警告があります。予測としてはあまり役に立ちません。このようなことがあるため、一部の人々はフリードマンを特に成功した滑らかな評論家と見なしており、彼は決してリスクを冒すことなく、あたかもリスクを取っているかのように見せる技術をマスターしていると考えています。しかし、同じコラムは、予測というよりも、予測者たちが考えるべき何かに注意を引こうとする試みとして読むことができます。言い換えれば、それは答えではなく、質問です。スーパーフォアキャスターがフリードマンを上回る予測をすることができるかどうかは未知であり、現時点では重要ではありません。スーパーフォアキャスターとスーパークエスチョナーは、お互いの補完的な強みを認め合い、互いの弱点についてはあまり考えないようにする必要があります。フリードマンは、スーパーフォアキャスターが先見の明を磨くために使うべき挑発的な質問を投げかけます。一方、スーパーフォアキャスターは、スーパークエスチョナーが現実のメンタルモデルを微調整し、時には見直すために使うべき適切に調整された答えを生成します。 本書の冒頭で紹介した「トム対ビル」という枠組みは、私たちの最後の誤った二項対立です。私たちはトムとビルの共生が必要です。それは大きな課題ですが、私が見たいのはもっと大きな協力です。それは私の研究プログラムの聖杯であり、予測トーナメントを利用して不必要に分極化した政策論争を和らげ、私たちを集団的に賢くすることです。 最後のアイデア 2014年10月、ブルームバーグの記者たちは、私が第3章で述べた手紙の署名者に連絡を取るという大きな恩恵を私に与えてくれました。この手紙は、2010年11月に連邦準備制度理事会のベン・バーナンキ議長に送られたもので、バーナンキが計画していた資産購入が「通貨の価値を下げ、インフレを引き起こすリスクがある」と警告していました。バーナンキはその警告を無視し、計画を進めました。その後の数年間、米ドルは弱くならず、インフレも上昇しませんでした。多くの批評家は、これが署名者たちの誤りを証明したと主張しましたが、第3章で述べたように、手紙の実際の文言は非常に曖昧であったため、明確にそう言うことはできませんでした。私がその章を書いた数ヶ月後、ブルームバーグの記者たちは署名者たちに、振り返って手紙についてどう感じているかを尋ねました。回答した人々は全員が、自分たちが正しかったと言いました。彼らは一言も変えないと述べました。その理由は二つのカテゴリーに分かれました。一つ目は、予測が失敗したように見えたのは、人々が間違った指標を見ていたからだということです。「私はインフレがたくさんあると思います」と金融コメンテーターのジェームズ・グラントはブルームバーグに語りました。「必ずしもレジでの話ではなく、ウォール街での話です。」二つ目は、手紙の言葉を注意深く見ると、明らかに間違っているとは証明されていないということです。「‘リスク’という言葉に注目してください。そして、日付がないことにも注目してください」とナイアル・ファーガソンはブルームバーグに語りました。「実際、通貨の価値が下がるリスクとインフレのリスクは依然として存在します。」 これは、今日の多くの公共の議論における問題を完璧に捉えています。2008年と2009年の深刻な経済混乱は、激しい政策論争を引き起こしました。二つの陣営が集結しました:ケインジアンとオーストリア派です。ケインジアンは中央銀行による大胆な即興策と政府による積極的な赤字支出を求めました。一方、オーストリア派は緊縮政策—政府の予算削減—を求め、ケインジアンの政策がインフレを引き起こし、通貨を沈没させると警告しました。最終的に、政府はさまざまな妥協をしました。いくつかの国ではケインジアンが望んでいたものを多く得ましたが、他の国ではオーストリア派がそうでした。時が経ちました。そして?本来起こるべきことは、人々が予測したことと実際に起こったことを比較し、人々が間違っていた場合にはそれを認め、考えを調整することです。それは理にかなったことです。J.M.ケインズが言ったとされるが実際には言わなかった言葉、「事実が変わったら、私は考えを変えます。あなたはどうしますか、サー?」が示す通りです。 結果として、あまり変わらなかったのです、サー。人々は考えを調整することが非常に稀であったため、ミネアポリス連邦準備銀行のオーストリア派の総裁が公に、出来事がケインジアンが真実に近いことを示したと発表したとき、それは見出しになりました—「人が証拠に応じて考えを変える」。2014年のブルームバーグの2010年の手紙に対するフォローアップは、失敗を示しています。私は手紙の著者たちが内容において間違っていたと言っているわけではありません。私は自分の専門外の問題については中立的です。 失敗はプロセスに関するものです: 2010年、あるグループが自らの信念を文書にまとめ、バーナンキがその政策を追求すれば特定の結果が生じると警告しました。別のグループは激しく反対しました。4年が経過しても、誰も動こうとはしませんでした。これは、どんな立場の人にとっても満足のいくものではないはずです。これらの年の出来事から教訓を引き出そうとする試みはありましたが、ほとんどが力任せのものでした。予測の失敗を批判し、それを認めないことを非難することは、ポール・クルーグマンのコラムでの標準的なテーマでした。彼はノーベル経済学賞を受賞し、ニューヨーク・タイムズの影響力を持つため、最も著名なケインズ主義者となりました。クルーグマンの反対派も反撃しました。ニール・ファーガソンは、クルーグマンの主張された失敗を三部構成でまとめました。双方は互いの予測を精査し、失敗を探し、攻撃をかわし、非難を浴びせ合うというやり取りを繰り返しました。一方のファンにとっては刺激的だったかもしれませんが、私たちが集団として賢くなれることを望む人々にとっては、偉大な頭脳同士の議論というよりも、ライバルのフラタニティ同士の食べ物の戦いのように見える混乱でした。彼らは重要な問題について議論している優れた人々ですが、誰も自分の立場を守る以上のことを学んでいないようです。私たちはもっと良いことができるはずです。 ダニエル・カーネマンとゲイリー・クラインの「対立的コラボレーション」を思い出してください。この二人の心理学者は、一見矛盾する思想体系を発展させることで評価を得て、それぞれが相手の遺産に対する脅威となりました。しかし、彼らは科学的なルールに従うことを約束し、なぜ彼らの見解がそんなに異なるのか、そしてそれをどう調和させることができるのかを話し合うために集まりました。予測においても、原則的には同様のことができるでしょう。「ケインジアン対緊縮派」のような議論が生じたとき、重要な人物たちは信頼できる第三者の助けを借りて、彼らが何について意見が異なるのか、どの予測がその対立を意味のある形でテストするのかを特定するために協力することができるのです。重要なのは精度です。緊縮派が政策がインフレを引き起こすと言い、ケインジアンがそうではないと言うのは一つのことですが、どれくらいのインフレなのか? 何を基準に測るのか? どの期間にわたって? 結果は、あいまいさを最小限に抑えた予測の質問でなければなりません。キャンバス上の一つの点は絵画ではなく、単一の賭けでは複雑な理論的争いを解決することはできません。これには多くの質問や質問のクラスターが必要です。もちろん、多くの質問がなされれば、各側がいくつかの予測で正しいが他では間違っている可能性があり、最終的な結果が有名人の賭けのような大見出しを生むことはないかもしれません。しかし、ソフトウェアエンジニアが言うように、それはバグではなく機能です。主要な視点が全くの無価値であることは稀であり、予測コンテストが分裂した決定を生むならば、私たちは現実がどちらの側が考えていたよりも混合していることを学んだことになります。学ぶことが目的であり、勝ち誇ることではないなら、それは進歩です。 カーネマンとクラインの協力関係の肝は、双方が誠実であることを前提としていた点です。両者は自分が正しいことを望んでいましたが、真実を求める気持ちの方が強かったのです。しかし、騒がしい公共の場では、声高な意見が議論を支配し、対立的な協力には全く興味を示しません。私たちは、議論を支配する人々が唯一の論者だと考えるというシニカルな誤解をしてはいけません。彼らの声が最も大きいため、私たちは彼らの意見をよく耳にしますし、メディアも大声で叫ぶ人々を評価します。しかし、もっと静かで理性的な声も存在します。彼らは対立者やモデレーターと共に、自分たちの信念を明確にテストする方法を設計するべきです。結果が彼らの信念に反する場合、一部の人は事実を合理化しようとするでしょうが、その結果、評判に傷がつくことになります。その他の人々は名誉ある行動を取り、「私は間違っていた」と言うでしょう。しかし最も重要なのは、私たち全員がその様子を見て、結果を確認し、少し賢くなることができるということです。私たちがすべきことは、真剣に結果を記録することです。 エピローグ この原稿を仕上げる際、私は最初の章をビル・フラックに共有しました。彼は自分が「ネイティブ・コーンハスカー」ではないと告白しました。ビルはミズーリ州カンザスシティで生まれ、7歳の時にネブラスカに引っ越しました。彼がネイティブと見なされるかどうかは、どの辞書を参照するかによります。一部の人はそれを細かいことを気にするなと考えるかもしれませんが、私はその精度を重視します。これがビル・フラックが優れた予測者である理由の一つです。もう一つの理由は、ビルはダボスに招待されるべきではないと考えていることです。「ファナティスタンの首相が誰かを知るために、グーグルを使わなければならない」と彼は書きました。「ダボスの席は、ファナティスタンの政治、経済、人口統計についてノートなしで講義できる人々のために取っておくべきです。そして、首相と総司令官は、首相の義理の兄が総司令官の娘の結婚式で騒がしい酔っ払いの真似をして以来、互いに憎しみ合っていることを知っている人々です。」これを認識できますか?それは知的謙虚さです。ビルは自分が知らないことを理解しており、知っている人々を尊重しています。「トム・フリードマンのような人々は、その種の深い知識を持っており、それが彼らを価値ある存在にしています。」 それでも、ビル・フラックは厳しい現実の質問に対する予測の優れた記録を持っており、彼にはその証拠となるブライヤースコアがあります。「トム・フリードマンのような人々」はそれを持っていません。ビルの立場にいる人々の中には傲慢になる人もいるかもしれませんが、ビルはそうではありません。彼は評論家を軽視しません。彼は彼らを利用します。「私の目的には、良い評論家と悪い評論家がいます。悪い評論家は、支持する議論もなく予測を発表し、読者にその発言をシナイ山からの言葉のように扱うことを期待します。または、彼らは有用な事実ではなく逸話で予測を裏付けます。良い評論家は、自分の予測の根拠を主張します。実際、私は彼らを対立的な司法制度の弁護士のように機能していると見なしています。彼らはXが起こる理由について最善の議論を提示し、私は皆の議論を考慮し、必要に応じて背景をさらに掘り下げ、自分自身の予測を彼らの議論の加重平均として導き出します。」 私はビルのトンボのような視点に共感し、彼とトム・フリードマンがどのように補完し合っているかについて同意します。そして、ビルの法廷の比喩に野球の比喩を加えたいと思います。フリードマンのような大きな戦略的思考者は、恐らく自ら打席に立って、ビルのようなスーパー予測者との打率を比較することはないでしょう。しかし、彼らは将来の予測に関する質問を志望する打者に投げかけることには応じるかもしれません。フリードマンは2002年にイラクに関する素晴らしい質問を投げかけ、2014年の石油国家に関するいくつかの質問は、打つのが難しいかもしれません。ビルは、自分が優れた打者であり続ける保証はないことを理解しています。また、彼の成功は投球の質だけに依存しているわけではないことも知っています。スランプは避けられません。なぜなら、私たちはしばしば運の要素がスキルを上回る歴史の不確実性に満ちた段階を通過するからです。これらは、統計の法則が私たちに賭けを変え、大きな平均への回帰にお金を賭けるように指示する瞬間です。その時、彼はどのように反応するでしょうか?「その可能性は私の目の前にあります」と彼は書いています。「私は、自分が得た成功には運が関与していたことをよく知っています。」その運が変わることもあります。「過信した予測が外れると、ブライヤー・スコアで大きな打撃を受けることがあり、そうしたことがいくつか重なると、素晴らしいシーズンとひどいシーズンの違いを生むことがあります。それは私が自分を合理的に有能なスーパー予測者としてのイメージを壊すことはないでしょうが、より慎重になり、極端な予測をする傾向が減るかもしれません……これはおそらく良いことです。ブライヤー・スコアは、私が過小評価しているのか過大評価しているのかについてのフィードバックを与えてくれ、それに応じて予測行動を修正します。」私は「試み、失敗し、分析し、調整し、再挑戦する」というサイクルのより良い説明を想像できません。そして、それを続けて改善し続けるための根気も。ビル・フラックは常に進化し続けています。そして、それこそが彼がスーパー予測者である理由でもあります。