ピンカー氏が9月26日に公開書簡。p(doom)20%との対立で一致している4点
2026年9月26日、ハーバード大のスティーブン・ピンカー氏がQuilletteに公開書簡を出しました。破滅確率をめぐる対立の中で双方が一致している監督・人間の介在・停止手段・記録の4点を、発注時の確認項目に落とします。
AI が人類を滅ぼすかどうか、という議論が 2026 年 9 月に一段と目立った。2026 年 9 月 26 日、ハーバード大学の心理学者スティーブン・ピンカー氏が Quillette に公開書簡を発表した。宛先は、ブログ Astral Codex Ten を書くスコット・アレクサンダー氏である。
この種の話題は、発注の現場では「関係のない議論」として扱われがちだ。ただ今回のやり取りは、双方が対立している部分と、双方が一致している部分がはっきり分かれているという点で読む価値がある。一致している側が、そのまま発注時の確認項目になる。

公開されている事実
まず、それぞれが何を書いたかを分けて整理する。
ピンカー氏の公開書簡(Quillette、2026 年 9 月 26 日)
- ペーパークリップ最大化のような破滅シナリオには説得力がないとする。根拠として、どんな知的なシステムも「ある問題は得意で、別の問題は不得意」であり、複数の競合する目標の間でトレードオフを抱えると述べている
- 自分が間違っていた点も挙げている。大規模言語モデルの能力は 2018 年時点の自分の予想より汎用的だったこと、フロンティア企業による「breakneck and sometimes irresponsible(猛烈で、ときに無責任)」なリリースを見込んでいなかったことである
- そのうえで、**現実の危険として bioterrorism(生物テロ)、cyber-sabotage(サイバー妨害)、unconstrained agents(制約のないエージェント)**を挙げている
- 対案として挙げるのは「sober safety engineering(地に足のついた安全工学)」。具体には**独立した監督、事故の義務的な調査、損害に対する責任、人間を介在させること、停止手段(kill switches)**である
アレクサンダー氏の立場(Astral Codex Ten「My AI Opinions」、2026 年 6 月 11 日)
- AI によって人類が滅びる確率(p(doom))を約 20% と見積もっている。本人はこの数字について、社会的に受け入れられやすい丸め方を含んでいるかもしれないとも書いている
- 絶滅を免れても、独裁や不整合などによって人類の可能性が恒久的に損なわれる確率を約 30% としている
- 対応として、解釈可能性と拡張可能な監督を軸にしたアラインメント研究、国際的な開発ペースの調整、そして継続的な監視を並行して進めるべきだとしている
両者のやり取りの経緯(9 月中旬のピンカー氏の主張、それに対するアレクサンダー氏の公開討論の呼びかけ、9 月 26 日の書簡での応答)については、The Decoder が 2026 年 9 月 28 日に報じている。
論点 1. 対立しているのは確率であって、やることではない
並べてみると分かるのは、2 人が争っているのは「どれくらいの確率で最悪のことが起きるか」であって、「何をすべきか」ではないということである。
| ピンカー氏 | アレクサンダー氏 | |
|---|---|---|
| 絶滅の確率 | 低い(懐疑的) | 約 20% |
| 現実の危険 | 生物テロ・サイバー妨害・制約のないエージェント | 不整合なシステム・価値観のずれ |
| すべきこと | 独立した監督・事故調査・損害責任・人間の介在・停止手段 | アラインメント研究・監視・国際的な調整 |
右の列と左の列で、「独立した監督」「継続的な監視」「人間が止められること」は重なっている。確率の見積もりが 10 倍違っても、明日やることの大半は同じになる、という構造である。
これは発注の現場にとって都合がよい。どちらの立場を取るかを決めなくても、共通部分だけを要件に落とせるからだ。
論点 2. 「制約のないエージェント」は今日の見積書の話
ピンカー氏が挙げた 3 つの危険のうち、発注に直結するのは unconstrained agents である。
いま企業が発注している AI エージェントは、外部のシステムに書き込み、メールを送り、在庫を動かす。AIエージェントとはで整理したとおり、エージェントの費用と難易度を決めるのは会話の性能ではなく権限の設計である。権限が広いほど、事故が起きたときの影響範囲も広くなる。
ここで確認すべきは、抽象的な安全性ではない。次の 4 点である。
| 確認すること | 見積書・設計書のどこに出るか |
|---|---|
| 何ができて、何ができないか | 権限一覧・API の呼び出し可能範囲 |
| どこで人間が判断に入るか | 承認フロー・確認画面の有無 |
| 止めるとき、どう止めるか | 停止手段・緊急時の切り替え |
| 後から何が起きたか分かるか | ログの保持期間・記録の粒度 |
この 4 点は、ピンカー氏が挙げた「人間の介在」「停止手段」「事故の調査」をそのまま実装の言葉に置き換えたものである。監視と記録にかかる費用の考え方はAIの監視とオブザーバビリティにまとめてある。
論点 3. 確率の数字は投資判断の根拠にならない
20% という数字は、本人が「丸めを含むかもしれない」と断っている。ピンカー氏の「低い」も定量的な根拠が示されているわけではない。どちらも投資判断に使える種類の数字ではないと考えるのが安全である。
この点は、煽る側にも止める側にも同じように効く。「AGI が来るから今すぐ全部 AI に置き換える」も、「危ないから AI の導入を止める」も、根拠としては同じ強さしかない。判断に使えるのは、自社の業務で測れる数字のほうである。何を任せるかを 4 つの軸でふるいにかける手順はAIに任せる業務の選び方に書いた。
発注者・企業への影響
ここからは見立てである。
1 つ目。この議論が発注に効くとすれば、責任と保険の側からだと考えられる。 ピンカー氏が挙げた「損害に対する責任」は、制度の話であると同時に契約の話でもある。AI が誤った出力をして損害が出たとき、誰が負うのか。この条項は、規制が動く前に取引先や監査から先に聞かれる可能性がある。契約書で見る項目はAI開発の契約書チェックリストに一覧がある。
2 つ目。安全性を掲げる提案の中身は、確認できる形になっているかで見分けるほかないと考えられる。 「安全に配慮した設計」とだけ書かれた提案は、検収できない。権限一覧・承認フロー・停止手段・ログ保持期間という 4 つの具体物に落ちているかどうかが、実質的な差になる。
3 つ目。議論そのものを追う必要は薄いと考えられる。 確率の見積もりは今後も動く。発注側が追うべきは、その議論の結果として制度や契約条件が変わったときであって、論争の途中経過ではない。
見積もりで確認する 3 点
- エージェントの権限一覧が提案に付いているか。できることとできないことが列挙されているか
- 停止手段が設計に入っているか。止めたあとどう業務を回すかまで書かれているか
- ログの保持期間と粒度が決まっているか。事故が起きたとき何を再現できるか
この 3 点は、条件をそろえて複数社に聞くと扱いの差が金額差として出る。案件票を作るところからであれば無料の相見積もりで始められる。
まとめ
ピンカー氏とアレクサンダー氏が対立しているのは確率の見積もりであり、打つ手のほうは大きく重なっている。重なっているのは、独立した監督、人間の介在、停止手段、そして事故を後から調べられる記録である。
発注側がやることは 1 つ。この 4 つを、権限一覧・承認フロー・停止手段・ログ保持期間という確認できる形にして、見積もりの条件に入れること。 確率の議論の決着を待つ必要はない。
参考・出典
- An Open Letter to Scott Alexander(Steven Pinker, Quillette, 2026-09-26): https://quillette.com/2026/09/26/an-open-letter-to-scott-alexander-steven-pinker-ai-alignment-safety/
- My AI Opinions(Scott Alexander, Astral Codex Ten, 2026-06-11): https://www.astralcodexten.com/p/my-ai-opinions
- Harvard psychologist calls for sober AI safety engineering over doomsday rhetoric(The Decoder, 2026-09-28): https://the-decoder.com/harvard-psychologist-calls-for-sober-ai-safety-engineering-over-doomsday-rhetoric/
AI開発の見積もりを、同じ条件で比べる。
条件を整理した 1 枚の案件票で複数のAI開発会社に依頼。初期費用だけでなく、データ整備・API 費・精度検証・保守・権利まで同じ列で比較できます。