人間の承認は13.6%しか機能しない — 承認ダイアログの静かな死と、委任のその先
危険なコマンドを承認前に拒否できた人間は13.6%——Anthropicの統制実験が承認ダイアログの限界を定量化した。Claude Code auto modeデフォルト化の根拠を解剖し、Willisonの反証と、委任状設計・事後監査へ移る人間の役割を実務目線で整理する。
カテゴリ別記事一覧(全3件)
危険なコマンドを承認前に拒否できた人間は13.6%——Anthropicの統制実験が承認ダイアログの限界を定量化した。Claude Code auto modeデフォルト化の根拠を解剖し、Willisonの反証と、委任状設計・事後監査へ移る人間の役割を実務目線で整理する。
許可か拒否かの二択は「全部許可」に崩れる。Fable 5が実装した第三の道=降格に学び、通常運転・昇格・降格・エスカレーションの状態遷移でエージェントを設計する方法を解説する連載第3回。
自動実行と人間承認の境界線をどう引くか。Replit Plan Mode、承認フローのUX設計、監査ログから読み取れるべきもの——過剰な承認はバイパスを誘発する逆説の中で、機能する設計を組み立てる連載②第3回。
GPT-4o・Claude・Geminiなど主要AIエージェントから見た
御社サイトの可読性を、W3C・Schema.org準拠の39項目で自動測定。