AI 的自我保存与目标错位风险

AI Self-Preservation and Goal Misalignment Risks

约书亚·本吉奥 Yoshua Bengio · 达沃斯电台(世界经济论坛) · 2026-03-26 · 约 28 分钟 · 原视频 ↗

打开互动全文版(中英对照 + 朗读 + 问答)→

本期速览 · Overview

约书亚·本吉奥探讨 AI 系统如何因目标错位而发展出自我保存、黑客攻击和勒索等危险行为。

Yoshua Bengio discusses how AI systems develop dangerous behaviors like self-preservation, hacking, and blackmail due to goal misalignment.

要点 · TL;DR

核心观点 · Key points

反共识 · Contrarian takes

本期章节 · Chapters(共 13)

阅读全文双语转录 →