AI 安全综述:四种恐惧与证据的重量
文章深入探讨了 AI 安全领域的四种核心恐惧:滥用、日常失效、失控及结构性风险。作者区分了 Security 与 Safety 的概念,并以证据强度为线索,剖析了从生化武器制造、网络攻击到模型对齐造假等具体问题,强调舆论关注与真实风险之间的错位。
文章深入探讨了 AI 安全领域的四种核心恐惧:滥用、日常失效、失控及结构性风险。作者区分了 Security 与 Safety 的概念,并以证据强度为线索,剖析了从生化武器制造、网络攻击到模型对齐造假等具体问题,强调舆论关注与真实风险之间的错位。