Skip to content
TopicTracker
来自 HackerNews查看原文
译文语言译文语言

在人工智能世界中映射人类层面的AI风险

作者正在编制一份文档,旨在系统性地梳理人工智能带来的风险,以及从人类角度可以采取的缓解措施。例如,随着未来AI说服能力可能增强,作者正在探索如何加以应对。该文档为进行中的工作,欢迎感兴趣的读者提供反馈和建议。

背景速读

- 这篇帖子来自 Hacker News 用户 "nl"(Looks Like You 创始人),旨在征集合作者共同绘制"AI 风险中的人为因素"的应对方案地图。作者认为未来 AI 会变得更擅长说服人(persuasion),因此需要提前研究人类这一侧的缓解措施。 - AISI(AI Safety Institute,英国政府下属的 AI 安全研究所)是文中引用的关键机构。2024 年它发布了一份报告,通过实验证明 AI 模型已具备利用人类认知偏误(如认知负荷、情绪操控)进行说服的能力,这引发了学界和监管层的关注。 - "Human side of AI" 是近年来 AI 安全讨论中的一个特定方向:过去大家更关注模型本身的安全(对齐、幻觉等),现在越来越多研究者认为社会层面的韧性——如何让人类不被操控、如何保持判断力——同样是核心风险点。 - 该文档是公开协作的 Google Doc,体现了 Hacker News 社区典型的 "Show & Ask" 文化:抛出一个早期想法,邀请各方贡献,而非发布成熟成果。

相关报道