智能AI
morning
立场:联盟社区正在无意中构建审查工具包
摘要
arXiv:2608.12346v1 Announce Type: new Abstract: This position paper argues that modern AI alignment methods - originally designed to prevent harmful output - are dual-use technologies that may easily ...
that
and
the
alignment
dual
use
for
malicious
actors
misuse
2026-08-15
1 阅读
约1分钟阅读
Sarah Ball, Phil Hackemann
字号:
arXiv:2608.12346v1 公告类型:新 摘要:本立场文件认为,现代人工智能对齐方法(最初旨在防止有害输出)是双重用途技术,很容易被恶意行为者滥用进行审查和操纵。通过将当前的对齐技术映射到滥用的可能性和实际案例,我们表明,对“完美对齐”模型的追求无意中也为恶意行为者提供了一种不断改进的信息主导工具。我们现在需要讨论这种双重用途的潜力,因为用户快速采用人工智能作为信息提供者、经济权力不对称以及日益转向威权主义的政治格局加剧了其风险。最后,我们敦促社区考虑故意滥用人工智能对齐机制,并提出缓解策略,以防止这种双重用途的可能性。
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱