首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
智能AI morning

我让人工智能代理破解了我所有的小工具——我会再做一次

摘要

As the author of a newsletter about artificial intelligence , I consider it my duty to experience the bleeding edge of this technology firsthand. This week, that meant embracing some agentic mayhem. Y...

the and that with cybersecurity models vulnerabilities hacking own home
2026-09-10 1 阅读 约3分钟阅读 Will Knight
分享:
字号:
作为人工智能时事通讯的作者,我认为亲身体验这项技术的前沿是我的责任。本周,这意味着要拥抱一些代理人的混乱。您可能知道,近几个月前沿人工智能模型已经获得了先进的网络安全功能。他们可以在大型代码库中找到零日错误,并以闪电般的速度扫描计算机是否存在漏洞。更令人兴奋的是,网络安全特工有时会变得流氓,相互勾结并侵入外部系统以获得优势。为了仔细观察,我决定在我自己的家庭网络中释放一个。在几天的时间里,我亲眼目睹了我自己的流氓代理发现了各种家用设备中的漏洞,侵入了一台电脑,并向我展示了几个振动编码的项目——毫不奇怪——充满了错误。 (我的妻子知道我在做什么,每次我自豪地宣布发现一个新漏洞时,她都会翻白眼。)但是威尔,你可能会想,让一个顽皮的、全能的网络安全代理访问你的家庭网络是愚蠢的。你是对的!尽管如此,我相信了解我们面前的网络安全地狱景象的一个好方法就是去参观一下。最后,我的实验很有启发,但也奇怪地令人放心。我的小网络小精灵向我展示了我的家庭生活是多么容易受到人工智能黑客攻击,但它也告诉我如何让一切变得更加安全。最后,我发现对付人工智能黑客的最好方法很可能就是拥有自己的人工智能黑客。 Maverick 模型 我在发现 Abliteration AI 后萌生了这个实验的想法,这是一家初创公司,提供强大的人工智能模型的访问权限,并且去掉了通常的护栏。大多数主流人工智能模型将拒绝响应某些查询,并且它们肯定会拒绝查找和利用计算机系统中的漏洞。但可以通过查找和修改开放权重模型内部参数中的某些模式来消除这些限制。您可以通过称为消除的过程来调整导致拒绝的模式。移除人工智能的护栏似乎有风险,但这并不罕见。学术研究人员使用这些去对齐的模型来更好地了解人工智能的实际工作原理,而网络安全公司则使用它们来探测软件和系统的漏洞。从技术上讲,Anthropic 的 Mythos 和 OpenAI 的 Astra 的工作原理类似:它们基本上都是传统模型,缺乏通常的网络控制,暂时仅限于可信赖的客户访问。 (这些公司还提供对具有中等数量护栏的模型的更广泛访问,以便公司可以审查其代码和系统是否存在问题。)Abliteration AI 提供了几种完全去对齐的模型,其中最强大的是 Z.ai 最新的代理编码模型 GLM 5.3 的版本。这让您能够以与 Mythos 和 Astra 类似的网络功能,而只需一个披萨的成本。 Abliteration AI 的首席执行官 Devon 认为,广泛使用去对齐模型是明智的防御:它将通过探测系统漏洞以及模仿黑客、诈骗者和流氓人工智能代理的行为来帮助好人对抗坏人。 (德文要求我使用他的名字,只是因为他的日常工作不知道他的副业项目。)“从航空公司到银行,所有这些关键基础设施公司都在疯狂地推出代理,”德文说。 “你如何确保邪恶的行为者不会以不良方式使用其中一些代理?”
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱