首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于

回溯机器访问的更新

2026-09-16 1 阅读 约2分钟阅读 ChrisArchitect
分享:
字号:
【HN用户评论摘要】 > 这是发生的事情。互联网档案馆的 Wayback Machine 受到了大容量自动化流量的冲击,我们已经采取了保护措施以保持服务运行。我非常确定这是抓取工具,它们试图通过点击 Wayback Machine 副本来解决访问原始网站的障碍。令人震惊的行为。除了给这一重要的非营利性互联网基础设施带来的负担之外,我们还看到一些网站选择退出 Wayback Ma 为档案馆的人们提供疯狂的道具。你们是我们在一个以前开放的互联网中需要的英雄,这个互联网正在向邪恶的大军团投降并关闭免费访问。互联网档案馆处于一个非常糟糕的境地,同时受到来自多方的攻击。但是,尽管服务并不一致,但他们仍然保持开放访问。我仍然可以从 Tor 匿名访问,无需 Cloudflare 或其他一些集中式网守向我伸出中指。如果你有闲钱,请考虑不要 人工智能军备竞赛造成如此附带损害,真是令人遗憾。免费资源总是被利用,但围绕人工智能的风险($T)和能力却允许前所未有的滥用。我希望我们能回去...:/我真的没有看到任何解决方案;抓取者甚至可能不介意过多地破坏像 IA 这样的资源,这最终将使它们成为唯一的“权威”知识来源。最好的办法可能是监管,包括。高额(!)罚款,但政治太慢而且太碎片化 我想知道为什么互联网档案馆不需要在访问 Wayback Machine 之前登录。它可能会帮助他们区分人类和机器人,而人类付出的代价却很小。 最近的抓取祸害是否主要是由人工智能公司驱动的?有人知道相关的研究吗?我开始认为,现在大多数网站因限流而难以浏览,是社会被迫承受的人工智能发展的又一个负外部性。 原始链接:https://blog.archive.org/2026/09/15/an-update-on-wayback-machine-access/
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱