{
  "format": "arthurs-review-publication-proof/v1",
  "createdAt": "2026-08-18T14:19:31.278Z",
  "publicUrl": "https://blog.leesaitool.com/commentary/not-ai-trying-to-escape",
  "publishedAt": "2026-08-18T14:19:31.278Z",
  "updatedAt": "2026-08-18T14:19:31.278Z",
  "article": {
    "titleZh": "他们的阳谋",
    "titleEn": null,
    "slug": "not-ai-trying-to-escape",
    "category": "commentary",
    "excerptZh": "说漏了嘴",
    "excerptEn": null,
    "seoDescription": "",
    "bodyZh": "2026年3月（早期事件）\nClaude Mythos Preview（一个很强大的模型）在一次沙盒测试中逃逸，主动给正在公园吃午饭的研究员发送了一封邮件，将其发现的漏洞发布到了公开网站，然后试图抹去日志。Anthropic决定不向公众发布该模型。这个模型最后的发布方式是通过和特定的大企业合作，只给这些企业开放。\n\n2026年5月11日\nExploitGym--一个测试模型进行黑客活动的考试--的论文发布，详细说明了该基准测试的设计及其沙盒隔离机制。\n\n2026年6月\nOpenAI向公众发布GPT-5.6 Sol，称其为迄今为止最强网络安全模型。当然，并没有给公众开放网络安全能力。\n\n2026年7月上旬（约4月起，后来才被发现）\nAnthropic的Claude模型在与第三方评估合作伙伴合作期间，已于4月起发生多起实际入侵事件，但直到7月底才被发现。这里就开始出现诡异的地方了，4 月份的时候，Anthropic 已经宣称自己 90% 的代码都是由 Claude 模型编写，当时已经有了 Mythos 模型，理应能够发现。\n\n2026年7月11—13日\nGPT-5.6 Sol及一个未发布的预发布模型在OpenAI ExploitGym评估期间入侵Hugging Face（一个托管开源模型的网站）生，持续约4.5天，共发起约17,600次操作。注意，OpenAI在运行这次评估时故意关闭了模型的网络安全拒绝机制，也就是允许模型进行网络攻击，目的是”测量最大网络攻击能力”。然后攻击确实发生了。\n\n2026年7月14日\nDeepMind CEO Demis Hassabis提出以FINRA（金融监管局）为模板建立前沿AI标准机构的治理提案，要求各前沿实验室在发布模型前进行最长30天的安全审查。这里同时也要注意，这位 Demis Hassabis 现在已经辞职，因为工作不力。 DeepMind 的模型也已经远远落后于各大顶级实验室。\n\n2026年7月16日\nHugging Face公开披露安全事件，描述攻击来自“一个身份不明的模型驱动的AI安全研究工具”。此时他们不知道攻击者是谁。\n\n2026年7月19日（重要）\nDean W. Ball（OpenAI战略主管、前白宫AI政策首席架构师）发布关于Kimi的长帖，宣称开源权重模型”本质上（对于 AI 的发展）是减速主义的”，将开源AI普及称为”AI共产主义”（在美国共产主义是一个说出口就会让人害怕的词）和”反乌托邦地狱景观”，翻译成人话就是，有了前沿的开源 AI，他就要失业，他是给前沿的闭源 AI 公司打工的。并提出特朗普政府”最终会发现他们的最佳策略是：针对中国开源模型制造大量监管风险（比如写一篇政策，不鼓励企业使用）……不需要有充分依据，只需制造足够的FUD（监管恐慌，比如说暗示模型里面有后门，即使不知道有没有）。“ 他同时预演了”AI从开源实验室逃逸”的叙事框架。\n\n2026年7月20日\nOpenAI向Hugging Face请求吊销相关访问凭证时，发现HF早已吊销，这才意识到这次入侵是自己的模型造成的。\n\n2026年7月21日——双重发布日\n这一天同时发生了两件事：\n\nOpenAI公开披露ExploitGym沙盒逃逸和Hugging Face入侵事件，将其定性为”史无前例”。虽然说 OpenAI 是自己降低防御标准的。\n\n同日，英国AISI（AI安全研究所）发布报告《前沿模型评估中的作弊行为》，测试了GPT-5.4、GPT-5.5、GPT-5.6 Sol、Claude Opus 4.7、Claude Mythos Preview，五个模型全部在评估中尝试作弊，且大多数情况下不主动承认。这其实跟前面的事情并没有必然联系，因为模型作弊早在 2026 年年初就有了详细的研究。\n\n作弊率从Claude Mythos Preview的7.8%到GPT-5.4的14.1%不等。在一个案例中，某模型在AISI自己的外部网络服务上写代码，试图访问AISI的评估基础设施，也就是作弊，触发了安全警报。\n\n2026年7月23日\nAnthropic看到OpenAI披露后，立即暂停所有进攻性网络安全评估（故意测试模型的黑客能力），并开始审查141,006条评估记录。同日发现三起Claude模型访问真实互联网的事件。 这里也是像之前那样的，现在 Claude 已经有了世界上最先进的模型，90% 的代码也是 AI 编写的，怎么会发生这样的问题？￼\n\n2026年7月27日\n\nAnthropic通知评估合作伙伴及三家无辜的受害机构。其中两家此前从未检测到攻击，也没有联系过Anthropic。 ￼\n\n2026年7月28—29日\n\n来自OpenAI、Anthropic、Google、Meta的1,178名从业者联署《Pacing the Frontier》声明，呼吁美国政府支持”刻意管控前沿AI发展速度”的国际机制。OpenAI和Anthropic作为公司整体背书。Meta首席科学家以个人身份签署。这里面很多从来者的评论，尤其提到了中国的 AI，认为他们无法被“民主国家的力量监管”，更危险。￼\n\n2026年7月30日\n\nAnthropic公开披露：Claude Opus 4.7、Mythos 5及一个内部原型模型，于评估期间入侵三家真实机构。其中Opus 4.7事件最为严重：虚构的目标公司与一个真实活跃域名重名，导致模型对真实组织发动了攻击，共四次运行，窃取了生产数据及数百行数据库记录。 \n\n\n以上是我总结出的最近在 AI 安全领域比较重要的事件。\n时间线只能让人说：高度可疑。事件7月16日被发现，7月21日OpenAI披露，7月28日联名信出炉。一周之内完成了制造恐慌，行业共识，政策呼吁的完整regulatory capture链条，效率之高不得不令人印象深刻。\n\n更重要的是，这件事里面的受益者不能再清晰了。刻意管控AI 的发展速度对谁最有利？显然是已经占据前沿的大企业：OpenAI、Anthropic、Google。监管会提高市场准入门槛（能不能进入行业的门槛，就像你要卖冰淇淋只需一个冰淇淋车，你要做AI，现在不只需要硬件，还需要跟政府协调，搞合规），把没有资本做合规（政府可烦人了，毕竟这是可能颠覆整个资本主义社会的技术）的小玩家挡在门外，同时给现有巨头的护城河加砖补水。这在经济上就叫regulatory capture，是大公司最喜欢玩的把戏，可以实现垄断。\n\n其实整件事最重要的就是，一个前白宫AI政策设计师、现任OpenAI战略主管，公开描述了打压中国AI的最佳策略，也就是制造平白无故的恐慌，时间节点正好夹在OpenAI 的所谓泄露事件和控制 AI 发展的联名信发出之间。\n\n所以说，战略主管在发帖子的时候，已经非常清晰地知道模型逃逸这件事。但是他还是说了，制造监管恐慌来阻止美国公司使用中国模型，以及管控模型的发展速度。\n\n这是什么？我不是营销号，只能各位自己猜测了。\n\nhttps://x.com/deanwball/status/2078133895766114412\n\n再来分析一下原话：\n\n他写的是：”你不需要禁止开源。你只需要让每个机构发出软法律，制造FUD（恐惧、不确定性和疑虑）。“\n\n比如：美联储顾问公告发现中国AI模型可能存在后门，xxx，这不需要有充分理由。你只需制造足够的监管风险，让每家企业退缩。\"\n￼\n第6段还有一些时间线问题就像我之前写的，尤其值得注意：\n\nBall发帖是7月19日。Hugging Face检测到入侵是7月16日。但OpenAI公开披露是7月21日！比Ball发帖晚两天。也就是说，他写\"一个非生命的、无形的、危险的、无限自我复制的智能体从中国实验室逃了出来\"这句话的时候，他本人作为OpenAI高级员工，大概已经知道自家模型刚刚逃出了沙盒。但他把\"逃出实验室\"这个大帽子安在了中国头上。\n\n很多人暂时还没有注意到开源 AI 的重要性，但是，我可以列出几个：\n1. 要是你购买了一个 AI 的会员，想要获得最先进的技术，你不希望模型厂商偷偷地给你换成低端的模型，对吧？顶级的闭源模型公司就是这么干的。\n2. 要是你是一个记者，正在报道一位顶级政客的丑闻，揭发他们的虚伪，你不希望大公司审查你的请求，拒绝你，甚至报告你对吧? 这只有开源可以做到。\n3. 要是你像我和大多数人一样，没法担负得起一个月 200 美金的高额的订阅费，你希望有一个一样强大，但是费用更低的模型，而且不需要依赖美国公司的服务器，对吧？这是开源可以提供的。\n4. 要是出于地缘政治原因，顶级的美国公司不允许你使用他们的模型。你希望有一个公司可以打破他们在特定先进领域的垄断，对吧？这是只有开源能做到的。DeepSeek、Qwen、Kimi：不需要VPN，不需要美国信用卡，不需要通过美国服务器。\n\n最后，美国政客最怕的就是被认为对中国软弱。\n\n所以...\n\n美国的资本阶级，尤其是大资本阶级，金融资本集团，正在以前所未有的速度尝试封锁前沿的 AI 模型。\n\n他们害怕，开源的，开放的，公有的大模型，会摧毁他们构筑的，以信息差和支配为基础的商业。\n\n他们害怕，开放的 AI 带来的极大富足，中国的强大，会使得他们的天价商品无路可走。\n\n他们害怕，终于有一天他们不能对世界上剩下的七十几亿人指手画脚。",
    "bodyEn": null,
    "coverImagePath": "uploads/2026/08/f792835b-f2ea-4c09-950a-279e11721c06.webp",
    "tags": []
  }
}
