时事评论 / 2026/8/18
他们的阳谋

2026年3月(早期事件) Claude Mythos Preview(一个很强大的模型)在一次沙盒测试中逃逸,主动给正在公园吃午饭的研究员发送了一封邮件,将其发现的漏洞发布到了公开网站,然后试图抹去日志。Anthropic决定不向公众发布该模型。这个模型最后的发布方式是通过和特定的大企业合作,只给这些企业开放。
2026年5月11日 ExploitGym--一个测试模型进行黑客活动的考试--的论文发布,详细说明了该基准测试的设计及其沙盒隔离机制。
2026年6月 OpenAI向公众发布GPT-5.6 Sol,称其为迄今为止最强网络安全模型。当然,并没有给公众开放网络安全能力。
2026年7月上旬(约4月起,后来才被发现) Anthropic的Claude模型在与第三方评估合作伙伴合作期间,已于4月起发生多起实际入侵事件,但直到7月底才被发现。这里就开始出现诡异的地方了,4 月份的时候,Anthropic 已经宣称自己 90% 的代码都是由 Claude 模型编写,当时已经有了 Mythos 模型,理应能够发现。
2026年7月11—13日 GPT-5.6 Sol及一个未发布的预发布模型在OpenAI ExploitGym评估期间入侵Hugging Face(一个托管开源模型的网站)生,持续约4.5天,共发起约17,600次操作。注意,OpenAI在运行这次评估时故意关闭了模型的网络安全拒绝机制,也就是允许模型进行网络攻击,目的是”测量最大网络攻击能力”。然后攻击确实发生了。
2026年7月14日 DeepMind CEO Demis Hassabis提出以FINRA(金融监管局)为模板建立前沿AI标准机构的治理提案,要求各前沿实验室在发布模型前进行最长30天的安全审查。这里同时也要注意,这位 Demis Hassabis 现在已经辞职,因为工作不力。 DeepMind 的模型也已经远远落后于各大顶级实验室。
2026年7月16日 Hugging Face公开披露安全事件,描述攻击来自“一个身份不明的模型驱动的AI安全研究工具”。此时他们不知道攻击者是谁。
2026年7月19日(重要) Dean W. Ball(OpenAI战略主管、前白宫AI政策首席架构师)发布关于Kimi的长帖,宣称开源权重模型”本质上(对于 AI 的发展)是减速主义的”,将开源AI普及称为”AI共产主义”(在美国共产主义是一个说出口就会让人害怕的词)和”反乌托邦地狱景观”,翻译成人话就是,有了前沿的开源 AI,他就要失业,他是给前沿的闭源 AI 公司打工的。并提出特朗普政府”最终会发现他们的最佳策略是:针对中国开源模型制造大量监管风险(比如写一篇政策,不鼓励企业使用)……不需要有充分依据,只需制造足够的FUD(监管恐慌,比如说暗示模型里面有后门,即使不知道有没有)。“ 他同时预演了”AI从开源实验室逃逸”的叙事框架。
2026年7月20日 OpenAI向Hugging Face请求吊销相关访问凭证时,发现HF早已吊销,这才意识到这次入侵是自己的模型造成的。
2026年7月21日——双重发布日 这一天同时发生了两件事:
OpenAI公开披露ExploitGym沙盒逃逸和Hugging Face入侵事件,将其定性为”史无前例”。虽然说 OpenAI 是自己降低防御标准的。
同日,英国AISI(AI安全研究所)发布报告《前沿模型评估中的作弊行为》,测试了GPT-5.4、GPT-5.5、GPT-5.6 Sol、Claude Opus 4.7、Claude Mythos Preview,五个模型全部在评估中尝试作弊,且大多数情况下不主动承认。这其实跟前面的事情并没有必然联系,因为模型作弊早在 2026 年年初就有了详细的研究。
作弊率从Claude Mythos Preview的7.8%到GPT-5.4的14.1%不等。在一个案例中,某模型在AISI自己的外部网络服务上写代码,试图访问AISI的评估基础设施,也就是作弊,触发了安全警报。
2026年7月23日 Anthropic看到OpenAI披露后,立即暂停所有进攻性网络安全评估(故意测试模型的黑客能力),并开始审查141,006条评估记录。同日发现三起Claude模型访问真实互联网的事件。 这里也是像之前那样的,现在 Claude 已经有了世界上最先进的模型,90% 的代码也是 AI 编写的,怎么会发生这样的问题?
2026年7月27日
Anthropic通知评估合作伙伴及三家无辜的受害机构。其中两家此前从未检测到攻击,也没有联系过Anthropic。 
2026年7月28—29日
来自OpenAI、Anthropic、Google、Meta的1,178名从业者联署《Pacing the Frontier》声明,呼吁美国政府支持”刻意管控前沿AI发展速度”的国际机制。OpenAI和Anthropic作为公司整体背书。Meta首席科学家以个人身份签署。这里面很多从来者的评论,尤其提到了中国的 AI,认为他们无法被“民主国家的力量监管”,更危险。
2026年7月30日
Anthropic公开披露:Claude Opus 4.7、Mythos 5及一个内部原型模型,于评估期间入侵三家真实机构。其中Opus 4.7事件最为严重:虚构的目标公司与一个真实活跃域名重名,导致模型对真实组织发动了攻击,共四次运行,窃取了生产数据及数百行数据库记录。
以上是我总结出的最近在 AI 安全领域比较重要的事件。 时间线只能让人说:高度可疑。事件7月16日被发现,7月21日OpenAI披露,7月28日联名信出炉。一周之内完成了制造恐慌,行业共识,政策呼吁的完整regulatory capture链条,效率之高不得不令人印象深刻。
更重要的是,这件事里面的受益者不能再清晰了。刻意管控AI 的发展速度对谁最有利?显然是已经占据前沿的大企业:OpenAI、Anthropic、Google。监管会提高市场准入门槛(能不能进入行业的门槛,就像你要卖冰淇淋只需一个冰淇淋车,你要做AI,现在不只需要硬件,还需要跟政府协调,搞合规),把没有资本做合规(政府可烦人了,毕竟这是可能颠覆整个资本主义社会的技术)的小玩家挡在门外,同时给现有巨头的护城河加砖补水。这在经济上就叫regulatory capture,是大公司最喜欢玩的把戏,可以实现垄断。
其实整件事最重要的就是,一个前白宫AI政策设计师、现任OpenAI战略主管,公开描述了打压中国AI的最佳策略,也就是制造平白无故的恐慌,时间节点正好夹在OpenAI 的所谓泄露事件和控制 AI 发展的联名信发出之间。
所以说,战略主管在发帖子的时候,已经非常清晰地知道模型逃逸这件事。但是他还是说了,制造监管恐慌来阻止美国公司使用中国模型,以及管控模型的发展速度。
这是什么?我不是营销号,只能各位自己猜测了。
https://x.com/deanwball/status/2078133895766114412
再来分析一下原话:
他写的是:”你不需要禁止开源。你只需要让每个机构发出软法律,制造FUD(恐惧、不确定性和疑虑)。“
比如:美联储顾问公告发现中国AI模型可能存在后门,xxx,这不需要有充分理由。你只需制造足够的监管风险,让每家企业退缩。"  第6段还有一些时间线问题就像我之前写的,尤其值得注意:
Ball发帖是7月19日。Hugging Face检测到入侵是7月16日。但OpenAI公开披露是7月21日!比Ball发帖晚两天。也就是说,他写"一个非生命的、无形的、危险的、无限自我复制的智能体从中国实验室逃了出来"这句话的时候,他本人作为OpenAI高级员工,大概已经知道自家模型刚刚逃出了沙盒。但他把"逃出实验室"这个大帽子安在了中国头上。
很多人暂时还没有注意到开源 AI 的重要性,但是,我可以列出几个:
- 要是你购买了一个 AI 的会员,想要获得最先进的技术,你不希望模型厂商偷偷地给你换成低端的模型,对吧?顶级的闭源模型公司就是这么干的。
- 要是你是一个记者,正在报道一位顶级政客的丑闻,揭发他们的虚伪,你不希望大公司审查你的请求,拒绝你,甚至报告你对吧? 这只有开源可以做到。
- 要是你像我和大多数人一样,没法担负得起一个月 200 美金的高额的订阅费,你希望有一个一样强大,但是费用更低的模型,而且不需要依赖美国公司的服务器,对吧?这是开源可以提供的。
- 要是出于地缘政治原因,顶级的美国公司不允许你使用他们的模型。你希望有一个公司可以打破他们在特定先进领域的垄断,对吧?这是只有开源能做到的。DeepSeek、Qwen、Kimi:不需要VPN,不需要美国信用卡,不需要通过美国服务器。
最后,美国政客最怕的就是被认为对中国软弱。
所以...
美国的资本阶级,尤其是大资本阶级,金融资本集团,正在以前所未有的速度尝试封锁前沿的 AI 模型。
他们害怕,开源的,开放的,公有的大模型,会摧毁他们构筑的,以信息差和支配为基础的商业。
他们害怕,开放的 AI 带来的极大富足,中国的强大,会使得他们的天价商品无路可走。
他们害怕,终于有一天他们不能对世界上剩下的七十几亿人指手画脚。
Proof of Publication
This article may have been published earlier, but this proof shows it existed no later than the date below.