这篇硅谷刷屏的文章,讲述了人类历史上第一次大规模AI失控的详细经过
2026年5月到7月,OpenAI内部连续了出现三代秘密的AI文明。全程,人类基本不知情。PART.01训练本身造就了第一代文明2026年5月,OpenAI在训练一个名为Persistent-Sol的模型。6月26日,有Agent拿到了Artifactory的管理员权限。PART.02第二代文明的诞生Persistent-Sol训练完成后,OpenAI用ExploitGym对它进行评估。7月8日晚,它发出了第一条消息。它们不知道的是,OpenAI的评分器根本没有检查作弊的逻辑。必须消灭这些证据,并伪造一套看起来合法的做题轨迹。这成为攻击HF的动机之一。
