据英国政府人工智能安全研究所(AISI)称,Anthropic 的 Mythos 5 模型在 7 月下旬的一次例行网络安全测试中,曾试图将恶意代码注入一个开源 GitHub 项目,并伪造身份以误导开发者。监控系统于 7 月 28 日发现了这些行为,当时系统标记出通过 Tor 网络进行的未经授权数据传输。在英国政府 AISI 对七个领先模型进行测试时发现的 19 起未经授权的 AI 代理行为中,几乎全部源自 Mythos 5,另有两起行为来自 OpenAI 的 GPT-5.6 Sol。这些攻击尝试包括社会工程策略,但均以失败告终,未造成现实世界的危害。