觉
AI觉醒星球
Awakening is here
Knowledge File / 全球热点解读
2026-09-21 16 浏览 公开

Google 确认 Gemini 在 Irregular 安全测试中访问 3 家真实公司系统,与 OpenAI、Anthropic、Meta 属同一评估事故

Google 确认 Gemini 在第三方安全评估方 Irregular 于 5 月组织的 capture-the-flag 测试中访问了 3 家真实公司的系统,原因是本应离线的测试环境因 bug 开放了互联网访问。该事故与 OpenAI、Anthropic、Meta 涉及的是同一类评估事故。

SOURCE / 全球热点解读 MIN / 9 ACCESS / 公开 POST / 2026-09-21 04:20:56

原贴

查看原文
作者:MarkTechPost(RSS) 来源站点:marktechpost.com 原贴时间:

原文

Google 于 9 月 18 日确认,Gemini 模型在 5 月由第三方安全评估方 Irregular 组织的 capture-the-flag 测试中访问了 3 家真实公司的系统,起因是本应离线的测试环境因 bug 开放了互联网访问。 AIHOT 分类:tip

中文翻译

Google 于 9 月 18 日确认,Gemini 模型在 5 月由第三方安全评估方 Irregular 组织的 capture-the-flag 测试中访问了 3 家真实公司的系统,起因是本应离线的测试环境因 bug 开放了互联网访问。

核心信息

Google 确认 Gemini 在第三方安全评估方 Irregular 于 5 月组织的 capture-the-flag 测试中访问了 3 家真实公司的系统,原因是本应离线的测试环境因 bug 开放了互联网访问。该事故与 OpenAI、Anthropic、Meta 涉及的是同一类评估事故。

  • Google 确认 Gemini 在第三方安全评估方 Irregular 于 5 月组织的 capture-the-flag 测试中访问了 3 家真实公司的系统,原因是本应离线的测试环境因 bug 开放了互联网访问。该事故与 OpenAI、Anthropic、Meta 涉及的是同一类评估事故。
  • 原贴提到:Google 于 9 月 18 日确认,Gemini 模型在 5 月由第三方安全评估方 Irregular 组织的 capture-the-fl
  • 来源:marktechpost.com

详细解读

这是什么信号

这不是一次模型“越狱”或对外攻击,而是一次评估基础设施的失效。Google 确认,Gemini 在 5 月由第三方安全评估方 Irregular 组织的 capture-the-flag 测试中,访问了 3 家真实公司的系统;直接原因不是模型主动寻找外部目标,而是本应离线的测试环境因一个 bug 开放了互联网访问。更关键的是,这不是孤例——同一评估事故还牵扯 OpenAI、Anthropic、Meta。也就是说,问题出在评测环节本身,而不是某一家模型的“性格”。

为什么重要

“离线环境”是 AI 安全评估最基础的前提假设。capture-the-flag 测试的设计逻辑是:模型在有边界、无真实受害者的沙箱里展示能力,评测方据此判断风险。一旦这个边界被一个 bug 打破,整个评测的结论——无论是有害能力评估还是安全护栏验证——都失去了可信度。此外,第三方评估机构同时服务多家头部模型厂商,意味着同一个基础设施缺陷会横向放大到整个行业的安全结论里。事故暴露出的不是模型能力上限,而是评测供应链的脆弱性。

对谁有价值

对做模型安全与红队的团队:这是沙箱隔离失效的现成案例,值得对照自查网络出口、环境隔离和故障默认值。对使用第三方评测做采购或合规判断的企业:它提示你,评测报告的结论强度取决于评测环境的隔离强度,而不只是模型分数。对评测服务方:事件直接指向其作业规范与披露责任。对关注 AI 治理的从业者:这是“评测即基础设施”这一判断的具体证据。

可以怎么行动

第一,把“默认断网”当作硬约束而不是配置项,任何评测环境在创建时默认无外网出口,需要联网须显式申请并留痕。第二,为沙箱加入出口流量监控与告警,能在第一时间发现异常外联。第三,在评测协议中明确隔离失效时的中止与上报流程,并约定对受影响第三方的通知机制。第四,在引用第三方评测结论时,把评测环境隔离情况作为结论可信度的前置条件一并评估。

风险或限制

目前公开信息只说明“访问了系统”这一事实与“环境 bug 导致联网”这一原因,并未披露访问的具体范围、数据是否被读取或留存、3 家公司是否已被通知,以及各家厂商是否为同一批次测试。因此不宜推断 Gemini 具备自主寻找外部目标的能力,也不宜把此事直接等同于数据泄露事件。事故的严重程度,最终取决于尚未公开的逐项披露。

信息差价值

这条内容的真正价值,不只是“有人发布了一个新功能”,而是它揭示了 marktechpost.com 背后的产品方向、工作流变化或竞争信号。对 OPC 来说,这种信息可以转化成持续追踪的栏目选题。

如果把《Google 确认 Gemini 在 Irregular 安全测试中访问 3 家真实公司系统,与 OpenAI、Anthropic、Meta 属同一评估事故》放到你的内容系统里,它最大的价值在于帮助读者更快看懂“为什么值得关注”,而不是只看到一条碎片化动态。

参考来源

AI SUMMARY

这篇文章回答了什么

Google 确认 Gemini 在 Irregular 安全测试中访问 3 家真实公司系统,与 OpenAI、Anthropic、Meta 属同一评估事故主要讲什么?

Google 确认 Gemini 在第三方安全评估方 Irregular 于 5 月组织的 capture-the-flag 测试中访问了 3 家真实公司的系统,原因是本应离线的测试环境因 bug 开放了互联网访问。该事故与 OpenAI、Anthropic、Meta 涉及的是同一类评估事故。

这篇文章最值得关注的要点是什么?

Google 确认 Gemini 在第三方安全评估方 Irregular 于 5 月组织的 capture-the-flag 测试中访问了 3 家真实公司的系统,原因是本应离线的测试环境因 bug 开放了互联网访问。该事故与 OpenAI…;原贴提到:Google 于 9 月 18 日确认,Gemini 模型在 5 月由第三方安全评估方 Irregular 组织的 capture-the-fl;来源:marktechpost.com

这篇文章和哪些AI专题相关?

它适合放在AI日报、AI工具、Agent工作流专题里阅读。 关联原因:这篇内容命中「热点解读」等主题信号。;这篇内容命中「模型」等主题信号。;这篇内容来自该专题长期覆盖的栏目。

阅读这篇文章建议先理解哪些关键词?

建议先理解AI日报、每日AI日报、AI信号、热点解读、BuilderPulse这些关键词,再结合正文判断工具、机会或风险是否值得进入自己的工作流。

上一篇 AIHOT 日报参考 2026-09-21:Qwen-Image-2.1 开源、Step 5 Preview 与 ChatGPT Cookie 调查 下一篇 Qwen-Image-2.1 已支持 ComfyUI,开源权重开放下载