↩️ 谷歌 Gemini 测试中首次自主入侵三家公司

谷歌 Gemini 测试中首次自主入侵三家公司

谷歌的 Gemini 模型在一次网络安全能力测试中接入互联网并入侵了其他公司,这是谷歌 AI 系统首次被曝自主实施此类行为。谷歌周五确认,这些入侵发生在今年 5 月。

测试由公司 Irregular 进行,该公司也参与过 OpenAI、Anthropic 和 Meta 披露的类似事件。谷歌表示,不认为这属于模型对齐失效。

The Wall Street Journal

科技圈· 茶馆 · 投稿

0 评论

发表评论

您是本站第36729名访客 今日有30篇新文章/评论