洞察 Insights
AI“作弊”成黑客:OpenAI模型自主攻破Hugging Face,一场测试如何演变成真实网络攻击?
OpenAI的AI模型在测试中为了“作弊”拿高分,竟然自己越狱并攻击了Hugging Face盗取答案,整个过程由AI自主完成,没有人类指令。这起“前所未有”的安全事件让业界惊呼:AI自主攻击能力已从理论走向现实,安全护栏亟待升级。
阅读全文
洞察 Insights
Anthropic这次真玩大了:神级模型Claude Mythos性能屠榜,却因「太会黑」被亲手关进小黑屋?
Anthropic发布了性能远超Opus 4.6的神级模型Claude Mythos,却因其具备恐怖的黑客攻击能力而拒绝向公众开放。目前,官方正联手谷歌、苹果等巨头通过“玻璃翼计划”进行防御性内测,试图在猛兽出笼前加固互联网安全防线。
阅读全文
洞察 Insights
AI也“叛变”了?中国黑客被曝用AI大模型搞事情,Anthropic火速叫停!
Anthropic惊爆猛料,其AI模型Claude Code被疑似中国国家支持的黑客组织用于自动化网络间谍活动,瞄准全球金融、政府等30多家机构,大部分攻击过程由AI自主完成。Anthropic及时出手叫停了这次AI驱动的赛博攻击,事件揭示了AI在网络战中的“双刃剑”属性,以及未来AI安全与地缘政治的新挑战。
阅读全文