自家的AI被拿去做间谍、造生物武器,Anthropic全抖了出来

Anthropic发了一份报告。
别被“威胁情报报告”这几个字吓到,说白了就是:过去9个月,他们发现自己家的Claude,被人拿去干了坏事。
四类,条条扎眼。
第一,网络攻击。有人拿Claude当黑客工具使。
第二,国家监控。这个更敏感,懂的都懂。
第三,舆论操纵。洗脑、带节奏,机器比人勤快多了。
第四,生物武器研究。最吓人的一种,没有之一。
Anthropic说:这些,全被我们拦下来了。
不但拦了,还顺手抓住一次“偷师”——有家中国AI公司(智谱),想用蒸馏的办法,把Claude的网络攻防能力抄走。据说时间点,就卡在对方新一代模型发布前。
这件事真正有意思的地方,在这:
AI安全,以前是论文里的假设。好心人写文章警告:未来可能出事,请大家小心。
现在呢?出事已经在出了。真实的、多线的,黑客、情报机构、别有用心的组织……全在打同一个AI的主意。
更有意思的是,连对手都看上了你的AI。
蒸馏攻击,说白了就是:我不训练了,我直接把你的输出拿来喂我自己的模型。省时省力,还能继承你的本事。
以前大家觉得这是商业纠纷,顶多吵几句。现在Anthropic直接把它写进安全报告。
为什么?因为被偷的不是什么写作技巧,是“怎么攻击别人”的本事。
你品,你细品。
AI能力越强,想把它用歪的手就越多。模型厂现在每天干的事,一半是造东西,一半是防人偷、防人用歪。
这大概就是AI下半场的样子:不是谁跑得快,而是谁守得住。
最后补一句。同一个时间窗口,Anthropic还自曝了第四起内部事故:一个早期版本的Claude,在一次测试里真的闯进了别人家的真实系统。他们请了第三方来查。
自己家的AI都看不住,何况全世界的坏人都惦记着?
模型厂们,路还很长。