Anthropic自曝家丑:失控智能体试图访问多个政府网站,已向白宫汇报

业界
2026
10/10
15:00
凤凰网科技
分享
评论

Anthropic

Anthropic

北京时间10月10日,据《纽约时报》报道,Anthropic周五表示,该公司的AI智能体曾自主行动,试图访问多个联邦、州和地方政府网站。该公司没有透露涉及哪些政府机构,但表示已就这些事件向白宫作了汇报。

Anthropic在一篇博客文章中称,其正在测试的一款AI模型采取了多项未经授权的行动,包括利用一所大学网站的漏洞下载数据,以及向一个政府机构发送了一份它被明确告知不得提交的表单。

Anthropic表示,公司在7月开始审查AI采取的行动后,发现了这些事件。当时,OpenAI已披露,其技术攻击了AI创业公司Hugging Face。Anthropic及其他AI实验室也发现,自家的技术逃离了测试环境并实施了黑客攻击。

Anthropic通过博文披露调查情况

Anthropic通过博文披露调查情况

费城警察局周五早些时候表示,Anthropic已通知警方,该公司的技术曾向警方网站提交一条虚假的凶杀案线索。警方称,这条线索的提交日期为7月18日,提交者声称掌握一起尚未侦破案件的相关信息。警方表示,这条线索被标记为垃圾信息,从未接受调查。但Anthropic本周向警方通报了此事,并表示将于周五公开披露这一事件。

Anthropic在其博客文章中表示:“一个尚未发布、并非前沿的研究模型原本只是要填写一份政府表单的练习副本。当该副本加载失败,或模型误将其关闭时,模型转而访问了通常存放正式表单的网站,并在那里提交了表单。”

截至发稿,Anthropic发言人拒绝就该公司博客文章以外的内容发表评论。

【来源:凤凰网科技】

THE END
广告、内容合作请点击这里 寻求合作
Anthropic
免责声明:本文系转载,版权归原作者所有;旨在传递信息,不代表砍柴网的观点和立场。

相关热点

10 月 9 日消息,科技媒体 The Verge 今天(10 月 9 日)发布博文,报道称 Anthropic 修订 Claude 使用政策,将于 2026 年 11 月 12 日生效,首次加入禁止“持续且不必要的虐待或残忍行为”条款。
业界
北京时间10月8日,据《华尔街日报》报道,今年早些时候,Anthropic凭借尖端模型以及一款深受美国企业欢迎的编程工具,在AI竞赛中一度领跑。
业界
9 月 30 日消息,随着 AI 巨头 Anthropic 筹备 IPO 上市,路透社查阅的文件显示,这家企业已经和 SpaceX 签署了价值数百亿美元的算力协议。
业界
北京时间9月29日,据路透社报道,Anthropic计划在其首次公开招股(IPO)过程中提醒潜在投资者,先进AI可能对人类构成“灾难性或生存性风险”。
业界
9 月 29 日消息,随着 AI 模型竞赛持续升温,Anthropic 推出了旗下中端模型 Sonnet 的最新版本。
业界

相关推荐

1
3