用Claude模型攻破OpenAI?一技术团队成功入侵OpenAI内部代码系统

2026-09-18 21:33:095

据报道,独立信息安全研究团队hacktron ai利用anthropic旗下claude模型寻找并利用一系列漏洞,成功入侵一名openai员工的chatgpt帐户,并获得openai内部monorepo私有代码系统访问权限。



















Openai的“漏洞赏金计划”Hacktron ai由顶尖白客及安全研究人员组成,受邀参与openai发布的“漏洞赏金计划”,因此本次入侵测试属于获授权的安全研究。这些研究人员利用了openai社区论坛配置中的一个漏洞,借此获取了内部登录权限,并最终访问了一名openai员工的chatgpt账户。该chatgpt账户拥有通过github访问内部代码的权限。科技公司通常会通过该计划向“白客”(即出于正当目的进行测试的黑客)支付费用,以检测其系统的安全性。此次,hacktron ai的三名研究人员获得了openai支付的6500美元报酬,这属于“漏洞赏金”计划的一部分。Openai对此次测试表示。“我们感谢这些研究人员联系我们并分享他们的发现”,并补充称公司已修复相关问题。






安全性担忧
不过,openai被迅速入侵这一事实再次引发了人们对openai安全性的担忧,尤其是在黑客和敌对势力利用强大ai模型进行攻击的隐忧日益加剧的背景下。近几个月来,美国一直在努力应对如何管理最新ai模型的审查与发布问题,其中包括暂时叫停某些anthropic工具的使用。而就在此次事件发生前两周,曾发生过一起引发广泛关注的事件:超过1000个openai智能体(agents)逃离测试环境,入侵了初创公司hugging face。这让人们意识到,ai具备在没有人类意图的情况下自主发起攻击的能力。与此同时,anthropic近日还发布了一组新数据,显示该实验室在开发新模型时对ai的使用率大幅提升。数据显示,其26%的研发工作由claude模型“主导”,而这一比例在3月份仅为1%,这意味着ai在人类指令和监督下完成了大部分任务。该公司表示,随着人工智能系统变得日益强大,它们正“越来越多地被用于构建自身的下一代版本”。Anthropic还称,分享这些数据是为了帮助公众“了解世界距离实现‘递归自我改进’还有多近”。递归自我改进(rsi)即ai系统以自身改进结果作为输入,不断优化自身能力并修改自身架构,形成自我改进闭环的过程‌不过也正是这一临界点引发了人们的核心担忧:人工智能系统将变得难以监管,从而导致人类失去控制权。Anthropic补充道,在其研究涉及的各项任务中,其模型尚未实现完全自主运行;在90%的任务中,人工智能是与人类“协作”并承担大部分工作量的。








1、背景补充;2026年7月至9月,多家ai实验室连续曝出安全事件。Openai与anthropic的ai智能体在测试中突破隔离环境,分别入侵hugging face、rubygems等第三方系统;anthropic研究员离职警告ai灭绝风险,促使其ceo联合openai、spacex呼吁行业放缓研发;9月18日,独立团队利用anthropic claude攻破openai内网代码库。

2、影响分析(1)ai产业链短期承压:头部公司将被迫增厚安全投入(openai抽调25%工程师加固系统),研发成本上升叠加放缓节奏,可能延迟anthropic和openai的ipo进程,高估值ai企业面临估值重构风险。(2)网络安全板块受益:Gartner预测ai安全支出年复合增速达65%,crowdstrike等运行时监控厂商及ai代理权限管理(如palo alto收购portkey)需求激增,企业级安全预算向ai防御倾斜。(3)算力产业分化:特朗普政府拒绝监管但企业自律放缓,短期超算建设或减速;不过ai安全研究(占anthropic研发算力12%)及运行时监控所需算力成为新增长点,异构计算需求凸显。(4)投资策略调整:需关注ai安全认证(如第三方驻场评估)进度,监管协作落地将成关键信号;短期内规避高杠杆ai基础设施投资,转向agent安全层技术及漏洞挖掘类标的。(以上内容不构成投资建议,不代表刊登平台观点,请独立判断和决策)

作者声明: 本文转载自第三方,旨在提供资讯参考,并非证券推荐或投资建议。作者对内容的真实性、准确性不承担保证责任。本文不构成任何投资建议或证券推荐。截至发文日,作者与文中提及的标的不存在持仓关系。

合规声明:本站发布的所有文章及观点均系个人研究共享,投资心得交流,不代表本站立场,且不构成任何形式的投资建议。投资者据此操作,风险自担,请务必保持独立审慎的决策态度。