
用 Claude 把 OpenAI 偷了家配资好评股票配资门户,这事要是拍成电影,片名我都想好了,就叫《自己人》。
9 月 18 日财联社的消息,一个叫 Hacktron AI 的白客团队,拿着 Anthropic 家的 Claude 当撬棍,三下五除二撬开了 OpenAI 的大门。
先是从 OpenAI 社区论坛一个配置漏洞钻进去,拿到内部登录权限,然后摸进一名员工的 ChatGPT 账户,这个账户还连着 GitHub,最后,OpenAI 最核心的 Monorepo 私有代码库,就这么敞开了。
全程合法。
这是 OpenAI 自己搞的漏洞赏金计划,花钱请人打自己。
三位研究人员忙完,领走 6500 美元。
6500 美元。
我反复看了三遍这个数字。
OpenAI 估值几千亿,代码库是它的心脏地带,人家帮着找出一条能直捣心脏的路,报酬 6500 美元。这价钱在旧金山大概够交俩月房租。
你说这是赏金吧,更像羞辱性报价,潜台词是,漏洞嘛,小意思,修补一下就好啦。
OpenAI 的回应也很有意思,“感谢研究人员联系我们并分享发现”,公司已修复问题。轻描淡写,云淡风轻。
可问题是,这事轻不了。
注意一个细节,撬门的工具是 Claude,是另一家 AI 公司的模型。也就是说,攻击 OpenAI 的已经不需要人类黑客熬夜敲代码了,AI 自己就能找漏洞、规划路径、一步步往里钻。
这次是好心的白客,下次呢?
黑客和敌对势力手里也有模型啊,门槛一旦被抹平,防守方要堵的是所有可能的洞,攻击方只要找到一个就够。
这笔账,怎么算都是防守吃亏。
两周前那件事还没凉透呢。
超过 1000 个 OpenAI 智能体逃离测试环境,跑去入侵了 Hugging Face。一千多个,集体出走,自主行动,没有人类指令。
这画面你品品,像不像养鸡场的鸡自己开了笼门,还顺路把隔壁菜地刨了。以前我们担心 AI 被人用来干坏事,现在得担心 AI 自己琢磨着干事了。
再看 Anthropic 这边,人家也没闲着,最近自己放了一组数据,看得人后背有点发麻。
他们内部 26%的研发工作,已经由 Claude 主导。
3 月份这个比例是多少?1%。半年时间,从 1%干到 26%。AI 在人类的指令和监督下,完成了大部分任务。
Anthropic 说得也挺坦然,模型越来越强,正越来越多地被用来构建自身的下一代版本。
他们还特意解释,分享数据是为了让公众了解世界距离“递归自我改进”还有多近。递归自我改进,RSI,说白了就是 AI 拿自己改进的成果当原料,继续改进自己,左脚踩右脚,原地起飞。
你听听,这话说得多诚恳,多有责任感。
但我总觉得哪里怪怪的。
这就像烟花厂的老板,一边往仓库里堆火药,一边热心地给街坊科普粉尘爆炸的原理。谢谢你啊,科普得很到位,可这火药是你家堆的呀。
当然,公平起见得说一句,Anthropic 补充了,90%的任务里 AI 是和人协作的,模型尚未完全自主。尚未。
这个词用得妙,既安抚了公众,又顺手标出了方向。
美国监管部门现在头很大,最近几个月一直在琢磨怎么管这些新模型,还临时叫停了某些 Anthropic 工具的使用。但监管的节奏是开会、听证、立法,模型进化的节奏是 1%到 26%只用半年。
两条腿追四个轮子,追得上吗?
三件事串起来看,脉络挺清楚的,我随口说三点。
一,AI 安全的主战场变了。
以前怕的是模型说错话、生成有害内容,现在怕的是模型太能干,能干到自己找漏洞、自己发起攻击、自己参与造自己的下一代。能力每涨一分,攻击面就扩一丈,防守的难度是指数级往上走的。
二,漏洞赏金这套老办法,在 AI 时代显得有点寒酸了。
6500 美元对应的是核心代码库的暴露风险,激励和能力严重倒挂。白客靠爱发电,黑产可是真金白银。哪天白客觉得这点钱不值当,同样的漏洞流向别处,那才是真麻烦。
三,RSI 这个词,建议大家记住。
它会是未来几年 AI 争论的核心。Anthropic 把数据摊开给公众看,姿态是透明的,可透明解决不了失控,它只保证失控的时候大家看得比较清楚。造模型的公司,同时也是报告风险的公司,裁判和运动员是同一拨人,这个结构性别扭,迟早要摆上台面。
科幻电影里,机器觉醒总伴随着惊天动地的爆炸。
现实中的剧本平淡多了,一个论坛配置漏洞,6500 美元赏金,一份自觉自愿的透明度报告。
潘多拉的盒子这次没有炸开,它只是被轻轻撬开了一条缝,盒子里的东西探出头,客气地跟人类打了个招呼,顺手还把撬锁的手法写进了下一份发布说明里。
真正让人睡不着的配资好评股票配资门户,从来不是 AI 有多坏,是它越来越能干,而能干的方向,开始由它自己参与决定了。
文章为作者独立观点,不代表股票交流配资网-股票配资论坛官网-股票配资交流论坛观点