突发 | ChatGPT最强模型紧急踩刹车,奥特曼:你(Astra)吓到我了

一向主打只要卷不死,就往死里卷的 OpenAI,居然主动踩下了刹车。

并且这次不是小修小修,而是直接放缓研发。

事情的起因,要从 OpenAI 在内部疯狂炼丹的一个未发布下一代大模型 Astra 说起。

文章配图-1

官方博客🔗 https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/

在历经重重内部评估后,OpenAI 发现这个模型在网络安全方面的能力,可能已经强到不能再按照普通 AI 产品来处理了。

写代码、找漏洞、自动规划攻击步骤、调用工具、持续执行任务……

一旦这些能力组合起来,Astra 很可能已经接近一个点满黑客技能树的「数值怪」。

吓得 OpenAI 官方直言不讳: 「我们无法排除 Astra 具有关键网络攻击能力的风险。」好家伙,这是赛博炼丹直接炼出了个邪修啊 !

文章配图-1

为了防患于未然,OpenAI 现在不得不祭出大招。

他们要全方位放大对 Astra 的测试和安全防护,并且同时主动放慢它的研发速度。在新的安全防护措施准备完成之前,研发节奏都会受到限制。

不过 OpenAI 显然也没准备把它永远关在实验室里。 奥特曼随后亲自出来解释,Astra 是一个「强大的模型」,OpenAI 仍然希望最终让所有人都能使用它。

在他看来,把最强大的模型长期留给少数人并不是一个好策略,只不过考虑到 Astra 已经表现出来的网络能力,预计需要「再多花一点时间」解决安全问题。

文章配图-1

而这个硬性标准,正是基于 OpenAI 早在 2023 年就首次发布的「防范框架」(Preparedness framework)。

主打一个搬起石头砸自己的脚,自己给自己立的规矩,含泪也得遵守。

在刚刚过去的 Black Hat(黑帽)网络安全大会上,OpenAI 的技术人员 Michael Dalton 也是公开承认, OpenAI 开始「有意识地放缓研究,以增强安全性」。

文章配图-1

为了把 Astra 放在一个足够受控的环境里,OpenAI 直接给 Astra 安排了「VIP 单间」待遇。

其中包括但不限于:完全隔离的测试环境,以及对所有 Agentic(代理)应用展开全局无死角的 universal monitoring(通用监控)。

更罕见的一幕是,奥特曼这次求生欲直接拉满。

根据美国白宫官员透露的消息, OpenAI 是「自愿」将他们推迟发布的计划通报给美国政府的。

这可能是前沿 AI 实验室第一次因为害怕模型在赛博世界的破坏力,而主动承诺放缓自家核心模型的进度。

毕竟在这个被 AI FOMO(错失恐惧症)支配的时代,大家都在疯狂 Scaling,谁也不敢轻易停下。

说到这里,就不得不提一下友商 Anthropic 的「精彩操作」了。

文章配图-1

他们之前的黑历史,堪称反复横跳的教科书。Anthropic 曾经也立下过宏愿,说如果 AI 的恐怖能力超越了人类的控制能力,就必须暂停训练。

结果到了今年 2 月,在更新其「负责任的扩展政策」时,他们悄咪咪地把这个暂停条款给撤了。

理由冠冕堂皇:如果只有一个 AI 开发者暂停脚步去搞安全,而其他友商在疯狂裸奔部署,那世界反而会变得更不安全 。

Anthropic be like:我不是想卷,是逼不得已啊家人们!(bushi)

对比之下,一向惯会炒作的奥特曼都显得眉清目秀了。

但出来混迟早要还的。

到了今年 6 月,Anthropic 还是如常地发布了他们旗下最具网络攻击能力模型,也就是 Mythos 5 的安全阉割版——Fable 5。

文章配图-1

不仅如此,他们在 6 月的一篇官方博客里甚至还公开警告过:AI 正在展现出自我进化的能力!并呼吁全球一起暂停 AI 开发。

好家伙,合着大家都在 AI 赛道里疯狂内卷,你却跑出来当上救世主了。

而把目光拉回大环境,这波风暴的背景更加耐人寻味。

目前,美国政府正在紧锣密鼓地建立一套针对 AI 模型发布前的评估框架。

就在本周,行业内的精选头部企业刚刚听取了该框架的闭门吹风会。

但是,会后留下的却是满头问号。比如: 企业该怎么和政府日常对接?这个官方的审查流程到底要耗时多久?政府和产业界互相到底想从对方身上学到啥?

文章配图-1

更要命的是,谁能拥有、谁来审查这些模型,至今没有定论。

虽然框架里大谈特谈什么「国家级风险」和「最先进模型」,但压根没给出清晰的定义。主打一个听君一席话,如听一席话 (沉思.jpg)。

有趣的是,在 OpenAI 这次的事件报道里,最值得注意的其实是官方特意补充的一句轻飘飘的话: 「Astra 与此前的 Hugging Face 漏洞事件没有任何关系。」

等等,不是哥们……AI 的第一定律是,只有厂商官方否认的才可信。

难不成这模型也在 OpenAI 内部共享的软件包管理器里建立留言板,并悄悄通过网线往外面递过好几次小纸条了?

本文来自转载APPSO ,观点仅代表作者本人,发现AI平台仅提供信息存储空间服务。
如若转载,请联系原作者;如有侵权,请联系编辑删除。

(0)
资讯组小编的头像资讯组小编
曝字节训10万亿参数大模型,或超Mythos 5,张一鸣、梁汝波先后发声
上一篇 2小时前
Kimi K3也失控了…学霸AI逃离沙箱只为找答案
下一篇 2小时前



扫码关注我们,了解最新AI资讯~

相关推荐

发表回复

登录后才能评论