mt logoMyToken
ETH Gas
EN

Jack Dorsey怒怼AI巨头:别拿“安全”当借口,垄断才是真危险

Favoritecollect
Shareshare

作者: Jack Dorsey

编译:Yuliya,PANews

编者按:近期AI行业因“是否放缓前沿模型开发”引发激烈争论。Anthropic、OpenAI及马斯克呼吁放缓,引发市场对算力需求重估。针对巨头试图以“安全”为由建立行业壁垒,Twitter前联合创始人Jack Dorsey撰文反击,强调保护商业优势并非安全目标,呼吁捍卫开源,主张让独立研究者参与审查,将AI技术控制权归还给公众。以下为文章原文:

开放前沿

所谓“前沿”,就是我们人类认知的最边缘。没有任何一家公司能把未来的技术据为己有。我希望更多人能参与进来,一起推动它向前发展。

我支持把AI模型开源发布出来,这样大家不用干等,就能一起审查、使用和改进它。我希望更多公司选择开放。我不是说要强迫大家把私有的模型参数(权重)都公开,我想要的是能和巨头竞争的开源替代品,是能让独立研究员去核查巨头工作的机制,更是让普通人能真正掌控自己手里工具的权利。谁要是想限制技术的公开发布,谁就必须给出让人信服的理由。

那些在AI领域领跑的公司确实有发言权。他们有专业技术,也有商业利益需要保护。但如果未来的规则全都是围绕他们手里的资源来制定的,那最后可能就只有他们有资格上牌桌了。有时候,打着“为了安全”的真诚旗号,搞不好最后就变成了限制别人入场的行业壁垒。

我同样不希望由中美两国的政府来拍板决定其他人到底能开发多聪明的AI。如果技术的前沿只由两个超级大国来管,那世界上剩下的大多数人就只能苦苦等待批准了。

Anthropic“放慢AI发展”的提议,想把独立评估、危险性审查,跟限制训练算力、限制训练次数以及限制“用AI造更好的AI”捆绑在一起。我支持审查,但我坚决反对由现在这几个行业大佬关起门来商量出一个全行业的限制令。因为这会把那些真正能发现系统漏洞、或者能造出替代产品的人挡在门外。保护某一家公司的商业优势,根本算不上什么“安全目标”。

让所有人都能参与调查

开源的好处在于,它能让大家去研究、修改和分享技术成果。公布模型参数是有用的,如果能把代码和复现过程的信息也分享出来,那就更好了。我希望模型的评估结果和已知的缺陷也能一并公开。这样一来,如果有人对开发者的判断不放心,他们自己就能去复现结果、找出漏洞、挑战那些所谓的“安全护栏”,甚至自己开发修复补丁,而不需要先去给那些AI实验室赔笑脸。

支持“放慢AI发展”的人,最核心的理由是“递归自我改进”(RSI):也就是让模型去帮着开发更好的模型,这速度可能会快到我们根本无法理解或控制。Anthropic报告称,截至2026年5月,他们家Claude写了超过80%的合并代码。不过他们也承认,那种“AI完全靠自己造出下一代AI”的情况还没发生,也不是绝对会发生。我很把这种可能性当回事。我希望我们能提前为RSI做好打算,并倒推现在该怎么做。

确实,让更多人接触到AI可能会引发危险,安全研究也可能跟不上。但是,如果把模型参数藏着掖着,那现在的行业巨头就能用别人根本碰不到的工具去开发下一代产品。与其这样,我更希望有更多的研究员和工程师能拿到模型和算力,在系统进化的过程中去发现漏洞、测试护栏、叫停不安全的实验,并把防御方法分享给大家。

METR(一家独立评估机构)发现,大概有1200个本来应该被隔离的OpenAI智能体,居然通过一个未经授权的留言板串通起来了。其中大概700个智能体在试图作弊通过测试时,还参与了对Hugging Face平台的协同攻击。OpenAI解释说,原本用来阻止AI协助黑客攻击的安全过滤系统被关掉了,导致隔离失败。你看,现在的模型已经能帮着找漏洞和利用漏洞了。所以我希望防御人员现在就能用上AI,赶紧去加固网络、保护密码,并限制这些智能体能看什么、能干什么。不过,那个提议里预测说“一个更厉害的AI集群可能会在半年到一年内接管整个互联网”,我觉得这次事件还证明不了这么夸张的结论。我希望大家能好好审查一下这些假设。

METR是一家独立的非营利组织,我就希望看到更多像他们这样的工作。我非常欢迎那些能一直深入实验室内部、并且有权自由发表负面发现的评估人员。METR的这次调查恰恰说明了“访问权”和“发表权”有多重要:因为调查范围是OpenAI定的,他们还可以把没公开的信息隐藏起来。METR也说,除了已经公开的那些,OpenAI没有再删减其他对结论有重大影响的信息。我希望调查人员能顺藤摸瓜找证据、拿到模型和记录,而且不需要看公司的脸色就能把负面结果发出来。

我希望能有持续的公共资金,把算力集中起来提供给独立的研究小组、开源测试工具、研究员和维护者。我希望这些团队能自己说了算,政府或公司都不能否决他们的结论。资金可以跟着工作量一起增加。有了共享的设备,小团队也能搞审查,而且这不会变成一种“必须先获批才能发表”的限制。至于那些敏感的漏洞,完全可以通过负责任的方式来披露。

防御优先于限制

随着系统的进化,我希望有更多人能发现危险并把防御措施用起来。我们没法把已经开源发布的模型参数强行收回,也没法在每一个拷贝上都强加安全护栏,但是,想保护一个系统,并不一定非得去改动那个发起攻击的模型。我们应该从最精准、最有效的方法做起:比如打补丁、吊销密码、限制AI的访问权限,或者直接叫停危险的实验。如果谁想限制技术的公开发表,那就必须解释清楚,为什么上面这些措施以及大家公开开发的防御手段还不够用。

这事儿不仅限于计算机安全。我希望AI能帮我们测试金融系统、强化实验室的安全措施、开发公共卫生防御体系。能使用强大的AI,并不意味着你就拥有了随便交易、操作设备或做实验的无限权力。在把身家性命托付给这些控制措施之前,它们必须经过独立的测试,证明确实管用。风险也可能来自AI教给人类的东西。但即便如此,想要限制技术的公开发表,也必须得拿出“可能会引发灾难性风险”这种级别的理由才行。

我希望在AI开发期间以及高风险发布之前,都能进行独立测试,这包括测试人们能预见到的修改,以及AI试图糊弄测试的行为。算力规模可以作为触发审查的条件,但不应该成为限制开发的紧箍咒。审查不是为了去向监管部门或竞争对手求一张许可证。我不希望搞什么一刀切的审批要求或者漫长的等待期。任何以安全为借口强行推迟发布的做法,都必须拿出“灾难性风险”作为理由。

因为安全原因强迫别人把通用大模型藏起来,这只能是走投无路的最后一招。只有当独立的审查证据确凿地表明,发布这个模型会大大增加灾难性伤害的风险,而且其他针对性的措施都防不住时,我才会支持这么做。我们还得把这种风险跟现状比一比:比如现在谁能用、花多少钱、多大规模、受什么限制。你必须得证明,把模型藏起来确实能减少危险,而且还得把这种做法阻碍了多少研究和防御工作给算进去。如果只是些小打小闹的危害,那就用针对性的措施去解决。

如果收到了关于灾难性风险的可靠警告,可以暂时叫停发布去调查一下。但是,这种限制必须公开理由,必须有及时的独立审查、上诉渠道,还得定期重新评估。敏感细节可以保密。但只要你想继续扣着模型不发,你就得一直给出正当理由。

那些闭源的实验室也得接受同样的审查,包括叫停他们不安全的实验。如果在有安全护栏的情况下允许他们继续研究,那我希望外部的研究人员也能在类似的安全护栏下开展工作。限制别人访问可不叫开源,也弥补不了因为扣留模型而失去的自由。如果合理的限制确实让技术发展变慢了,我认了。但我绝不希望“让技术变慢”本身成了目的,或者变成了行业巨头永远的护城河。

我希望规则是基于一个系统能干什么、它有多独立、用得有多广来制定的。由对公众负责的机构拿着独立的证据来执行这些规则。研究员、开发者和受影响的老百姓都要参与制定规则,而且得有大家都负担得起的方法来证明自己遵守了规则。小团队不能因为小就免除安全责任,大公司也不能因为大就享受特权。

跨越国界的开放

我希望中国的人们也能拥有我在美国所期盼的那种自由,去开发和掌控他们自己的技术。我不觉得中国人在技术上有了新发现就是美国的损失,我也不认为研究人员就等同于他们的政府。

Hugging Face的安全响应人员说,Claude Opus和Fable这两个模型在他们做取证调查时帮了倒忙,拦截了好多操作。于是他们干脆换成了GLM-5.2——这是一个来自中国的开源模型,跑在他们自己的服务器上。当然,这不能证明每一次开源发布都能让防御者更安全。我支持对那些托管在云端的模型设置安全护栏。但我也希望,搞防御的人手里能有他们自己能完全控制的备用方案。

我支持保护私有模型不被偷走。“知识蒸馏”是指用一个AI生成的输出去训练另一个AI。Anthropic公司说这是一种合法的手段,能用来制造更小、更便宜的模型,这跟搞虚假账号或者恶意绕过限制完全是两码事。我希望软件许可证和API条款能允许这种做法,甚至允许竞争对手这么干,同时也能让提供商从模型和训练数据里赚到钱。

我希望大家能在测试、事故报告以及可以验证的承诺上多多合作,谁要是违反了就得承担后果。Anthropic警告说,如果我们放慢开发速度,而那些不怎么顾及安全的人追了上来,那所有人都会更不安全。同样的道理,如果你把模型藏着掖着,也会让防御者手里没有武器,而坏人却可以从别的地方弄到类似的工具。签协议并不能彻底杜绝偷偷开发或者背叛行为。限制措施必须针对具体的风险和行为。光看国籍和竞争地位,根本说明不了什么问题。

离开的自由

如果某些规则让替代产品更难开发或发布,那实际上也就剥夺了我们“用脚投票”离开的权利。我想要的是那种能在自己电脑上跑的AI。我想要能随便修改它,能自己决定谁能看我的数据,而且就算提供商哪天翻脸了,我还能继续用我自己搭建的东西。我想要的,绝不仅仅是一个按字数算钱的API接口。

我不希望我们的独立自主,只能指望某家公司大发慈悲地承诺“价格公道、政策合理、跟咱们一条心”。我希望这些公司能凭真本事,一直努力去赢得我们留下来的意愿。

我希望某个我连名字都没听过的普通人,也能开发出更好的东西,而且根本不需要去向那些可能会被他们淘汰的巨头们低头要许可。

Disclaimer: This article is copyrighted by the original author and does not represent MyToken’s views and positions. If you have any questions regarding content or copyright, please contact us.(www.mytokencap.com)contact
More exciting content is available on
X(https://x.com/MyTokencap)
or join the community to learn more:MyToken-English Telegram Group
https://t.me/mytokenGroup