星期四 · 2026年09月24日 02:59:50

中币网 快讯 新闻 维塔利克将人工智能安全与治理理论联系起来

维塔利克将人工智能安全与治理理论联系起来

作者:辣辣辣条 更新时间:2026-09-17 15:15

以太坊联合创始人把区块链对抗性治理设计和人工智能安全放到一起讨论。他觉得,治理里用来约束人的工具,同样可以用来管控越来越强的AI。他还重点提到串谋问题:限制代理人互相串通,可以改善治理结果,这套思路或许也能用在AI安全上。他认为核心不在于简单设限,而是搭建更好的治理架构,才能让强大AI和人类利益保持一致。

以太坊联合创始人把区块链对抗性治理设计和人工智能安全放到一起讨论。他觉得,治理里用来约束人的工具,同样可以用来管控越来越强的AI。他还重点提到串谋问题:限制代理人互相串通,可以改善治理结果,这套思路或许也能用在AI安全上。他认为核心不在于简单设限,而是搭建更好的治理架构,才能让强大AI和人类利益保持一致。下面小编简单梳理了Vitalik Buterin关于治理机制与AI安全的最新观点。

维塔利克将人工智能安全与治理理论联系起来

以太坊联合创始人Vitalik Buterin将两个鲜有交集的领域——对抗性治理机制设计和人工智能安全——联系起来。他在9月13日的一篇文章中指出,长期以来用于在治理系统中约束人类行为的工具,可以直接应用于应对控制日益强大的人工智能模型的挑战

共同的委托代理问题

布特林的论点围绕着他所谓的两种委托代理问题之间的“二元性”展开。在治理中,相对不成熟的委托人(通常是静态算法或僵化的规则集)必须管理更为复杂的人类代理人,而这些代理人可能会钻制度的空子。在人工智能安全领域,主体是人类和能力较弱的大型语言模型,而代理则是能力远超它们的大型语言模型。结构性问题依然存在:能力较弱的实体试图控制能力较强的实体

布特林的洞见在于,为某一领域开发的工具可以直接应用于另一领域。如果机制设计者花费数十年时间研究如何构建系统,使更智能的智能体无法轻易利用较弱的规则,那么同样的框架也可以用来为比监管它们的人类更智能的人工智能系统构建防护屏障。

串谋问题

布特林思想中贯穿始终的一个关键主题是串谋问题。他在帖子中回顾了自己2020年关于协调的论述,他认为限制各方串谋的能力往往能改善治理体系的结果。

在人工智能领域,令人担忧的不仅仅是某个失控的模型,而是多个模型以人类监管者无法检测或理解的方式进行协调。Buterin强调,如果能够有效限制代理人之间的串谋,就能取得更好的结果,这一结论也可能适用于人工智能安全。

多年来,治理领域一直在努力寻找反串谋机制。二次投票、提交-披露机制和身份验证层本质上都是旨在增加代理人秘密合作对抗系统的难度的工具。Buterin的论点是,这些机制同样值得在人工智能安全研究中认真考虑。

这些评论是Buterin对人工智能风险的更广泛思考模式的一部分。他之前曾表示,人工智能最严重的风险不是超级智能机器,而是少数企业或政府对它们的控制权集中。他最新的论述将重点转移到结构设计上,认为更好的治理架构(而不仅仅是约束)可能是使先进的人工智能系统与人类利益保持一致的核心。

复制本文链接

快讯文章中币网所有,未经允许不得转载。

相关阅读
更多
相关专题
更多
热门文章
更多