科技
Vitalik:对抗性治理机制设计或可用于AI安全,限制合谋或成未来对AI约束的关键
PANews 9月14日消息,Vitalik 发文表示,对抗性治理机制设计理论的一个重要应用很可能是 AI 安全。Vitalik 对比了两类场景:一类是静态算法作为委托人、人类作为更聪明的代理人;另一类是人类加上较弱 LLM 作为委托人、更强 LLM 作为代理人。两者都是较弱委托人试图从更强代理人那里获得理想结果。Vitalik 强调,若能有效限制代理人之间的合谋,就能取得显著更好的结果,这一结论也可能适用于 AI 安全。未来对 AI 的约束或许更像建立一套包含规则、权限、裁决和记录机制的制度体系,而不只是设置技术“沙箱”。
阅读全文本文仅展示来源提供的标题与摘要,完整内容及版权归原发布方所有。
前往 PANews 原文 FireView 对公开资讯进行聚合和分类,不代表对来源内容的背书,也不构成投资建议。新闻可能存在延迟、修订或错误,请以原发布方为准。
