他认为,治理机制与人工智能安全之间存在深层对应关系:两者都涉及”能力较弱的委托方”如何从”能力更强的代理方”中获得理想结果。在人工智能安全场景中,委托方是人类及较弱的大语言模型,代理方则是更强的大语言模型。Vitalik 指出,若能限制代理方之间的合谋程度,系统可实现更优结果,这一机制设计结论或可迁移至人工智能安全领域。
他认为,治理机制与人工智能安全之间存在深层对应关系:两者都涉及”能力较弱的委托方”如何从”能力更强的代理方”中获得理想结果。在人工智能安全场景中,委托方是人类及较弱的大语言模型,代理方则是更强的大语言模型。Vitalik 指出,若能限制代理方之间的合谋程度,系统可实现更优结果,这一机制设计结论或可迁移至人工智能安全领域。