跳到正文
原文
arXiv:越狱与提示注入· arXiv:2609.19399· Michael Lanier·· 15 天前

RWPS:面向网络安全博弈的高效纳什均衡计算

Efficient Nash Equilibrium Computation for Cybersecurity Games

AI 导读

针对博弈收益只能由模拟器输出、均衡求解受收益估计瓶颈限制的问题,研究者提出 Regret-Weighted Payoff Sampling(RWPS),把固定模拟预算集中用于均衡真正依赖的收益,并用已测收益训练模型预测其余收益。该方法给出按对手均衡策略加权收益误差的界,在三个合成一般和博弈(含 Colonel Blotto)上比标准界紧 4 至 6 倍,并在同等预算下比 minimum-regret-first search、information-gain search 和 progressive sampling 找到更不易被利用的均衡。

阅读原文arxiv.org