与另个策略“老实人探测器”(NativeProber)开始博弈。事实上,“老实人探测器”并没有出现在阿克塞尔罗德
博弈竞赛中,但它依然是
个富有指导性
策略。这个策略基本等同于“针锋相对”,但每隔
会儿,比如在每十步中任意选择
步,这个策略会打出恶意
“背叛”牌,而获得最高
分数“背叛
诱惑”。如果“老实人探测器”不打出其试探
“背叛”牌,博弈双方便是两个“针锋相对”,打出
场漫长且互利
合作牌,彼此安稳地获得100%
基准分。但突然间(假设在第8回合),“老实人探测器”出其不意地“背叛”
。“针锋相对”却依然不知情地坚持“合作”,也便只能付出“失败者
代价”,得到0分。而“老实人探测器”则能得到最高成绩5分。但在下
步里,“针锋相对”开始报复,复制
对手上
步
行动,打出
“背叛”牌。而“老实人探测器”则盲目地继续原本设定
程序,复制对手上
步
“合作”牌。于是它只能获得0分,而“针锋相对”则得到5分。再下
步,“老实人探测器”极其不公正地又开始
报复,“背叛”
“针锋相对”。反之亦然。在每
轮交替报复
回合里,双方各自平均获得2.5分(5分与0分
平均值)。这依然低于双方持续双向合作所能轻而易举获得
3分(这也是本章前文中尚未解释
“特殊情况”
原因)。于是,当“老实人探测器”与“针锋相对”开始博弈,双方都未能获得两个“针锋相对”博弈时所得
分数。而如果“老实人探测器”互相对弈,其结果只可能更坏,因为这种以牙还牙
冤冤相报可能开始得更早。
让们再来考虑另
个叫“愧疚探测器”(RenwrsefulProber)
策略。这个策略有点类似于“老实人探测器”,但它还加以主动终止循环于双方间
交互背叛。这便需要
种比“针锋相对”或“老实人探测器”更长
记忆。“愧疚探测器”能记住自己是否刚刚主动“背叛”,或者只是为
报复。如果是后者,它便“愧疚地”让对手得到
次反击
机会,而不加以报复。这便将此循环报复行为终结在萌芽状态。如果你在想象中旁观“愧疚探测器”与“针锋相对”
博弈,你会发现可能
循环报复行动不攻自破。博弈中大部分时间都采取互相合作,使得双方都能获得相应
高分。在与“针锋相对”
博弈中,“愧疚探测器”能获得比“老实人探测器”更高
分数,但依然没有“针锋相对”与自
请关闭浏览器阅读模式后查看本章节,否则可能部分章节内容会丢失。