博弈论混合策略纳什均衡
混合策略纳什均衡
(混合策略纳什均衡)
一个不存在纳什均衡的例子
硬币配对——“零和博弈”(zero sum game)
甲乙各持一枚硬币,同时选择手中硬币的正反面。 若他们硬币的朝向相同,乙将赢得甲的硬币。反之,甲将赢得乙的硬币。
参与人乙 正面H
正面H -1,+1 +1,-1
反面T
+1,-1 -1,+1
按照无差异原则,均衡中的q应使这两个表达式相等。
硬币配对博弈的混合策略均衡
参与人2
正面H(q) 参与人1 正面H 反面T -1,+1 +1,-1 反面T(1-q) +1,-1 -1,+1
• 也就是:1-2q=2q-1,即q=0.5 • 对称地,可以得到参与人1的最佳应对p=0.5 • 因此,(0.5,0.5)是这个硬币配对博弈的混合策略纳什均衡(符合直
在各自概率策略的选择下,双方的期望收益互为最大(任何单方面 改变不会增加其收益) 纳什证明:具有有限参与者和有限纯策略集的博弈一定存在纳什均 衡(包括混合策略均衡) 一般来说,找到混合策略的纳什均衡是很困难的,但在某些特定条 件下能有系统的方法。
双人双策略、不含纯策略均衡的博弈——混合策略纳 什均衡
考虑硬币面向的博弈
他 正面H H 你 T +1,-1 -1,+1 -1,+1 反面T +1,-1
• 你若知道对方的策略是以0.7的 概率出H,你会采取什么策略? 如果他的概率是0.2呢?
• 你若知道对方的策略是以0.5的概率 出H,你会采取什么策略?
“0.5”策略在此有什么特别?
如果对方用0.5,我出什么都
混合策略的收益计算例子
博弈论三种均衡的异同
问题:博弈论三种均衡的异同结合工作实践举一个例子,谈以下三种均衡的异同,1、占优策略均衡,2、纳什均衡,3、混合策略纳什均衡。
国企办公室当中的智猪博弈。
“大猪”们辛辛苦苦加班,工资一分也不多拿,“小猪”们一边逍遥自在,工资一分也不少拿,这种情况在国企办公室里比比皆是。
很遗憾,我就是“大猪”们中的一员,因为我们什么都缺,尤其缺能干的人,就是不缺人。
严格占优均衡(DSE)、重复剔除占优均衡(IEDE)、纯策略纳什均衡(PNE)、混合策略纳什均衡(MNE),前一个均衡是后一个均衡的特例,后一个均衡是前一个均衡的扩展,即DSE是IEDE的子集,IEDE是PNE的子集,PNE是MNE的子集。
他们的区别如下:1、占优策略“不管你怎么做,我所做的都是我能做得最好的。
”其他人无论采取什么策略,目前你采取的策略就是最优的,永远不会改变。
2、纳什均衡:在一种策略组合上,其他人不改变策略时,那么你就不会改变策略,因为目前最优。
★“给定你的做法后,我所做的是我能做得最好的。
”★“给定我的做法后,你所做的是你能做得最好的。
”★如果你有占优策略, 你可以使用此策略, 以不变应万变;★如果你没有占优策略, 你必须随机应变。
在达到了纳什均衡之后, 所有参与者都没有动机想再变了。
纳什均衡是常态,帕累托最优几乎不存在。
经典案例:囚徒困境。
3、混合策略纳什均衡由所有参与人的混合策略构成的纳什均衡。
有些博弈不存在纳什均衡,或者纳什均衡不唯一,如猜硬币博弈。
要想为博弈方的选择和博弈结果做明细的预测,就要用到混合策略纳什均衡。
混合策略纳什均衡是面对其他博弈者选择的不确定性的一个理性对策,其主要特征是作为混合策略一部分的每一个纯策略有相同的期望值,否则,一个博弈者会选择那个期望值最高的策略而排除所有其他策略,这意味着原初的状态不是一个均衡。
混合策略纳什均衡
02
混合策略纳什均衡的基本理论
纳什均衡的定义与性质
纳什均衡的定义
在博弈中,如果每个玩家都采取自己的最优策略,那么整个博弈会达到一种均 衡状态,即所有参与者的利益达到最大化。
纳什均衡的性质
纳什均衡是一种自我稳定的状态,即使受到外部干扰,也会迅速恢复到原始状 态。此外,纳什均衡也是最优的,因为它使得每个参与者的利益都达到最大化 。
其次,现有的研究往往只关注特定的博弈模型, 对于更一般化的博弈模型,尤其是对于连续型博 弈和多阶段博弈的研究还比较缺乏。
首先,混合策略纳什均衡的概念和性质仍需进一 步深化和研究。例如,对于非完全信息博弈,如 何准确地刻画混合策略纳什均衡点的数量和分布 等问题仍需探索。
最后,现有的研究主要集中在理论层面,对于如 何将混合策略纳什均衡应用到实际问题中,如何 设计和制定有效的混合策略等问题还需要进一步 探讨。
未来研究方向与挑战
未来研究可以进一步拓展混合策略纳什均衡的应用领域,例如在经济学、政治学、社会学等领域的应 用。
另外,针对现有的研究不足,未来研究可以深入探索混合策略纳什均衡的性质和计算方法,以及如何设 计和制定有效的混合策略等问题。
此外,未来的研究还可以进一步拓展混合策略纳什均衡的理论框架,例如在多阶段博弈、不完全信息博 弈、非线性博弈等领域的研究。
略纳什均衡来分析。
在生物学领域的应用
在生物学中,混合策略纳什均衡可以用来研究生物种 群的进化稳定性和生态平衡。
在生态系统中,生物种群可以通过选择不同的繁殖、 迁徙、捕食等策略来适应环境变化,这种博弈关系可 以通过混合策略纳什均衡来分析。
在其他领域的应用
在社会学中,混合策略纳什均衡可以用来研究社会群 体中的合作与竞争关系。
3-混合策略的纳什均衡
博弈论教学/混合策略的纳什均衡出自MyKnowledgeBase< 博弈论教学Bread crumbs: Main Page > 博弈论教学/混合策略的纳什均衡目录■1 复习■2 混合策略(Mixed strategy)■2.1 举例/Example■2.2 概念■2.3 纯策略和混合策略■2.4 混合策略的争议■3 混合策略的纳什均衡■3.1 基本概念■3.2 混合策略纳什均衡的存在性/纳什定理■3.3 学术争议与批评■4 混合策略纳什均衡举例■4.1 社会福利博弈Social Welfare Game■4.1.1 博弈分析(方法1:收益无差异)■4.1.2 博弈分析(方法2:图形分析法)■4.1.3 博弈分析(方法3:导数(Derivative)极值法)■4.2 普通例子■4.3 审计博弈(Tax Game)■4.4 激励的悖论[5]■4.5 求解纳什均衡的一般方法■5 多重纳什均衡■5.1 多重纳什均衡举例■5.1.1 夫妻之争■5.1.2 制式问题■5.1.3 市场机会博弈■5.2 多重纳什均衡分析■5.2.1 帕累托上策均衡(Pareto Dominated Equilibrium)■5.2.1.1 帕累托最优Pareto optimality■5.2.1.2 帕累托上策均衡(Pareto Dominated Equilibrium)■5.2.1.3 举例分析■5.2.2 风险上策均衡(Risk-dominant Equilibrium)■5.2.3 聚点均衡(Focal Points Equilibrium)■5.2.4 相关均衡■5.2.5 抗共谋均衡(coalition-proof Nash equilibrium)■6 纳什均衡的意义■7 作业■8 参考文献pure strategy)相对应。
混合策略:在博弈中,博弈方的策略空间为,则博弈方i以概率分布随机在其选策略中选择的“策略”,称为一个“混合策略”,其中,对都成立,且。
混合策略纳什均衡例子
混合策略纳什均衡例子混合策略纳什均衡是博弈论中的一个重要概念,指的是各参与者选择一个概率分布作为他们的策略,从而达到一个稳定的状态。
在混合策略纳什均衡中,没有任何参与者可以通过单独改变自己的策略来获得更好的结果。
一个经典的混合策略纳什均衡的例子是“岩石-剪刀-布”游戏。
在这个游戏中,两个参与者(称为玩家1和玩家2)可以选择出岩石、剪刀或布中的任意一种。
每一种选择都有一定的胜负规则:岩石胜剪刀,剪刀胜布,布胜岩石。
假设玩家1选择出岩石、剪刀和布的概率分别为p1、q1和r1,玩家2选择出岩石、剪刀和布的概率分别为p2、q2和r2。
两个玩家的利益可以用一个支付矩阵表示如下:| 岩石 | 剪刀 | 布-----------------------------岩石 | 0 | -1 | 1-----------------------------剪刀 | 1 | 0 | -1-----------------------------布 | -1 | 1 | 0在混合策略纳什均衡中,每个玩家选择的概率分布必须使得对于每一种选择,玩家都不希望改变自己的概率分布。
在这个例子中,我们可以通过计算来找到混合策略纳什均衡。
假设玩家1选择出岩石的概率为p1,则选择剪刀的概率为q1=1-p1-0=1-p1,选择布的概率为r1=0-0=0。
同样地,玩家2选择出岩石的概率为p2,则选择剪刀的概率为q2=1-p2-0=1-p2,选择布的概率为r2=0-0=0。
为了找到混合策略纳什均衡,我们需要检查每一种选择,并确保玩家对于每一种选择都不希望改变自己的概率分布。
在这个例子中,无论玩家1选择什么概率分布,玩家2都可以通过选择相应的概率分布来获得更好的结果。
所以,不存在一个混合策略纳什均衡。
总结起来,混合策略纳什均衡是博弈论中一种稳定的策略选择状态,即不存在任何参与者可以通过单独改变自己的策略来获得更好的结果。
岩石-剪刀-布游戏是一个经典的混合策略纳什均衡的例子,其中玩家的选择概率分布是关键因素。
博弈论-混合策略纳什均衡
政治学的案例分析
总结词:国际关系
详细描述:在国际关系中,混合策略纳什均衡可以用来解释 国家之间的竞争和合作。例如,两个国家可能会以一定的概 率选择不同的外交政策,例如结盟、中立或对抗,以达到各 自的利益最大化。
生物学的案例分析
总结词
捕食者-猎物博弈
详细描述
在生物学中,混合策略纳什均衡可以用来解释捕食者与猎物之间的博弈。例如,捕食者 可能会采用追逐和放弃两种策略来捕猎猎物,而猎物也可能会采用逃跑和装死两种策略 来避免被捕食。最终,捕食者和猎物都以一定的概率随机选择不同的策略,以达到均衡
非合作博弈论
研究个体如何在不知道其 他个体如何行动的情况下 做出最优决策。
博弈论的基本概念
参与者
参与博弈的决策主体, 可以是个人、组织或国
家。
行动
参与者根据给定的信息 所做出的决策。
信息
参与者在进行决策时所 拥有的数据、情报或知
识。
策略
参与者为达到最优结果 而采取的一系列行动的
方案。
博弈论的应用场景
状态。
生物学的案例分析
总结词:繁殖竞争
VS
详细描述:在生物种群中,不同个体 之间会存在繁殖竞争。为了最大化自 己的遗传贡献,个体可能会采用不同 的交配策略,例如追求高繁殖成功率 的策略或避免过度竞争的策略。混合 策略纳什均衡可以用来描述这种竞争 状态下的交配行为。
THANKS FOR WATCHING
繁殖博弈
在繁殖博弈中,生物个体通过选择不同的繁殖和竞争策略来繁衍后代。混合策略纳什均衡可以用来分 析繁殖过程的均衡结果,解释生物多样性的形成机制。
05 混合策略纳什均衡的案例 分析
经济学的案例分析
博弈论混合策略纳什均衡名词解释
博弈论混合策略纳什均衡名词解释博弈论混合策略纳什均衡是指在博弈论中,当参与者不能确定选
择某一个策略时,采取混合策略的情况下达到的均衡状态。
具体来说,混合策略是指在一个博弈中,参与者以一定的概率选
择不同的纯策略。
而纳什均衡是指在一个博弈中,参与者无法通过单
独改变自己的选择来获得更好的结果,即不存在任何参与者可以通过
改变自己的策略来让其他参与者不再选择当前策略。
混合策略纳什均衡是指游戏中所有参与者以一定的概率选择不同
的纯策略,并且这种概率分配对于所有参与者都是最优的。
也就是说,在混合策略纳什均衡下,参与者没有更好的选择可供其采取,而其他
参与者也没有更好的概率分配可供其选择。
拓展:
在博弈论中,还有许多其他类型的均衡概念,例如纯策略纳什均衡、帕累托均衡、部分均衡等等。
纯策略纳什均衡是指游戏中参与者
以确定性的纯策略进行选择,使得没有参与者可以通过改变其策略来
获得更好的结果。
帕累托均衡是指在一个博弈中,不存在可以改善任
何一个参与者的情况。
部分均衡是指只有某些参与者达到均衡状态,而其他参与者未达到均衡状态。
博弈论是研究决策制定者在相互影响下进行决策的数学工具。
通过分析不同的博弈策略和可能的结果,博弈论可以帮助我们理解冲突和合作的情况,并提供一些决策建议。
混合策略纳什均衡
博弈论 第三章 混合策略纳什均衡
r*=R(q)
反应对应曲线
第二节 混合策略纳什均衡的求解方法
二、反应对应法
例:扑克牌对色游戏(p77)
再看乙的最优反应,记为q*=R(r): 观察π乙(p甲, p乙)= 2q(2r-1)-(2r-1)
若r 1 / 2 2r 1 0, q越大越好 1, q* R( r ) [0,1], 若r 1 / 2 2r 1 0,无论q选什么都无影响 0, 若r 1 / 2 2r 1 0, q越小越好
博弈论 第三章 混合策略纳什均衡
第二节 混合策略纳什均衡的求解方法
二、反应对应法
例:扑克牌对色游戏(p77)
先看甲的最优反应,记为r*=R(q): 观察π甲(p甲, p乙)= 2r(1-2q)+(2q-1)
若q 1 / 2 1 2q 0, r越小越好 0, r* R( q) [0,1], 若q 1 / 2 1 2q 0,无论r选什么都无影响 1, 若q 1 / 2 1 2q 0, r越大越好
解:Max π甲(p甲, p乙) r Max π乙(p甲, p乙) q
f.o.c. 2r-1=0
r*=1/2
混合策略纳什均衡是甲在策略空间{红,黑}上以概率分布 p甲*= (1/2,1/2)进行选择,乙也在策略空间{红,黑}上以概率p乙*= (1/2,1/2)进行选择
博弈论 第三章 混合策略纳什均衡
第二节 混合策略纳什均衡的求解方法
二、支付最大化法
例:扑克牌对色游戏(p77)
无纯策略NE 给定混合策略p甲=(r,1-r); p乙=(q,1-q) π甲(p甲, p乙)=r[q(-1)+(1-q) 1]+ (1-r)[q1+(1-q)(-1)] = 2r(1-2q)+(2q-1) π乙(p甲, p乙)=q [r1+(1-r)(-1)]+ (1-q)[r(-1)+(1-r)1] =2q(2r-1)-(2r-1) f.o.c. 1-2q=0 q*=1/2
博弈论---混合战略纳什均衡
义为:
n
vi ( i , i ) ( j (s j ))ui (s) sS j1
n个参与人的混合战略纳什均衡
让我们以两人博弈为例说明这一点。假定S1 (s11, , s1K ) ,
即参S2与人(s12有1 ,K 个, s2纯J )战略,参与人2有J个纯战略。若参与人1相
1k
2 j u1 ( s1k , s2 j )
1k 2 j u1 ( s1k , s2 j )
K 1
j 1
K 1 j1
这里,1k 2 j 是参与人1选择 s1k 且参与人2选择 s2 j 的概率,即纯 战略组合 (s1k , s2 j )发生的概率。
n个参与人的混合战略纳什均衡
混合战略纳什均衡
用上述方法:求该猜谜游 戏的混合战略纳什均衡
正面 反面
正面
1 -1,
-1 1,
反面
-1 1,
1 -1,
如何理解混合战略 ——虚张声势
一个参与人选择混合战略的目的是给其 他参与人造成不确定性,这样尽管其他 参与人知道他选择某个特定纯战略的概 率是多少,但不知道实际上对手会采用 哪个战略。正是因为它在几个战略之间 的无差异性,他的行为才难以预测,混 合战略均衡才会出现。
小猪
大猪
按 等待
按 5,1 9,-1
等待 4,4 0,0
正面
1
正面 -1,
反面
-1 1,
-1
反面 1,
1 -1,
混合战略纳什均衡
在n个参与人博弈的战略式表述 G S1,, Sn;u1,,un
中,假定参与人 i 有K个纯战略:Si Si1, , Sik ,那么,
与人关心的是其期望效用。 最优混合战略:是指使期望效用函数最大的混合
混合策略纳什均衡
03 混合策略纳什均衡的证明 方法
反证法
总结词
通过假设不成立来证明均衡的存在。
详细描述
反证法是一种常用的证明方法,它首先假设与结论相反的命题成立,然后通过逻辑推理和数学推导,得出矛盾的 结论,从而证明原命题的正确性。在证明混合策略纳什均衡的存在时,反证法可以用来证明当其他玩家采取了最 优策略时,某个玩家采取混合策略能够达到最优结果。
唯一性意味着在给定对手策略的情况下,每个参与者都只有一个最优反应,从而 避免了复杂的策略互动和不确定性。
存在性
混合策略纳什均衡的存在性是指在某 些博弈中,至少存在一个策略组合, 使得每个参与者在给定其他参与者策 略的情况下,采用混合策略是最优的 。
存在性通常通过数学证明和计算机搜 索等方法来证明,但并不是所有博弈 都有混合策略纳什均衡。
混合策略纳什均衡
目录
CONTENTS
• 混合策略纳什均衡的定义 • 混合策略纳什均衡的特性 • 混合策略纳什均衡的证明方法 • 混合策略纳什均衡的应用场景 • 混合策略纳什均衡的局限性 • 混合策略纳什均衡的发展前景
01 混合策略纳什均衡的定义
定义
混合策略纳什均衡是一种博弈论中的均衡概念,它描述了在 给定对手策略的情况下,参与者如何选择最优策略以最大化 自己的期望收益。
代数法是一种通过数学符号和公式进行推 理和证明的方法。在证明混合策略纳什均 衡的存在时,代数法可以用来推导和证明 纳什均衡的条件和性质,利用代数性质和 技巧来证明均衡的存在。
04 混合策略纳什均衡的应用 场景
经济学
竞争策略分析
混合策略纳什均衡在经济学中被用于分析竞 争策略,特别是在不完全竞争市场和寡头垄 断市场中。通过混合策略纳什均衡,可以研 究企业在不确定环境下的最优反应,以及企 业如何通过调整其策略来应对竞争对手的行 为。
混合策略纳什均衡
第二节 混合策略纳什均衡的求解方法
二、反应对应法
例:扑克牌对色游戏(p77)
先看甲的最优反应,记为r*=R(q): 观察π甲(p甲, p乙)= 2r(1-2q)+(2q-1)
若q 1 / 2 1 2q 0, r越小越好 0, r* R( q) [0,1], 若q 1 / 2 1 2q 0,无论r选什么都无影响 1, 若q 1 / 2 1 2q 0, r越大越好
纯策略(确定性)
q*=R(r)
(陈明德语) r 1 3/4
r*=R(q)
0 1/4 1 q (钟信德语)
博弈论 第三章 混合策略纳什均衡
第三节 寻找多重纳什均衡
二、反应对应法:情侣博弈
支付的帕累托优势:初步印象 π陈明=r(4q-1)+2(1-q),π钟信=q(4r-3)+(3-2r) r*=0, q*=0 纯策略(确定性)
第三节 寻找多重纳什均衡
例:情侣博弈
两个(多个)纯策略纳什均衡 问题:纳什均衡找完了吗?有无混合策略纳什均衡?
一、支付最大化法
给定混合策略p陈明=(r,1-r); p钟信=(q,1-q) Max π陈明(p陈明, p钟信)=r[3q+(1-q) ]+ (1-r)[0+2(1-q)] =r(4q-1)+2(1-q) r Max π钟信(p陈明, p钟信)=q (2r+0)+ (1-q)[r+3(1-r)] =q(4r-3)+(3-2二节 混合策略纳什均衡的求解方法
二、反应对应法
例:扑克牌对色游戏(p77) 无纯策略NE 给定混合策略p甲=(r,1-r); p乙=(q,1-q)
混合策略纳什均衡
混合策略纳什均衡混合策略纳什均衡是博弈论中一个重要的概念。
纳什均衡是指在一个博弈中,每个参与者都选择了最优的策略,而且即使其他参与者知道其他参与者的策略,他们也无法从自己的策略中获得更大的利益。
而混合策略则是指参与者通过随机化选择不同策略的概率来达到最优策略。
本文将深入探讨混合策略纳什均衡的概念、特点以及计算方法。
首先,混合策略纳什均衡是指参与者通过一定概率选择不同策略的方式达到最优策略。
在混合策略中,每个参与者都拥有一个策略概率分布,表示他们在不同策略下的选择概率。
这样,在博弈中,每个参与者将根据其策略概率分布中的概率随机选择其中一种策略。
对于每个参与者而言,他们的目标是通过选择最优的策略概率分布来最大化自己的期望收益或最小化自己的期望损失。
其次,混合策略纳什均衡与纳什均衡相比具有以下特点。
首先,混合策略纳什均衡可以推翻完全信息博弈中的固定策略均衡结果。
在完全信息博弈中,参与者可以根据对其他参与者策略的了解来做出精确决策,因此均衡状态是唯一确定的。
而在混合策略博弈中,由于参与者通过概率选择不同策略,他们无法准确地预测其他参与者的策略,因此均衡状态不再是唯一确定的。
其次,混合策略纳什均衡可以引入不确定性,增加博弈的复杂性。
参与者无法准确地预测其他参与者的策略,因此他们需要通过一定的概率选择策略来平衡风险与收益。
最后,混合策略纳什均衡可以通过均衡态的共同选择来实现长期的稳定状态。
在混合策略纳什均衡中,参与者通过随机化选择策略,从而消除了其他参与者可以预测自己策略的可能性,增加了稳定性。
最后,计算混合策略纳什均衡的方法主要有以下两种。
一种是通过计算参与者的最优策略概率分布来确定混合策略纳什均衡。
这种方法主要基于线性规划技术,通过最大化或最小化参与者的期望收益或损失来确定最优的策略概率分布。
另一种方法是通过迭代算法来求解混合策略纳什均衡。
这种方法主要是通过反复更新参与者的策略概率分布,直到达到均衡状态。
混合纳什均衡计算
混合纳什均衡计算
混合纳什均衡计算是博弈论中的一种计算方法,用于确定一种游戏中每个参与者的最优策略组合。
该方法基于每个参与者的预期效用最大化,通过分析参与者之间的相互作用来确定最优策略的概率分布。
具体步骤如下:
1.确定每个参与者的策略空间,即可选的所有策略。
2.针对每个参与者选择一个混合策略,即概率分布,表示以多
大概率选择某个策略。
每个混合策略都必须满足概率和为1的条件。
3.根据参与者的混合策略,计算每个参与者的预期效用。
4.针对每个参与者的混合策略进行优化,以提高预期效用。
这
可能涉及到增加或减少某个策略的概率。
5.重复步骤3和4,直到达到一个平衡点,即每个参与者都无
法通过调整自己的混合策略来获得更高的预期效用。
最后,混合纳什均衡计算得出的每个参与者的最优策略组合是一个概率分布,它描述了每个参与者在不同策略下的选择概率。
这个最优策略组合也被称为混合纳什均衡,符合最优反应理论和稳定性概念。
混合策略纳什均衡计算方法
混合策略纳什均衡计算方法
混合策略纳什均衡是博弈论中的一种解决方法,它指的是在博弈中每个玩家都使用多种策略的概率分布,使得任何一个玩家单独改变自己的策略都不会导致自己的收益增加。
计算混合策略纳什均衡需要使用到线性规划的方法。
具体来说,可以通过列出每个玩家的收益矩阵和概率分布向量的线性规划问题,然后求解这些线性规划问题的最优解从而得到混合策略纳什均衡。
在求解线性规划时,通常使用单纯形法或内点法等算法。
这些算法的基本思想是从某个初始解开始,逐步移动到更优的解,直到不能找到更优解为止。
需要注意的是,在实际应用中,混合策略纳什均衡的计算可能比较复杂,特别是当博弈参与者数量较多或者策略空间较大时。
此外,即使得到了混合策略纳什均衡,也不一定能保证博弈的稳定性,因此需要对结果进行进一步的分析和评估。
总之,混合策略纳什均衡是博弈论中的一种重要解决方法,对于理解和分析博弈问题具有重要的意义。
《经济博弈论》复习题参考答案
《经济博弈论》复习题及参考答案一、名词解释1、混合战略纳什均衡如果在博弈的利益表中,无法找到任何一方都可以接受(不一定利益最大化)的方案,也就是没有哪一种组合是在给定对手策略下没有动机改变自己策略的情况。
这时博弈没有纯策略均衡,需要一个“概率表”指导博弈结果。
在博弈G={S1,S2……Sn;U1,U2……Un}中第i个博弈方策略空间为Si={Si1……Sik}则博弈方以概率分布Pi=(Pi……Pik)随机在k个可选策略中选的的策略称为一个混合策略纳什均衡。
2、子博弈精炼纳什均衡对于扩展式博弈的策略组合S*=(S1*,…,Si*,…,Sn*) ,如果它是原博弈的纳什均衡;它在每一个子博弈上也都构成纳什均衡,则它是一个子博弈精炼纳什均衡。
子博弈精练纳什均衡所要求的是参与人应该是序惯理性的。
对于有限完美信息博弈,逆向归纳法是求解子博弈精炼纳什均衡的最简便的方法。
3、完全信息动态博弈完全信息动态博弈,是指博弈中信息是完全的,即双方都掌握参与者对他参与人的战略空间和战略组合下的支付函数有完全的了解,但行动是有先后顺序的,后动者可以观察到前者的行动,了解前者行动的所有信息。
4、不完全信息动态博弈指在动态博弈中,行动有先后次序,博弈的每一参与人知道其他参与人的有哪几种类型以及各种类型出现的概率,即知道“自然”参与人的不同类型与相应选择之间的关系,但是,参与人并不知道其他的参与人具体属于哪一种类型。
由于行动有先后顺序,后行动者可以通过观察先行动者的行为,获得有关先行动者的信息,从而证实或修正自己对先行动者的行动。
5、完全信息静态博弈完全信息静态博弈指的是信息对于博弈双方来说是完全公开的情况下,双方在博弈中所决定的决策是同时的或者不同时但在对方做决策前不为对方所知的。
6、囚徒困境囚徒困境是博弈论的非零和博弈中具代表性的例子,反映个人最佳选择并非团体最佳选择。
虽然困境本身只属模型性质,但现实中的价格竞争、环境保护等方面,也会频繁出现类似情况。
混合策略纳什均衡
混合策略纳什均衡简介混合策略纳什均衡是博弈论中的一个重要概念,用于描述多方参与的博弈情境中,每个参与者按照一定的概率分布选择不同的策略,使得任何人无法通过改变自己的策略来获得更好的结果。
在这种均衡状态下,每个参与者的预期收益最大化。
混合策略在传统的博弈理论中,参与者通常会选择一个确定性的策略来对抗其他参与者。
然而,在现实生活中,我们经常遇到的情况是,每个参与者都存在一定的不确定性和随机性,犹豫在不同的策略之间选择。
这时,混合策略就应运而生了。
混合策略是指参与者以一定的概率分布选择不同的策略来进行博弈。
例如,在一个石头剪刀布的游戏中,参与者可以以1/3的概率选择石头,1/3的概率选择剪刀,1/3的概率选择布。
这样的不确定性选择使得博弈更具有变数和策略性。
纳什均衡纳什均衡是由约翰·福布斯·纳什在20世纪50年代提出的一个概念,用于描述博弈理论中的均衡状态。
在纳什均衡中,每个参与者选择的策略都是最优的,即在其他参与者选择的策略下,自己无法通过改变策略来获得更好的收益。
通常情况下,纳什均衡是以确定性策略为基础进行定义的。
但是当参与者选择混合策略时,纳什均衡也可以被定义为每个参与者选择混合策略的概率分布,使得任何人都无法通过改变自己的概率分布来获得更高的收益。
混合策略纳什均衡的计算方法计算混合策略纳什均衡的方法主要是通过解析求解和数值求解两种方式。
解析求解解析求解是一种通过代数和数学推导的方式来找到混合策略纳什均衡的方法。
通过建立参与者的效用函数和概率分布函数等数学模型,应用最优化理论和微积分等数学工具,可以得到参与者的最优混合策略。
然而,解析求解的方法通常只适用于简单的博弈情境,并且求解过程繁琐复杂。
数值求解数值求解是一种通过计算机模拟和迭代计算的方式来找到混合策略纳什均衡的方法。
通过构建博弈模型,设定参与者的初始混合策略,然后通过迭代计算,逐渐优化参与者的混合策略,直到收敛到纳什均衡。
混合策略纳许均衡课件
策略纳什均衡的算法优化。
混合策略纳什均衡与人工智能
02
随着人工智能的发展,可以尝试将混合策略纳什均衡应用于机
器学习和人工智能领域,以实现更高效和智能的决策。
混合策略纳什均衡与演化博弈论的结合
03
研究混合策略纳什均衡与演化博弈论的结合,可以更好地解释
现实生活中的动态博弈现象。
06
参考文献
参考文献
定义
混合策略纳什均衡课件
CONTENTSБайду номын сангаас
• 混合策略纳什均衡简介 • 混合策略纳什均衡的数学模型 • 混合策略纳什均衡的求解方法 • 混合策略纳什均衡的应用实例 • 混合策略纳什均衡的挑战与展
望 • 参考文献
01
混合策略纳什均衡简介
定义与概念
混合策略纳什均衡是一种博弈论中的概念,它描述了在给定对手策略的情况下,参 与者如何选择最优的行动方案。
定义策略空间
为每个参与人定义一个策略选 择的空间,这些策略可以是离 散的、连续的或混合的。
定义支付函数
根据每个参与人的策略选择, 定义他们的支付函数,即每个 参与人在该策略下的期望收益。
构建博弈矩阵
根据参与人的策略空间和支付 函数,构建一个博弈矩阵,用 以表示每个参与人选择不同策
略时的收益。
模型参数解 释
纳什均衡点或满足一定的收敛条件。
优化算法
优化算法是一种基于数学优化的方法,用于求解混合策略纳什均衡。
优化算法的基本步骤包括:定义一个目标函数,然后使用优化算法(如 梯度下降法、牛顿法等)寻找目标函数的最大值或最小值,从而得到纳
什均衡点。
优化算法的优点是能够快速找到纳什均衡点,适用于大规模问题。但缺 点是需要对问题进行数学建模,且对初始点的选择敏感。
- 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
- 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
- 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。
略纳什均衡才会存在。
讨论
• 尽管混合策略不像纯策略那样直观,但它确实是一些博弈中参与人的合理行为方式。扑克比 赛、垒球比赛、划拳就是这样的例子,在这一类博弈中,参与比赛的总是随机行动以使自己 的行为不被对方所预测。
博弈论混合策略纳什均衡
§剪刀、石头、布的游戏
• 每个同学跟后面一排对应的同学玩剪刀、石头、布的游戏. • 玩二十次,将结果记下来 • 赢了十次以上同学举起手来 • 告诉我你有什么秘决 • 怎么样才能赢得多?
§剪刀、石头、布的游戏
• 我们知道—— • 如果博弈只进行一次,我们无法明确预测博弈的结果,不管是哪个博弈方,也不管他们的选择
E A U p 1 X 1 p 2 X 2 . .p .n X n
政府和流浪汉的博弈
• 政府想帮助流浪汉,但前提是后者必须试图寻找工作,否则,不予帮助;而流浪汉若知道找工作。他们获得的支付 如图所示:
政府
救济 不救济
流浪汉
对上述效用函数求微分,得到政府最优化的一阶条件为:
v G 5 1 0 0 .2
就是说,从政府的最优化条件找到流浪汉混合策略——流浪汉以0.2的概率选择寻找工作,0 .8的概率 选择游闲。
• 解一:支付最大化 • 流浪汉的期望效用函数为:
L
2 1 0
0.5
• 政府选择救济策略
是哪个策略,都不能保证得到较好的结果。根据我们上一章所学的方法,这个博弈没有纳什均 衡。 • 那么是不是意味着这样的博弈中,你可以随意选择,结果都一样呢?
§剪刀、石头、布的游戏
• 答案是否定的。 • 事实上,局中人的选择仍然是很有讲究的,策略选择的好坏对局中人的利益仍然有很大的影响。 • 在这个零和博弈里,无论双方采用哪种策略组合,结果都是一方输一方赢,而输的一方又总是
可以通过单独改变策略而反输为赢。如果哪个局中人能找到对手方的规律或者偏好,他就能猜 测到对手的策略而采用针对性策略从而保证赢。
§剪刀、石头、布的游戏
• 因此,秘决在于—— • 自己的策略选择不能预先被对手方知道或猜测到,在该博弈的多次重复中,博弈方一定要避免
自己的选择具有规律性; • 观察对手方策略选择是否具有规律或者偏好,预先猜测对手策略,从而采用针对性策略赢得这
• 经济学上的监督博弈也是这样一个例子。如税收检查、质量检查、惩治犯罪、雇主监督雇员 等都可以看成猜谜博弈。
纳什均衡的存在性
纳什定理:在一个由n个博弈方的博弈
中,如果n是有限的,且 都是有限集
S G {S, S;u, u} (对
),则该博弈至少存在一个纳什均衡,但可能包含混合策i略。1 1,nn 1
vL1,13vL0, 0.5
政府和流浪汉的博弈
• 如果政府救济的概率小于0.5; • 则流浪汉的最优选择是寻找工作; • 如果政府救济的概率大于0.5; • 则流浪汉的最优选择是游闲等待救济。 • 如果政府救济的概率正好等于0.5; • 流浪汉的选择无差异。
讨论
• 上面的均衡要求每个参与人以特定的概率选择纯策略。也就是说,一个参与人选择不同策略 的概率不是由他自己的支付决定的,而是由他的对手的支付决定的。
求解混合策略纳什均衡
1、假定政府采用混合策略:
G,1 即政府 的以 概率选1择 的 救概 济率 ,选择不
2、流浪汉的混合策略为:
L,1 即流浪 的汉 概以 率选择 1寻 的找 概工 率作 选, 择
解一:支付最大化 那么,政府的期望效用函数为:
v G G , L 3 1 1 1 0 1 5 1
解二:支付等值法 • 政府选择不救济策略
1
期望效用
0 期望效用
vG1, 3 11 vG0, 1 01
4 1
如果一个混合策略是流浪汉的最优选择,那一定意味着政府在救济与不救济之间是无差异的,即:
v G 1 ,4 1 v G 0 , 0 .2
• 解二:支付等值法
如果一个混合策略是政府的最优选择,那一定意味着流浪汉在寻找工作与游闲之间是无差异 的,即:
寻找工作
游闲
政府和流浪汉的博弈
• 思考:政府会采用纯策略吗?流浪汉呢?这个博弈有没有纯策略的纳什均衡? • ——跟你玩剪子石头布游戏一样,你会一直采用纯策略吗? • 那么政府和流浪汉最有可能采用什么策略? • ——使自己的预期支付最大化。 • ——若能够猜的对方的策略,就可以采用针对性的策略,使自己的支付增加。
n
• 证明过程省略,主要根据是布鲁威尔和角谷i 的不动点定理。
• 纳什均衡的普遍存在性正是纳什均衡成为非合作博弈分析核心概念的根本原因之一。
§扑克牌对色游戏
• 甲乙玩扑克牌对色游戏,每人都有红黑两张扑克牌,约定如果出牌颜色一样,甲输乙赢,如果 出牌颜色不一样,则甲赢乙输。
• 找到这个博弈的纳什均衡。
个博弈。
§ 第三章 混合策略纳什均衡
• 纯策略(pure strategies):如果一个策略规定参与人在一个给定的信息情况下只选择一种特定 的行动。
• 混合策略(mixed strategies):如果一个策略规定参与人在给定的信息情况下,以某种概率分 布随机地选择不同的行动。
• 在静态博弈里,纯策略等价于特定的行动,混合策略是不同行动之间的随机选择。
§ 期望支付 • 与混合策略(mixed strategies)相伴随的一个问题,是局中人支付的不确定性(uncertainty).可
用期望支付(expected payoff)来描述——有个n可能的取值X1,X2…,Xn ,并且这些取值发生 的概率分别为p1,p2,…,pn,那么我们可以将这个数量指标的期望值定义为发生概率作为权 重的所有可能取值的加权平均,也就是
红 甲
黑
红 -1, 1 1, -1
乙 黑
1, -1 -1, 1
§ 反应函数法
• 假设甲、乙均采用混和策略,随机地以p的概率出红牌和以(1-p)的概率出黑牌,而乙则随机地以 q的概率出红牌和以(1-q)的概率出黑牌。