第 8.2 节 · 共 25 节,第 25 节
博弈均衡
通过约束顶点和收益矩阵理解优化应用。
打开互动动画01 · Story
在这个场景中要验证什么
沿着说明与运算顺序,确认最终场景中保留了哪些数学证据。
- 01
G记录每对策略组合的收益
- 02
把两个策略等概率混合成p,再乘以G
- 03
payoff是零向量,不偏向任何纯策略
混合策略产生无法被利用的均衡
02 · Notebook
实际运行的笔记
下面的原文会创建数学对象,并决定运算与动画顺序。阅读后,你可以亲自播放同一个场景。
2d
zoom 1
coordinates on
1 -1 #G
-1 1
// {{G}}记录每对策略组合的收益
checkpoint 博弈均衡
1/2, 1/2 #p@
// 把两个策略等概率混合成{{p}},再乘以{{G}}
G * p #payoff@
// {{payoff}}是零向量,不偏向任何纯策略\n混合策略产生无法被利用的**均衡**
focus payoff
打开互动动画
03 · 第8课
本单元课程
线性规划与博弈论 — 通过约束顶点和收益矩阵理解优化应用。