第 8.2 节 · 共 25 节,第 25 节

博弈均衡

通过约束顶点和收益矩阵理解优化应用。

打开互动动画

01 · Story

在这个场景中要验证什么

沿着说明与运算顺序,确认最终场景中保留了哪些数学证据。

  1. 01

    G记录每对策略组合的收益

  2. 02

    把两个策略等概率混合成p,再乘以G

  3. 03

    payoff是零向量,不偏向任何纯策略
    混合策略产生无法被利用的均衡

02 · Notebook

实际运行的笔记

下面的原文会创建数学对象,并决定运算与动画顺序。阅读后,你可以亲自播放同一个场景。

2d
zoom 1
coordinates on
1 -1  #G
-1 1
// {{G}}记录每对策略组合的收益
checkpoint 博弈均衡

1/2, 1/2  #p@
// 把两个策略等概率混合成{{p}},再乘以{{G}}
G * p  #payoff@
// {{payoff}}是零向量,不偏向任何纯策略\n混合策略产生无法被利用的**均衡**
focus payoff
打开互动动画

03 · 第8课

本单元课程

线性规划与博弈论 — 通过约束顶点和收益矩阵理解优化应用。

  1. 8.1约束与顶点
  2. 8.2博弈均衡