高阶

GTO博弈论基础

25分钟 · 难度 ★★★★

学完你应该能

  • 解释均衡策略、无差异和不可被持续剥削的基本含义
  • 根据下注尺度推导河牌玩具模型中的价值与诈唬比例

先避开这些误区

  • GTO 不是每手牌唯一固定的动作,也不等于面对所有真实对手都必须拒绝剥削调整。

GTO 是什么

博弈论最优(Game Theory Optimal, GTO) 指在二人零和抽象模型下,存在一种策略组合,使得 单方偏离无法在长期提高期望收益。在扑克语境里,常指 按频率混合不同行动(例如用同一手牌部分 check、部分下注),使对手 无法通过简单调整 占你便宜。

GTO 不是「每一手牌只有一个正确答案」,而是 分布上的平衡:强牌与诈唬在尺度与组合上 成比例,对手过跟或过弃都会被惩罚。

与剥削策略的关系

实战中人类对手多有 系统性漏洞(过弃、过跟、尺度单一)。纯剥削 针对漏洞最大化短期 EV;GTO 思维 保证你在 信息不足或对手极强 时不被轻易读穿。

高阶打法常是 混合模型:对大漏洞狠剥削;对未知或强敌用 GTO 骨架 保底,再插入微调。

简单直觉:坚果与诈唬的比例

在简化河牌模型里,若底池为 P、你下注 B,且下注范围只有必胜价值牌与纯诈唬,为让对手的抓诈牌对跟注与弃牌无差别,你下注范围中的理论诈唬占比是 B ÷ (P + 2B)。例如下注半池时,诈唬约占下注范围 25%,即价值 : 诈唬约为 3 : 1;下注满池时,诈唬约占 33.3%,即约 2 : 1。这是玩具模型,不可直接套到有薄价值、分池或非全下的复杂节点。

示例极化局面:你手持坚果或纯诈唬,公共牌为:

河牌

分析时不是猜对手「像不像诈唬」,而是问:我的价值组合与诈唬组合是否成合理比例,使对手 跟与弃都无利可图(在理想模型下)。

学习与工具

求解完整 GTO 需要 Solver(如 Pio、Monker) 与大量算力;大师阶段应理解 输出背后的逻辑:位置、尺度、范围分裂,而不是死记图表。

小结

GTO 是 防剥削的基准线理解扑克的语言。实战中以 范围与频率 思考,再用剥削放大利润,才是完整的高阶框架。

下一步

掌握了本节内容后,继续学习 范围分析,用组合与街-by-街更新把 GTO 语言落到具体决策上,进一步提升你的技能。

课后行动练习

分别为半池、三分之二池和满池河牌下注计算玩具模型诈唬占比,并写出计算依赖的假设。

先写下理由,再查看答案或范围表;重点比较决策过程,不用用单次输赢评价自己。

对应场景练习

用本课知识独立作答,再对照解析检查决策过程。

2