PLO Camp

整手规划

翻牌的筹码底池比在翻牌之前就定了

筹码底池比在翻牌之前就定了

本课程的全街实战是一张单挑桌:两个座位,按钮位就是小盲。双方都是 100 个大盲,盲注是 0.51。下面没有一个数字是口味问题——本页每一笔加注都是 pot-limit 的上限,是算出来的,不是挑出来的。

游戏规则:最大的合法加注 = 你这一街已投入的钱 + 底池 + 两倍的待跟注额。所以 pot-limit 里的「下注尺度」是关于底池的一个事实,不是一种风格。

由 js/core/plo-pot.js 现算——全街实战里 Bet 键上那个合法上限用的也是这一个函数,所以本页的数字和那块屏幕上的数字不可能各走各的。

三条翻前线路,每一次加注都打满。双方最后都跟到同一个数,所以翻牌底池是那个数的两倍:

一张公共牌都还没发,三条线的比值已经差出一个数量级:16.175.061.35。再去问规则层「筹码打光之前还塞得下几注」,同样这三条线的答案是 432——翻前每多加一次注,翻后就少一条街可打。

在投第一笔钱之前把翻牌的筹码底池比算出来,而不是等翻牌发出来再算。

单挑、100 个大盲深度、每一次加注都打满。打不满的加注落在这几个数之间,换一个筹码深度三个数会一起动;算法一样,数值不一样。

比值低不等于好。1.35 上整手牌只有 2 注长,它保护的是一手已经领先的牌,钉死的是一手要靠翻牌帮忙的牌。four-bet 这条线是双向的承诺——这正是下一页要讲的事。

同一手牌,两块翻牌,两个游戏

A♥A♦K♥K♦J♣T♣9♠8♠,发两块不同的翻牌。每块都一路枚举到河牌——每块 820 个 runout,没有抽样,没有估计:

同样两手牌,差 51.1 个百分点,变的只是桌上那三张牌。这个差额就是筹码底池比重要的全部理由。一手牌的价值集中在一部分翻牌上,它要的是一棵矮树:1.35 上整手牌只有 2 注长,那些它落后的翻牌因此少花钱。一手要等翻牌来的牌要的正相反——16.17 上有空间在坏翻牌上便宜地退出、在好翻牌上慢慢建池。

按「这手牌需要翻牌给它什么」来挑翻前线路,而不是按「它翻前看着有多强」。

单挑,双方筹码深到三条线都存在。上面这组对比对这两手牌、这两块翻牌是精确的;换一对手牌两个数都会动,而一对到处都跑得很近的牌几乎不动。

「AAxx 永远想要低比值」是这条规则最贵的那个版本。在 9♥8♦2♣ 上,four-bet 那条线把 32.4% 锁进了一个走不掉的底池——低比值保护不了一手已经落后的牌,它只是把这手牌承诺了进去。这条规则说的是牌的形状,不是牌的名号;而它是本课程的规则,不是均衡解。

哪些决策我们判得了,哪些判不了

我们让脚本对手跟一个固定探针打了 120 手——探针面对下注一律跟注,没人下注时交替 check 与 bet——然后数下每一个「轮到你行动」的节点。一共 505 个决策点,120 手里有 113 手一路打到河牌。这 505 个点里,269 个拿到了判定。判定覆盖率 53.3%。

覆盖在哪儿,不覆盖在哪儿:

最后那一行是这个训练器诚实的另一半。本仓的规则层是一组分类器,不是一套策略。问它「这个听牌能不能在翻牌上进攻」,它答得出来;问它「这张转牌该不该下注」,它没有话可说——因为这个问题本项目从来没有校准过。在那儿给你打分,等于拿一个我们自己写的脚本来评判你,你学到的会是「怎么猜中我们的脚本」而不是「怎么打牌」。所以那些节点上,屏幕只给真算得出来的事实(equity、outs、坚果梯子、筹码底池比),一点档位颜色都不给。

规则层还会在更小的地方拒绝,你会碰到:比值 1.35 上的一手纯听牌拿不到承诺档位,因为那档只对「手里已经有成手」的牌校准过。这些都是本课程的规则,不是均衡解;一条知道自己在哪儿停的规则,比一条永远有答案的规则值钱。

在标着「没有判据」的节点上,读事实,别去找那块没出现的颜色。

上面那个比例是用那一个探针量出来的。真人的动作分布不一样——加注更多、主动下注更少,或者反过来——所以你自己看到的比例会不同。它是「你站在哪类节点上」的性质,不是这一局的分数。

「没有判据」不等于「怎么打都行」。屏幕上的事实照样排除掉一些动作:把当街最大的牌弃掉就是错的,无论有没有东西给它打分;复盘页的 equity 曲线也会明明白白指出一条线是从哪一步开始不成立的。

本课程在转牌主动下注、河牌主动下注、以及任何一次加注上都不给档位。我们在那儿没有校准过的判据,编一条出来就等于拿自家写的脚本审判你。这件事没有时间表,而且只有真的出现校准数据才会做。还有一条限制该写在这一页上、而不是埋在文档里:全街实战是一张单挑桌,但它读的翻前表是按六人桌做的。真正的单挑范围比那更宽。这是本版本的数据限制,不是「单挑就该这么打」的主张。

本课要点

上面每一个数字都出自 js/core/plo-pot.js、js/core/plo-equity.js,或者一次 js/fullstreet/engine.js 的真实运行,并且和本书其余部分由同一道门锁进 test/fixtures/learn-numbers-postflop.js。这些阈值是本课程的规则,不是均衡解。

本课出现的术语

equity · 坚果梯子 · 判定覆盖率 · 脚本对手

读完只是小的那一半。这门课配 24 道题,判分对的是引擎,不是某个人的看法。

在 app 里练这一课