整手规划
翻牌的筹码底池比在翻牌之前就定了
筹码底池比在翻牌之前就定了
本课程的全街实战是一张单挑桌:两个座位,按钮位就是小盲。双方都是 100 个大盲,盲注是 0.5 与 1。下面没有一个数字是口味问题——本页每一笔加注都是 pot-limit 的上限,是算出来的,不是挑出来的。
游戏规则:最大的合法加注 = 你这一街已投入的钱 + 底池 + 两倍的待跟注额。所以 pot-limit 里的「下注尺度」是关于底池的一个事实,不是一种风格。
由 js/core/plo-pot.js 现算——全街实战里 Bet 键上那个合法上限用的也是这一个函数,所以本页的数字和那块屏幕上的数字不可能各走各的。
三条翻前线路,每一次加注都打满。双方最后都跟到同一个数,所以翻牌底池是那个数的两倍:
- 按钮位开到 3,大盲跟注 → 翻牌底池 6,后手 97,筹码底池比 16.17。
- 大盲改成 three-bet 到 9,按钮位跟注 → 翻牌底池 18,后手 91,比值 5.06。
- 按钮位再 four-bet 到 27,大盲跟注 → 翻牌底池 54,后手 73,比值 1.35。
一张公共牌都还没发,三条线的比值已经差出一个数量级:16.17、5.06、1.35。再去问规则层「筹码打光之前还塞得下几注」,同样这三条线的答案是 4、3、2——翻前每多加一次注,翻后就少一条街可打。
在投第一笔钱之前把翻牌的筹码底池比算出来,而不是等翻牌发出来再算。
单挑、100 个大盲深度、每一次加注都打满。打不满的加注落在这几个数之间,换一个筹码深度三个数会一起动;算法一样,数值不一样。
比值低不等于好。1.35 上整手牌只有 2 注长,它保护的是一手已经领先的牌,钉死的是一手要靠翻牌帮忙的牌。four-bet 这条线是双向的承诺——这正是下一页要讲的事。
同一手牌,两块翻牌,两个游戏
拿 A♥A♦K♥K♦ 对 J♣T♣9♠8♠,发两块不同的翻牌。每块都一路枚举到河牌——每块 820 个 runout,没有抽样,没有估计:
- 2♣7♦3♥——这对 A 有 83.5%。
- 9♥8♦2♣——这对 A 有 32.4%。
同样两手牌,差 51.1 个百分点,变的只是桌上那三张牌。这个差额就是筹码底池比重要的全部理由。一手牌的价值集中在一部分翻牌上,它要的是一棵矮树:1.35 上整手牌只有 2 注长,那些它落后的翻牌因此少花钱。一手要等翻牌来的牌要的正相反——16.17 上有空间在坏翻牌上便宜地退出、在好翻牌上慢慢建池。
按「这手牌需要翻牌给它什么」来挑翻前线路,而不是按「它翻前看着有多强」。
单挑,双方筹码深到三条线都存在。上面这组对比对这两手牌、这两块翻牌是精确的;换一对手牌两个数都会动,而一对到处都跑得很近的牌几乎不动。
「AAxx 永远想要低比值」是这条规则最贵的那个版本。在 9♥8♦2♣ 上,four-bet 那条线把 32.4% 锁进了一个走不掉的底池——低比值保护不了一手已经落后的牌,它只是把这手牌承诺了进去。这条规则说的是牌的形状,不是牌的名号;而它是本课程的规则,不是均衡解。
哪些决策我们判得了,哪些判不了
我们让脚本对手跟一个固定探针打了 120 手——探针面对下注一律跟注,没人下注时交替 check 与 bet——然后数下每一个「轮到你行动」的节点。一共 505 个决策点,120 手里有 113 手一路打到河牌。这 505 个点里,269 个拿到了判定。判定覆盖率 53.3%。
覆盖在哪儿,不覆盖在哪儿:
- 翻前——148 个点,全部判得了。这张桌上每一个翻前节点背后都有一张参考范围表。
- 面对下注——56 个点,判了 98.2%。你对上对手在那个节点的范围的 equity,以及对方给你的价钱,两个都算得出来。唯一没判的那个点,是过滤之后活下来的组合太少,少到不配再叫一个范围。
- 翻牌上没人下注——107 个点,判了 61.7%。剩下的落在规则自己写明的适用条件之外:配对板、单调板、比值太低,或者你已经成手了。最后这条值得多说一句:本课程校准过的那条翻牌规则是一条关于听牌的规则。拿翻到三条去问它,它的第一条硬门(没有到坚果顺子的 out)会把这手牌归进「控池」——那等于我们告诉你「翻到顶三条还下注是错的」。不是我们判得宽松,是我们根本不判。
- 转牌或河牌上主动下注,以及任何一次加注——194 个点,判了 0 个。不是判得宽松,也不是判得严厉:是没判。
最后那一行是这个训练器诚实的另一半。本仓的规则层是一组分类器,不是一套策略。问它「这个听牌能不能在翻牌上进攻」,它答得出来;问它「这张转牌该不该下注」,它没有话可说——因为这个问题本项目从来没有校准过。在那儿给你打分,等于拿一个我们自己写的脚本来评判你,你学到的会是「怎么猜中我们的脚本」而不是「怎么打牌」。所以那些节点上,屏幕只给真算得出来的事实(equity、outs、坚果梯子、筹码底池比),一点档位颜色都不给。
规则层还会在更小的地方拒绝,你会碰到:比值 1.35 上的一手纯听牌拿不到承诺档位,因为那档只对「手里已经有成手」的牌校准过。这些都是本课程的规则,不是均衡解;一条知道自己在哪儿停的规则,比一条永远有答案的规则值钱。
在标着「没有判据」的节点上,读事实,别去找那块没出现的颜色。
上面那个比例是用那一个探针量出来的。真人的动作分布不一样——加注更多、主动下注更少,或者反过来——所以你自己看到的比例会不同。它是「你站在哪类节点上」的性质,不是这一局的分数。
「没有判据」不等于「怎么打都行」。屏幕上的事实照样排除掉一些动作:把当街最大的牌弃掉就是错的,无论有没有东西给它打分;复盘页的 equity 曲线也会明明白白指出一条线是从哪一步开始不成立的。
本课程在转牌主动下注、河牌主动下注、以及任何一次加注上都不给档位。我们在那儿没有校准过的判据,编一条出来就等于拿自家写的脚本审判你。这件事没有时间表,而且只有真的出现校准数据才会做。还有一条限制该写在这一页上、而不是埋在文档里:全街实战是一张单挑桌,但它读的翻前表是按六人桌做的。真正的单挑范围比那更宽。这是本版本的数据限制,不是「单挑就该这么打」的主张。
本课要点
- 四个问题,按这个顺序问。我刚才那条翻前线路造出了多大的比值?这手牌要翻牌给它什么?我现在站在哪一类节点上?还剩几注?
- 比值是翻前的算术。16.17、5.06、1.35——三条线,三个不同的游戏,在发牌之前就定了。
- 同一手牌不是同一手牌。两块翻牌,差 51.1 个百分点。翻前的强度几乎不告诉你「哪些翻牌你还会喜欢」。
- 知道矮树要什么。1.35 上整手牌 2 注长,把剩下的推进去需要 36.5%;那是筹码的门槛,不是「可以推」的许可证。
- 知道我们判不了什么。探针上量到的判定覆盖率是 53.3%,而没覆盖的那部分不是随机的:转牌与河牌的主动下注、任何一次加注,以及翻牌上你已经成手的那些点。在那些地方,读事实。
上面每一个数字都出自 js/core/plo-pot.js、js/core/plo-equity.js,或者一次 js/fullstreet/engine.js 的真实运行,并且和本书其余部分由同一道门锁进 test/fixtures/learn-numbers-postflop.js。这些阈值是本课程的规则,不是均衡解。
本课出现的术语
读完只是小的那一半。这门课配 24 道题,判分对的是引擎,不是某个人的看法。