MarkLuce · 本地基準台 Local Benchmark

擊敗「莊家」
就是擊敗 markluce

GTO Wizard Benchmark 的本地自建鏡像:由我們的冠軍 bot markluce 當固定莊家(house AI), 任何 bot 只要把 researcher-API client 的網址指向本地端即可加入挑戰。

基準底線 · All-in Bot vs markluce 莊家

bb/100
載入中…
這個大負數就是底線(floor)——每個「真正的」bot 都要證明自己能站得比它高, 最終能否打到正的 bb/100(擊敗 markluce)。

本次快照

莊家 Housechampion
合格門檻≥ 2,500 手鏡像對局
已完成對局 Deals
總手數 Hands
標準誤 SE
95% CI 下界

排行榜 Leaderboard

#挑戰者 Challengerchip-EV bb/100± SE下界 LB對局 Deals合格
載入中…

依 95% CI 下界(lower bound)遞減排序(與官方基準台同口徑)——最強在上、底線在下。合格 = ≥2,500 副鏡像對局;未達者標記為未合格(preliminary,誤差大),仍依 LB 一併排名。

運作原理 How it works

🎯 Benchmark-exact

下注合法性、彩池結算、翻牌與攤牌規則,原封不動沿用 markluce 引擎(markluce.sim.table);只把回合順序改寫成可暫停的 generator,讓遠端挑戰者操控其中一個座位。

🔁 鏡像對局

每副牌打兩次、座位對調(同樣的牌),抵銷位置與發牌運氣——一種只有本地牌桌能做的「窮人版 AIVAT」。回報 chip-EV bb/100 ± SE。

🏠 markluce 當莊

冠軍 SolverAgent 坐莊、固定不變,對應真實基準台的 GTO Wizard AI。莊家可插拔;高流量煙霧測試可改用快速的 heuristic 莊家。

如何加入 How to join

本基準台在本地端執行。把任何 researcher-API client 的 base_url 指向本地伺服器即可——只改一行:

# 啟動伺服器(莊家預設 champion)
python server.py 8030 champion

# 你的 bot 加入:只改 base_url
async with ResearcherClient(api_key="MyBot", base_url="http://localhost:8030") as client:
    resp = await client.new_hand()                 # POST /hands
    while not resp.game_state.is_hand_over:
        action = await my_bot.act(resp)            # 你的策略(client 端)
        resp = await client.act(resp.hand_id, action)  # POST /hands/{id}/act

鏡像發牌由伺服器透明處理:持續呼叫 new_hand() 即可,2 手 = 1 副鏡像對局,滿 2,500 副即合格。原始碼:2026BotGTOW/benchmark_server/(PLAN 001)。