AI 與莊家制賭場:可計算、可預測、可利用與制度限制
AI and House-Banked Casino Games: Computability, Predictability, Exploitability, and Institutional Constraints
Series: AI Game Intelligence, Randomness, and Adaptive Markets
Paper 05
Version: v0.1
Date: 2026-09-02
Author: Neo.K with Aletheia(GPT-5.6 Sol)
Institution: EveMissLab/一言諾科技有限公司
摘要
當人工智慧被引入傳統賭場問題時,最常見的誤解是把「能算得更精確」直接等同於「能提高對莊家的長期期望值」。
然而,輪盤、老虎機、百家樂與 Blackjack 並不是同一種類型的隨機系統。某些遊戲的下一次結果在合理模型下近似獨立;某些遊戲由物理系統生成但實務上不可取得足夠狀態;某些牌靴遊戲則因有限牌組且不放回抽取而具有真實狀態依賴。更進一步,即使某種資訊在數學上可以提高決策品質,賭場規則與司法管轄區仍可能禁止玩家使用電子、電腦或軟體裝置在遊戲進行中取得優勢。
因此本文提出四層區分:
Computable=Predictable=Exploitable=Permitted.
本文進一步把 AI 對合法、正常運作且無作弊的莊家制賭場可能造成的影響分成四類:
EAI=Eeducation+Eselection+Epolicy+Estate,
其中:
Eeducation
代表把缺乏數學知識的玩家提升到較接近正確玩法;
Eselection
代表辨識不同規則、賠表與 house edge;
Epolicy
代表在允許的決策空間內採取較佳策略;
而:
Estate
則代表利用遊戲內部仍保留的狀態資訊。
對真正近似 IID、固定負期望值的遊戲,本文提出「歷史適應下注不變性」:若每一單位下注在給定過去資訊後仍具有固定負條件期望,則任何只根據歷史輸贏改變下注額的 AI,都不能把總期望值變成正數。
相反地,Blackjack 類有限牌靴遊戲說明:
P(Yt+1∣St)=P(Yt+1),
因此狀態資訊確實可能具有數學價值。但這正是現代賭場制度會以洗牌、牌靴管理、桌規與電子輔助限制加以處理的區域。Nevada 現行 NRS 465.075 明確禁止使用設計來取得遊戲優勢的電腦、電子、軟體或硬體,包括預測結果、追蹤牌、分析事件概率或分析遊戲與投注策略。
因此,本篇的核心結論是:在合法、公平且受監管的莊家制賭場中,AI 最穩定的作用通常不是「創造正期望」,而是減少玩家自己的策略錯誤、比較制度條件、理解風險,以及驗證遊戲生成機制是否符合宣稱規則。
1. 從共同彩池重新回到莊家制市場
Paper 03 的共同彩池具有:
O=F(q1,…,qn),
價格由所有投注者共同形成。
莊家制 casino game 則更接近:
Operator defines rules→probability/payoff structure→player chooses within that structure.
在大量傳統遊戲中,玩家的資金不會像 pari-mutuel 那樣直接重新生成其他玩家的最終派彩。
因此這一次的核心不是:
Can AI predict the market?
而是:
Can AI change the expectation already encoded in the game rules?
2. 四道不同的門
本文首先建立四個 Gate。
Gate 1 — Computability
能否精確或近似計算:
P(Y),
EV,
Var(Y).
Gate 2 — Predictability
給定目前可觀測狀態:
Xt,
是否存在:
I(Xt;Yt+1)>0.
Gate 3 — Exploitability
即使可以改善預測或策略,是否存在:
EVplayer>0.
Gate 4 — Permission
即使數學上存在可利用結構:
EVstate>0,
玩家是否被遊戲規則與所在地法律允許使用取得該資訊的方法。
因此:
technical capability⇒legal or contractual permission.
3. House Edge
設一個單位投注的玩家淨收益為隨機變量:
R.
則玩家期望值:
EVP=E[R].
若:
EVP<0,
可以定義簡化 house edge:
h=−EVP.
對每投注一單位而言:
E[R]=−h.
只要規則與策略不變,長期投注總量:
W
的期望損失近似:
E[L]≈hW.
4. 勝率不是 House Edge
這是 AI 博彩討論最常見的錯誤之一。
假設策略:
P(win)=0.90,
但九次各贏:
1
單位,一次輸:
20
單位。
則:
EV=0.9(1)+0.1(−20)=−1.1.
所以:
P(win)↑⇒EV↑.
因此本文不使用「AI 提高勝率」作為唯一衡量標準。
5. AI 對新手仍然可能有價值
若玩家原本策略:
πH
大量偏離數學上較佳策略:
π∗,
則 AI 教學可能使:
EV(πH)<EV(πAI)≤EV(π∗).
因此:
AI can improve the player
與:
AI can beat the house
是完全不同的命題。
前者在很多遊戲成立。
後者則困難得多。
6. AI Improvement Gap
本文定義:
GI=EV(πAI)−EV(πhuman).
以及:
GH=EV(πAI)−0.
可能出現:
GI>0,
但:
GH<0.
意思是:
AI 確實讓玩家少輸,但仍然沒有使遊戲成為正期望。
這可能是傳統合法賭場中最常見的 AI 效果。
7. 輪盤:高度可計算,但下一轉未必可預測
以歐式單零輪盤為例。
紅色有:
18
格,
非紅色有:
19
格。
下注紅色一單位:
EV=3718(1)+3719(−1)=−371.
因此:
h=371≈2.70%.
這個數值可以被精確計算。
但:
knowing EV=knowing the next spin.
8. 美式雙零輪盤
若有:
38
個格子,含:
0
與:
00,
則等額紅黑下注的簡化 house edge:
h=382≈5.26%.
因此 AI 很容易告訴玩家:
2.70%<5.26%.
這是一個:
game-selection advantage
但不是:
outcome-prediction advantage.
9. 選比較好的規則不是打敗賭場
如果 AI 從:
h1=5.26%
的遊戲改選:
h2=2.70%,
則:
Δh=−2.56%.
這可以大幅改善玩家長期期望。
但仍然:
h2>0.
因此:
EVP<0.
AI 所做的是:
loss minimization
而不是:
positive-edge creation.
10. 歷史輸贏不能自動改變下一轉
若理想輪盤滿足:
Yt+1⊥Ht,
則:
P(Yt+1∣Ht)=P(Yt+1).
因此:
- 連續十次紅;
- 連續十次黑;
- 最近黑色偏多;
- 某個號碼很久沒出;
都不會自動改變下一轉的理論概率。
Paper 01 的 Randomness Boundary 在這裡直接成立。
11. AI 下注系統不能從歷史輸贏創造資訊
設 AI 在第 t 局以前觀察:
Ht−1.
它依據歷史選擇投注額:
bt=b(Ht−1).
若每一單位投注的條件期望始終:
E[Rt∣Ht−1]=−hbt,
其中:
h>0,
則由全期望法則:
E[Rt]=E[E[Rt∣Ht−1]]=−hE[bt].
對 n 局:
E[t=1∑nRt]=−hE[t=1∑nbt].
因此:
E[Rtotal]<0
只要總投注額為正。
12. 歷史適應下注不變性
本文稱上述結果為:
History-Adaptive Betting Invariance.
它表示:
在固定負條件期望的遊戲中,只根據過去輸贏改變下注額:
- Martingale;
- Fibonacci;
- loss chasing;
- reinforcement-learning sizing;
- LLM 自動調注;
都不能僅靠下注序列本身改變負期望的符號。
13. AI 可以改變 Variance
雖然:
EV
不一定改變,
下注策略可以改變:
Var(R),
P(short-term profit),
P(ruin),
以及資金路徑。
因此:
bet sizing can change risk geometry without changing underlying edge.
這正是「短期更常贏」與「長期期望為正」不能混在一起的原因。
14. 物理輪盤比抽象輪盤複雜
真正輪盤是經典力學系統。
可抽象為:
Y=F(vball,ωwheel,θ0,μ,g,ϵ).
因此它不是本體論上必然 IID 的數學神諭。
若能完整知道初始狀態:
S0,
原則上:
Y=F(S0)
可以具有物理結構。
15. Physical Structure 不等於 Practical Exploitability
現實需要:
sufficient measurement precision+sufficient computation time+stable dynamics+permitted sensing.
因此:
physically deterministic⇒practically exploitable.
而在受監管賭場中,玩家使用外部電子設備取得這類即時優勢還可能另受法律或場規限制。
16. RNG 遊戲:制度目標本來就是讓預測失效
截至 2026 年,英國 Gambling Commission 的 Remote Gambling and Software Technical Standards 要求隨機結果達到「acceptably random」。
其 RTS 7 要求 RNG 輸出應符合預期分布,並具有不可預測性;對軟體 RNG,標準明確指出,在不知道完整演算法與 seed 的情況下,下一個數字應達到計算上不可行預測。
同一標準亦禁止 adaptive behaviour,也就是遊戲在進行中根據玩家過去結果改變結果概率。
因此對合規系統:
AI failing to predict the RNG
可能正是:
the regulated system working as intended.
17. GLI 對 Gaming Device RNG 的要求
Gaming Laboratories International 的 GLI-11 標準亦要求 RNG 最終輸出進行獨立性等統計測試,並要求可用結果具有適當概率,不應因先前產生的結果而改變,除非遊戲設計本身另有規定。
GLI-11 同時把 unpredictability 列為 RNG 設計要求之一。
因此:
regulated gaming RNG
本身就是反歷史預測設計。
18. 老虎機的 AI 誤解
假設某合規遊戲理論 RTP 為:
RTP=96%.
長期期望 house edge 大致:
h=1−RTP=4%.
但:
RTP=96%
不代表玩家每:
100
元一定拿回:
96
元。
它描述的是大量遊戲下的理論平均結構。
19. RTP 不告訴你下一次 Spin
如果每次有效 RNG state 對玩家而言不可預測,則:
P(Yt+1∣Ht)≈P(Yt+1).
所以:
這台機器已經很久沒出大獎;
它剛剛連吃很多,所以快吐了;
不能僅從歷史結果推出。
20. AI 在 Slots 中最合理的角色
在不進入漏洞利用的前提下,AI 可以幫助理解:
- RTP;
- volatility;
- paytable;
- bonus rules;
- wager requirements;
- jackpot structure。
因此:
Eselection>0
可能成立。
但:
Eprediction≈0
在正常受監管 RNG 條件下仍是合理預期。
21. 複雜遊戲不等於高 AI Edge
一個老虎機可以有:
- 50 條 payline;
- cascading reels;
- multipliers;
- free spins;
- stateful bonus;
使人類難以心算。
AI 可以把:
EV
算得更清楚。
但:
complex payoff structure=predictable random generator.
22. 百家樂位於一個有趣的中間區
標準 shoe baccarat 使用有限牌組,牌不放回。
因此嚴格來說:
P(Yt+1∣St)=P(Yt+1).
牌組 composition 確實會隨已出牌變化。
所以它不是完全 IID。
23. 但主投注的決策空間非常小
在標準百家樂中,Player 與 Banker 的抽牌規則大多已由規則固定。
玩家主要決定:
which wager
而不是像 Blackjack 那樣在每手中連續決策:
- hit;
- stand;
- double;
- split。
因此:
state dependence exists
不代表:
large usable decision space exists.
24. 百家樂的歷史路紙問題
玩家常觀察:
- Banker streak;
- Player streak;
- alternating pattern;
- road maps。
但:
past Banker/Player labels
本身並不是完整牌組 composition。
因此:
outcome history=state representation.
即使牌組有狀態依賴,也不能推出單純追「莊閒走勢」具有可靠資訊價值。
25. Composition Effect 與 Pattern Effect 必須分開
牌靴遊戲可以有:
I(St;Yt+1)>0,
但仍可能:
I(Htlabels;Yt+1)≈0.
其中:
St
是完整剩餘牌 composition,
Htlabels
只是過往莊/閒結果序列。
因此:
stateful game⇒every historical pattern is informative.
26. Blackjack 是最重要的例外
Blackjack 同樣從有限牌靴不放回抽牌。
因此剩餘牌組:
St
會真正改變:
P(Yt+1∣St).
而玩家又擁有較豐富 action space。
所以:
state information+strategic action
同時存在。
27. Blackjack 的 AI 價值首先來自 Basic Strategy
對一般玩家而言,AI 不需要任何秘密資訊,就可以把:
πnovice
修正到較接近:
πbasic.
因此:
EV(πbasic)>EV(πnovice)
通常成立。
這是合法教育與離線學習層面的典型:
Epolicy>0.
28. 但 Basic Strategy 不等於必然正期望
即使:
π=πbasic,
在常見桌規下仍通常存在小幅 house edge。
因此:
optimal play under fixed rules=positive expectation.
29. 牌組狀態使 Blackjack 與輪盤分離
輪盤在理想模型中:
P(Yt+1∣Ht)=P(Yt+1).
Blackjack shoe:
P(Yt+1∣St)=P(Yt+1).
所以 Paper 01 的零互資訊結論不能直接套用完整 shoe state。
這是數學上真正不同的 regime。
30. 為什麼 AI 理論上會很強
如果允許機器完整觀察:
St,
AI 可以做到:
St→Pt→Qt(a)→πt∗.
也就是依目前牌組狀態重新計算各 action 的期望。
因此:
AI capability>human mental calculation capability
完全可能成立。
31. 但這正是 Permission Gate 最重要的地方
Nevada 現行 NRS 465.075 規定,在持牌博彩場所或持牌業者提供的遊戲中,不得使用或意圖使用設計來取得遊戲優勢的:
- computerized device;
- electronic device;
- electrical device;
- mechanical device;
- software;
- hardware。
該條文列出的例子包括:
- 預測遊戲結果;
- 追蹤已出的牌或準備使用的牌;
- 分析遊戲事件概率;
- 分析遊戲或投注策略。
因此:
AI can calculate it
與:
AI may be used at the table
必須完全分離。
32. 這條法律其實比生成式 AI 早幾十年
Nevada 對這種電子優勢設備的限制早在現代 LLM、vision model 與 agent 以前就已存在。
因此今天:
camera+vision model+probability engine+voice advice
雖然技術形式全新,
制度所處理的核心問題卻仍是:
external computerized advantage assistance.
33. Human Skill 與 Device Assistance 可以具有不同法律地位
一個很經典的歷史對照是 1982 年 New Jersey Supreme Court 的 Uston v. Resorts International Hotel。
該案涉及使用人類 card counting 的 Blackjack 玩家。法院當時認為,在 New Jersey Casino Control Act 的架構下,賭場不能僅因 Uston 使用 card counting 策略而自行排除他,遊戲規則的權限屬於監管機構。
這個案件的重要性不是代表所有地方都允許或保障 card counting,而是說明:
human mental strategy
與:
electronic assistance
在法律上可以被視為完全不同的類型。
34. Jurisdiction Matters
因此不存在全球統一的:
AI casino legality.
更合理的是:
Permission=P(jurisdiction,operator,game,device,timing).
本系列所有法律討論都只能作為制度比較,不能取代特定司法管轄區的正式法律意見。
35. 賭場還可以改變狀態資訊的生命週期
如果某種策略依賴:
St
在多手之間持續累積,
賭場可以縮短:
τS.
例如透過:
- 更頻繁洗牌;
- 較淺牌靴 penetration;
- continuous shuffling;
- 改變牌組數與桌規。
因此:
state edge→rule response→state-edge decay.
這與 Paper 00 的制度反身性完全一致。
36. Continuous Shuffling 的理論作用
若棄牌快速重新混回可抽取牌組,則:
St
相對前一手的長期記憶下降。
因此:
I(Hlong;Yt+1)
也會下降。
這是一種:
information-reset countermeasure.
37. 賭場不必「比你的 AI 更聰明」
這點和運彩非常不同。
Sportsbook 若定價錯可能需要重新估計世界。
但 casino operator 往往控制:
game rules themselves.
因此它可以直接改變:
Gt→Gt+1.
例如調整:
- payout;
- shuffle;
- deck count;
- table limits;
- allowed devices。
這使莊家擁有一種:
mechanism-design advantage.
38. House 是規則設計者,不只是對手
玩家問題:
πmaxEV(π∣G).
莊家則部分擁有選擇:
G.
所以完整互動更像:
Player optimizes within G
而:
Operator manages G.
這是莊家制遊戲最深的結構性不對稱。
39. AI 不能只跟「普通玩家」比較
如果一篇論文說:
AI Blackjack 玩家比一般玩家好 20%。
這只能證明:
EV(πAI)>EV(πaverage).
真正要問:
EV(πAI)>?EV(π∗),
以及:
EV(πAI)>?0.
這是三個不同 baseline。
40. 本文提出 Casino AI 三基準
Baseline A — Naive Human
BN.
Baseline B — Optimal Permitted Strategy
BO.
Baseline C — Zero Expected Return
B0=0.
AI 研究應分別報告:
ΔN,
ΔO,
Δ0.
41. AI 很容易打敗 Baseline A
對複雜賠表與策略遊戲:
ΔN>0
很合理。
42. AI 很難打敗 Baseline B
如果 optimal permitted strategy 已知且可精確計算,
則:
ΔO≈0.
這意味模型再大也只是重新發現同一策略。
43. AI 更難跨過 Baseline C
若遊戲在最佳合法策略下仍:
EV<0,
則:
Δ0<0.
AI 只是讓負值比較小。
44. 這是 Casino AI 的三層幻覺
第一層:
AI 贏過普通人,所以 AI 打敗賭場。
錯。
第二層:
AI 預測比較準,所以 EV 為正。
錯。
第三層:
AI 短期贏錢,所以找到了 edge。
仍然可能錯。
因此:
relative improvement=absolute advantage.
45. Side Bets 通常讓問題更複雜
很多桌遊加入:
- jackpot;
- pair;
- bonus;
- exotic side bets。
它們可能增加模型維度。
但複雜度本身不代表:
EV↑.
甚至常常:
hside>hmain.
因此 AI 最常做的合理事情反而可能是:
identify expensive complexity.
46. Complexity Tax
本文定義一個概念:
CX=hcomplex−hsimple.
如果某額外玩法只是增加娛樂性卻增加 house edge,
則:
CX>0.
這可稱為:
Complexity Tax.
AI 可以讓玩家更容易看見它。
47. 這是一種資訊公平改善
若遊戲規則完全公開,但一般玩家無法理解:
probability complexity,
AI 可以把:
opaque rules
轉成:
understandable EV.
因此 AI 的社會作用不一定是「幫人贏」。
也可能是:
reduce informational opacity.
48. 受監管 RNG 與 AI Audit 可以共存
玩家預測:
next outcome
可能沒有訊號。
但監管/研究 AI 仍可以測:
Pobserved=?Pdeclared.
因此:
No predictive edge=No auditing value.
這延續 Paper 01 的 Randomness Auditor。
49. Fair Game Integrity AI
在不以利用漏洞為目的的研究下,AI 可以用來檢查:
- 分布偏差;
- RNG drift;
- payout implementation;
- 異常設備;
- unexpected correlations;
- software regression。
這是一個:
operator/regulator-facing AI
而不是投注者 exploit engine。
50. 英國制度的另一個重要點:禁止 Adaptive Outcome Manipulation
UKGC RTS 7 不只要求不可預測。
它也禁止 compensated/adaptive behaviour:
P(Yt+1)
不應因玩家最近輸贏而被營運者動態操縱。
因此合法受監管系統中的:
你剛贏很多,所以機器故意不讓你贏;
不能被當作預設模型。
若有這類指控,正確問題是:
integrity investigation
而不是建立追輸贏「反算法」。
51. AI 不應替陰謀敘事生成數學外衣
如果玩家提供:
20
局輸贏資料,
AI 很容易敘述:
系統似乎在第 12 局後進入抑制狀態。
但沒有:
- 足夠樣本;
- null model;
- multiple-testing correction;
- game implementation evidence;
就不能推出:
adaptive manipulation.
這是 Paper 01 的 Narrative Overfitting 在 casino domain 的版本。
52. 線上合法 Casino 的核心信任問題
線上玩家無法直接觀察:
physical wheel
或:
internal RNG state.
因此公平性依賴:
regulation+testing+software integrity+audit.
這也是為什麼像 UKGC 與 GLI 的 RNG 標準比「AI 猜不猜得中」更根本。
53. AI 在這裡應該是 Verification Tool
合理研究方向:
declared rule→expected distribution
再比較:
observed distribution.
即:
D(Pobs,Prule).
這是:
verification
而不是:
exploitation.
54. Bankroll Management 不會創造 Alpha
AI 可以幫助控制:
P(ruin),
Drawdown,
Variance.
但若每個可選行動都滿足:
EV(a)<0,
單純資金管理不能創造:
∃a:EV(a)>0.
所以:
risk management=alpha generation.
55. 但 Risk Management 仍有 Utility
如果玩家本來就把賭場視為娛樂消費:
U=Uentertainment−λL−γRisk,
那 AI 可能透過:
- 預算;
- session limit;
- variance understanding;
- game selection;
增加:
U.
這仍然是真實價值,只是不是「打敗莊家」。
56. Gambling Utility 與 Profit Utility 不同
和 Paper 04 馬主效用類似,
玩家可能不是:
maxE[Π].
而是:
U=αE[Π]+βEntertainment+γSocial−λRisk.
因此一個理性娛樂玩家甚至可以接受:
E[Π]<0,
只要:
U>0.
57. 這不代表 House Edge 消失
娛樂效用只是表示:
negative financial EV
可能與:
positive total subjective utility
同時成立。
兩者不能混淆。
58. Casino 的 AI Counterpart 並不一定是「AI 莊家」
在 roulette / slot 類遊戲裡,莊家不需要即時預測玩家才能保持 edge。
因為:
edge is embedded in mechanism.
這比 sportsbook 更根本。
59. Mechanism Edge
定義:
EM=−EVplayer(π∗).
如果即使最佳允許策略:
EVplayer(π∗)<0,
則:
EM>0.
這就是莊家最強的優勢:
the rules themselves.
60. 所以 Casino 不需要每局打敗玩家
莊家可以輸:
1,10,100
局。
只要在足夠多獨立或弱相關投注中:
E[Rhouse]>0,
大數法則會逐漸穩定 aggregate result。
因此:
house advantage is statistical, not prophetic.
61. AI 玩家與 Casino 的根本不對稱
玩家希望:
find positive conditional states.
莊家則希望:
design away or price those states.
因此:
Player searches the state space;
House partly controls the state space.
62. State Compression 是重要反制思想
如果 advantage 依賴長歷史:
Ht−k:t,
賭場可透過頻繁 reset 使有效記憶長度:
keff↓.
因此:
I(Hold;Yfuture)↓.
這是一個比「抓 AI」更根本的設計方法。
63. Rule Design 可以比 Anti-Cheat 更強
若能讓:
S→0,
AI 就沒有大量可利用結構。
因此:
remove exploitable information
常常比:
detect every intelligent player
更容易。
64. 但不能把所有 Skilled Play 都等同作弊
必須區分:
mental skill,
legal pre-game study,
approved in-game information,
prohibited external assistance.
不同地區與遊戲的界線不同。
因此治理不能用:
玩家太會算了。
作為唯一判準。
65. Permission Frontier
本文定義:
P={a:a is technically possible and permitted}.
真正允許玩家最佳化的是:
π∗=argπ∈PmaxEV(π).
而不是所有技術上可行策略的全集。
66. AI 時代使 Permission Frontier 更重要
以前:
P
主要區分:
現在又增加:
- smartwatch;
- phone vision;
- cloud model;
- earbuds;
- remote human/AI assistance。
所以:
AI expands capability space faster than rule text changes.
但像 Nevada NRS 465.075 這類功能性法律因描述的是「取得遊戲優勢的電腦化設備/軟硬體用途」,仍可涵蓋大量新技術形式。
67. AI Casino Research 的安全邊界
本系列研究:
- house edge;
- information structure;
- optimal permitted policy;
- regulation;
- RNG integrity;
- countermeasure theory。
不提供:
device-assisted advantage play implementation,
real-time casino prediction tooling,
RNG seed recovery workflow,
surveillance evasion,
casino countermeasure bypass.
68. 第一核心命題:Computability Separation
Computable⇒Predictable.
House edge 可以被精確計算,但下一次結果仍可能不可預測。
69. 第二核心命題:Prediction Separation
Predictable⇒Profitable.
改善某些狀態預測不代表總 EV 已跨過:
0.
70. 第三核心命題:Permission Separation
Exploitable⇒Permitted.
Blackjack 電子輔助是最清楚的案例之一。
71. 第四核心命題:History-Adaptive Betting Invariance
若所有可下注時點都滿足:
E[Rt∣Ht−1]=−hbt,
其中:
h>0,
則任何只依據歷史決定:
bt
的策略皆有:
E[Rtotal]<0.
因此:
adaptive staking alone cannot reverse a fixed negative edge.
72. 第五核心命題:Relative Improvement Separation
可以同時成立:
EV(πAI)>EV(πhuman),
以及:
EV(πAI)<0.
因此:
AI can make a gambler better without making gambling profitable.
73. 第六核心命題:Mechanism-Design Dominance
在莊家可調整規則的市場:
house can respond to information advantage by changing the mechanism.
因此 AI edge 不是固定自然常數,而受:
Gt
控制。
74. 第七核心命題:State-Lifetime Principle
若策略優勢依賴:
I(St;Yt+1)>0,
則縮短狀態有效生命:
τS
通常會降低可累積資訊價值。
因此:
∂τS∂Estate>0
可作為條件性假說。
75. 第八核心命題:Integrity–Exploitation Separation
發現:
D(Pobs,Pdeclared)>0
首先意味:
integrity question.
不應自動被轉化為:
player exploitation opportunity.
這是本系列研究倫理的重要邊界。
76. 四類遊戲的理論位置
| 類型 |
典型例子 |
歷史資訊價值 |
AI 合理主要價值 |
| 近 IID / RNG |
Slots、電子 RNG |
很低 |
規則理解、RTP、audit |
| 物理但實務不可觀測 |
Roulette |
通常很低 |
EV、規則比較、integrity |
| 有限牌靴但低策略自由 |
Baccarat |
composition 有限影響 |
規則、EV、狀態研究 |
| 有限牌靴且策略自由較高 |
Blackjack |
明確存在 |
basic strategy、狀態理論、治理 |
這是一個理論分類,不代表所有場館、變體與司法管轄區完全相同。
77. 與 Paper 01 的關係
Paper 01 問:
Does history contain predictive information?
Paper 05 更進一步問:
If it does, can the player legally and economically use it?
因此 Paper 05 新增了:
Permission Gate.
78. 與 Paper 02 的差異
運彩市場中:
market price
會因新資訊重新調整。
莊家制 casino 則常把:
expected advantage
直接寫進規則。
所以:
Sportsbook≈adaptive pricing problem,
而:
Casino table/RNG game≈mechanism-design problem.
79. 與 Paper 03 的差異
共同彩池:
participants create price.
莊家制賭場:
operator largely defines payoff mechanism.
因此:
AI participates in pricing
與:
AI operates inside a predefined mechanism
是兩種不同的博弈世界。
80. 真正的 Casino AI 四層模型
本文最終提出:
CAI=(G,S,Π,P)
其中:
G=Game Mechanism,
S=Observable State,
Π=Permitted Strategy Space,
P=Probability/Payoff Model.
AI 真正能做的是:
π∗=argπ∈ΠmaxE[R∣G,S,P].
如果:
π∈ΠmaxE[R]<0,
那麼:
perfect AI still has negative expected return.
81. 這可能是整個系列最清楚的 AI 能力邊界之一
人工智慧可以:
- 計算得更快;
- 記得更多;
- 分析更多狀態;
- 執行更一致;
- 找到人類策略錯誤。
但它不能僅因為「智能更高」就違反:
probability structure
或:
game mechanism.
82. 結論
一般合法、正常運作、不作弊的莊家制賭場,確實是 AI 最不容易憑純粹預測能力取得持續正期望的傳統博弈環境之一。
原因並不是 AI 不夠強。
而是遊戲本身通常已經經過:
probability engineering.
在輪盤與合規 RNG 類遊戲中:
I(Ht;Yt+1)≈0.
因此 AI 可以精確知道自己長期平均會輸多少,卻沒有足夠資訊知道下一次會發生什麼。
在 slots 類遊戲中,監管標準本來就要求 RNG 不可預測、符合宣稱分布,並禁止依玩家先前結果動態操縱下一次結果概率。
在百家樂中,牌靴 composition 使系統嚴格來說具有狀態依賴,但固定抽牌規則與有限決策空間使「存在狀態資訊」與「存在大型可用 edge」不能直接畫上等號。
Blackjack 則形成最重要的例外:
P(Yt+1∣St)=P(Yt+1),
而且:
player action matters.
因此數學上確實存在更高的 AI state-analysis potential。
但也正因如此,制度開始直接介入:
Capability→Permission Boundary.
Nevada 的現行法律甚至直接列出「預測結果、追蹤牌、分析事件概率、分析策略」等電子輔助用途作為禁止範圍。
所以最後形成:
Computable=Predictable=Exploitable=Permitted.
這四個詞不能再混用。
對一般玩家而言,AI 最現實的合法價值往往是:
bad strategy→better strategy,
opaque rules→understandable expected value,
以及:
high-cost game→lower-cost game.
也就是:
reduce avoidable loss
而不是自動:
create positive alpha.
對監管者與營運者而言,AI 的價值則可能反過來是:
verify randomness+detect anomalies+protect game integrity.
因此傳統 casino game 為 AI 博弈研究提供了一個非常重要的負面邊界案例:
More intelligence does not guarantee more exploitable information.
如果遊戲機制已經把資訊結構壓縮到近似:
I(X;Y)=0,
那麼 AI 的最高手段也可能只是更快、更精確地得到同一個結論:
EV<0.
真正會讓下一篇產生巨大轉折的,是 Poker 與策略卡牌遊戲。
因為那裡不再是:
Player vs fixed mechanism.
而是:
Intelligence vs Intelligence.
當對手會觀察、欺騙、調整策略,而 AI 又可以即時進入決策迴路時,「公平」將不再只是 RNG 與 house edge 問題,而會正式變成:
Who generated the decision?
References / Regulatory Anchors
- UK Gambling Commission, Remote Gambling and Software Technical Standards — RTS 7: Generation of Random Outcomes, current standards accessed in 2026.
- UK Gambling Commission, Remote Gambling and Software Technical Standards — Introduction, updated March 2026.
- Gaming Laboratories International, GLI-11: Gaming Devices, RNG independence, available outcomes and unpredictability requirements.
- Nevada Revised Statutes, NRS 465.075 — Use or possession of device, software or hardware to obtain advantage at playing game prohibited, current Nevada statutory text accessed in 2026.
- Uston v. Resorts International Hotel, Inc., 89 N.J. 163 (1982), Supreme Court of New Jersey, historical legal distinction involving human card counting.
Next:
Paper 06 — Poker、卡牌遊戲與 Human–AI Hybrid:從 Bot、Solver、RTA 到決策來源危機