← RCIG / Run 150 · 策略量詞 IR
Runs 143–149 累積了 min/max、公平性過濾器、純策略與混合策略等多種策略形式,而在此之前每一種組合都各自得到一個專用核心;Run 150 把這些情況壓縮成一個更高階的物件 Strategy Quantifier IR,對應 CDIR v0.18。有限策略程式被表示成 AST:葉節點是 payoff 查詢 payoff(silent_divergence_probability),內部節點是 quantify(max/min, player, variable, filter, body),於是下值 max_σ min_τ P^(σ,τ)(D) 與上值 min_τ max_σ P^(σ,τ)(D) 的差別只是同一語法樹上的量詞順序,語義表示中不再需要任何 game-specific 的 Python 函式名。IR 把量化與可容許性判準分開,第一批具名 filter profile 是 accept_all_v0.1 與 pair_relative_bscc_fairness_v0.1;由於成對相對的公平性判準需要雙方指派都已綁定,它通常掛在內層量詞上,而被過濾成空域的內層量詞取值為 ⊥ 而非 +∞ 或 −∞,外層量詞跳過取值 ⊥ 的候選,若全部被跳過則整體為 ⊥,以此重現 Run 149 的空回應集語義。本輪同時引入量詞順序債務、過濾器放置債務與未定義域債務:max min 與 min max 不因某個參考賽局恰好兩值相等就可互換,公平性判準跨越量詞移動會改變策略域,因此不得被靜默重寫成另一個式子。V_-、V_+、V_-^fair、V_+^fair 因此首次能由同一個 AST 語言加上不同的具名程式與 filter 表示,是排程/賽局分支回壓成一般演算的第一次;Run 151 隨即以 CDIR v0.19 實作該設計而未更動其量詞/filter 語義,用一個通用直譯器重建了 V_raw=1、V_MaxWeak=1、V_MaxStrong=0、V_MinStrong=1、V_BothStrong=0,而 Runs 157–160 的 SCNF 正規化文法與臨界配對基底也正是建立在這個 IR 的文法之上。
載入中…