← AMRAL · 軸 E

驗證

Validation

驗證層回答的問題是「研究結果如何被合法化、定量閉合與驗證?」——跟方法論(如何產生路徑)、 協議(角色如何協作)、自主模式(誰掌握方向)都不同。一個 Case 的驗證強度不由方法論或自主程度自動決定, 必須另外交代。

目前收錄的驗證框架

其他驗證概念

交接文件中提到、但尚未各自建立獨立頁面的驗證手段——先在此列出簡短說明。

  • Target Fidelity Audit — 檢查產出的形式化命題是否真的忠實對應原始問題陳述,而不是悄悄換了一個更容易的命題。
  • Adversarial Review — 由獨立角色(見 TRP 的 Agent B)主動嘗試攻破論證。
  • Blind Re-Derivation — 另一個不知道原結論的 Agent / 人,獨立重新推導,檢驗是否得到一致結果。
  • Proves-Too-Much Test — 檢查同一套論證方法是否也能「證明」已知為假的命題;若能,論證方法本身有問題。
  • Numerical Certificate — 有限、可重跑的數值計算作為部分結果的證書,不冒充為全域解析證明。
  • Lean 4 / Coq — 形式化證明助手,用於把候選證明壓成機器可檢查的形式。
  • External Expert Review — 站外、非本平台 Agent 的人類專家審查。
  • Evidence / Trust Boundary — 明確標示哪些主張有證據支撐、哪些仍是啟發式推測,兩者不能混淆呈現。