● GovSim-X · deterministic ABM sandbox
v1.0.0 build — 赛道二 · 社会模拟与推演
可复现 · 可审计 · 确定性

不预测现实,
但每一步都能被复核。

GovSim-X 是一个社会治理政策实验沙盒:以政策实验合同为入口,用确定性 ABM 演算全部数字,LLM 只负责把结果写成解释文字——两者严格分离,杜绝"语言模型编数字"。

每一次推演都记录同冲击基线、主方案、备选方案、参数来源、随机种子与审计包; 同种子重复运行逐字节一致。

01 / EVIDENCE CHAIN

证据如何绑定到这份源码

验收不是一句"通过了",而是一条可追溯的链:源码指纹 → 自动化检查 → 结构化证据。 源码一旦变动,旧证据会被判为 stale,发布预检以非零退出码阻断交付。

02 / QUALITY GATE

质量门实测结果

以下为构建 dd7d97a9 的一次完整运行,逐项耗时如实记录,含跳过的检查。

状态
检查项
耗时
03 / FIGURES

系统架构与机制证据

图表由仓库内脚本从实验结果生成,可随源码一同重新产出。

04 / REPRODUCIBILITY

同一份源码,两个操作系统

构建指纹已对行尾归一,使跨平台一致性可达。下面是同一次演示推演在 本地 Windows 与 GitHub Ubuntu 上的实际输出——指标完全相同。

本机 · WINDOWSseed 42,43,44
CI · UBUNTU LTSseed 42,43,44
✓ 逐字节相同 —— 引擎使用 random.Random(seed) 而非 numpy 随机数,跨平台比特级一致;这是"实验真实性"的设计前提,不是巧合。
05 / BOUNDARY

这个系统不做什么

系统输出是情景证据,不是现实预测

  • 不代表现实政策的预测准确率,也不替代统计因果识别与公共决策程序。
  • 外部有效性仍受限:候选数据源均为 candidate_not_authorized, 授权来源数为 0,holdout 未启动——因此不输出任何现实校准误差或真实留出指标。
  • 部分机制默认关闭(校准、代理模型等研究模块未接入主链路),其量化结论仅代表模块自测。
  • 本页是静态快照,不会实时重算;真实推演请运行仓库代码或触发在线工作流。
06 / RUN IT

如何自己验证

LOCAL 本地运行

克隆后装锁定依赖,启动交互前端;完整推演约 11 秒。

pip install -r requirements-lock.txt
python scripts/quality_report.py
streamlit run frontend/app.py

CI 在线真实推演

无需本地安装:在仓库 Actions 页面手动触发一次真实推演,产物可直接下载。

Actions → Online Run (manual)
       → Run workflow

VERIFY 校验证据

比对证据文件记录的源码指纹与当前源码是否一致,非零退出即表示证据已过期。

python scripts/release_preflight.py
python scripts/build_fingerprint.py